Hermes status: configuração real, modelos e providers
Uma leitura operacional do que esta instância está usando hoje — sem achismo, só com inspeção real.
O quadro geral é bom: o seu Hermes está funcional e coerente para o uso principal. O chat principal roda em openai-codex com gpt-5.4, há fallback configurado para deepseek, os auxiliares principais estão configurados em gpt-5.4-mini e o gateway do Telegram está ativo. O que falta hoje não é base; são peças opcionais como backends externos de busca web e alguns providers secundários.
De onde esta página saiu
Esta página foi montada a partir da inspeção real da instância, com estes comandos e arquivos:
hermes config;hermes config check;hermes doctor;hermes status --all;hermes auth list;hermes tools list;~/.hermes/config.yaml.
model:
base_url: https://chatgpt.com/backend-api/codex
default: gpt-5.4
provider: openai-codex
fallback_providers:
- model: deepseek-v4-flash
provider: deepseek
Mapa geral da configuração
| Bloco | Estado atual | Leitura operacional |
|---|---|---|
| Modelo principal | openai-codex + gpt-5.4 |
é a rota principal do agente |
| Auxiliares principais | openai-codex + gpt-5.4-mini |
compression, approval, vision, web_extract, title_generation e outros blocos auxiliares |
| Fallback | deepseek + deepseek-v4-flash |
há uma rota alternativa explícita |
| Terminal | backend local · timeout 180s | execução local consistente com o uso do host |
| Timezone | America/Bahia |
alinhado com o seu fuso |
| STT / TTS | STT local · TTS Edge pt-BR-FranciscaNeural |
boa combinação para uso em português |
| Gateway | Telegram configurado · serviço rodando | mensageria principal está ativa |
Modelo principal
O modelo principal desta instalação está definido de forma direta: openai-codex com gpt-5.4. É essa rota que sustenta a conversa principal do agente.
model:
default: gpt-5.4
provider: openai-codex
Modelos auxiliares
O bloco auxiliar está concentrado principalmente em openai-codex com gpt-5.4-mini. A exceção atual é tts_audio_tags, que mantém provider definido, mas sem model explícito.
auxiliary:
approval:
model: gpt-5.4-mini
provider: openai-codex
compression:
model: gpt-5.4-mini
provider: openai-codex
curator:
model: gpt-5.4-mini
provider: openai-codex
kanban_decomposer:
model: gpt-5.4-mini
provider: openai-codex
mcp:
model: gpt-5.4-mini
provider: openai-codex
monitor:
model: gpt-5.4-mini
provider: openai-codex
profile_describer:
model: gpt-5.4-mini
provider: openai-codex
skills_hub:
model: gpt-5.4-mini
provider: openai-codex
title_generation:
model: gpt-5.4-mini
provider: openai-codex
triage_specifier:
model: gpt-5.4-mini
provider: openai-codex
tts_audio_tags:
model: ''
provider: openai-codex
vision:
model: gpt-5.4-mini
provider: openai-codex
web_extract:
model: gpt-5.4-mini
provider: openai-codex
O que faz cada auxiliar
| Auxiliar | Modelo atual | Função |
|---|---|---|
approval |
openai-codex / gpt-5.4-mini |
apoia fluxos de aprovação e decisões rápidas do runtime |
compression |
openai-codex / gpt-5.4-mini |
resume e comprime contexto para caber melhor na janela da conversa |
curator |
openai-codex / gpt-5.4-mini |
faz a revisão e curadoria de skills no fluxo de manutenção |
kanban_decomposer |
openai-codex / gpt-5.4-mini |
quebra uma tarefa em subtarefas e ajuda a distribuir trabalho no Kanban |
mcp |
openai-codex / gpt-5.4-mini |
apoia interações auxiliares ligadas ao cliente MCP e integração de ferramentas |
monitor |
openai-codex / gpt-5.4-mini |
classifica urgência e importância em automações como monitores e filtros |
profile_describer |
openai-codex / gpt-5.4-mini |
gera descrições curtas de perfis para roteamento e dashboard |
skills_hub |
openai-codex / gpt-5.4-mini |
apoia busca, descoberta e instalação de skills |
title_generation |
openai-codex / gpt-5.4-mini |
gera títulos curtos para sessões, resumos e superfícies derivadas |
triage_specifier |
openai-codex / gpt-5.4-mini |
transforma uma ideia vaga em uma especificação executável no Kanban |
tts_audio_tags |
openai-codex / model unset |
insere tags expressivas no texto antes do fluxo de Gemini TTS, quando usado |
vision |
openai-codex / gpt-5.4-mini |
apoia leitura e interpretação auxiliar de imagens |
web_extract |
openai-codex / gpt-5.4-mini |
faz extração estruturada de conteúdo web em fluxos de leitura e coleta |
Providers e credenciais
O estado de providers é bem típico de uma instalação madura: poucos provedores realmente ativos e vários outros ainda não ligados.
| Provider | Estado | Observação |
|---|---|---|
openai-codex |
ativo | provider principal do chat |
deepseek |
ativo | há API key e fallback configurado |
openai-api |
configurado | chave presente, embora não seja a rota principal do chat |
| OpenRouter | não configurado | afeta recursos opcionais e alguns toolsets |
| Anthropic | não configurado | sem impacto no fluxo principal atual |
| Google / Gemini | não configurado | opcional |
| xAI | não configurado | impacta x_search |
openai-codex (2 credentials):
#1 device_code oauth device_code rate-limited usage_limit_reached (429)
#2 openai-codex-oauth-2 oauth device_code ←
deepseek (1 credentials):
#1 DEEPSEEK_API_KEY api_key env:DEEPSEEK_API_KEY ←
openai-api (1 credentials):
#1 OPENAI_API_KEY api_key env:OPENAI_API_KEY ←
Este ponto conversa diretamente com a sua observação de hoje: você está usando duas contas do ChatGPT Plus para isso. Na prática, essa realidade já aparece no Hermes como duas credenciais no provider openai-codex. Uma delas está em cooldown por rate limit; a outra é a credencial ativa neste momento.
Toolsets e saúde geral
A parte central dos toolsets está habilitada: browser, terminal, file, code_execution, vision, skills, memory, session_search, delegation, cronjob e messaging.
✓ enabled web
✓ enabled browser
✓ enabled terminal
✓ enabled file
✓ enabled code_execution
✓ enabled vision
✓ enabled tts
✓ enabled skills
✓ enabled memory
✓ enabled delegation
✓ enabled cronjob
✓ enabled messaging
Mas aqui existe uma distinção importante: toolset habilitado não significa backend completo configurado. O caso mais visível é web. Ele aparece habilitado, mas o doctor aponta ausência de chaves para backends como Exa, Tavily e Firecrawl.
O diagnóstico de saúde geral foi positivo. O hermes doctor confirmou:
- Python, ambiente virtual e versão do Hermes em ordem;
- certificados SSL válidos;
config.yamle.envpresentes e legíveis;- OpenAI Codex autenticado;
agent-browsere Playwright Chromium instalados;- gateway ativo;
- memória built-in funcionando.
O próprio doctor resumiu o cenário como uma instalação saudável com recursos opcionais ainda não configurados.
Mensageria, voz e ambiente
Fora do núcleo de modelos, o ambiente também está consistente.
| Área | Estado | Leitura |
|---|---|---|
| Telegram | configurado | é a integração viva de mensageria hoje |
| Discord / Slack / Signal / WhatsApp | não configurados | sem problema, se não fazem parte do seu uso atual |
| STT | local · modelo base |
bom para transcrição sem depender de API |
| TTS | Edge · pt-BR-FranciscaNeural |
boa escolha para português do Brasil |
| Terminal | local | execução direta no host, sem camada remota no meio |
O que está ok hoje
- O caminho principal está claro: Codex com
gpt-5.4. - Há redundância útil: duas credenciais Codex + fallback em DeepSeek.
- Os auxiliares principais estão amarrados a um modelo menor coerente:
gpt-5.4-mini. - O browser local está realmente instalado, não só “habilitado no YAML”.
- O gateway está no ar e o Telegram está integrado.
- Voz e timezone estão alinhados com seu uso real.
Pendências que existem, mas não são críticas
- Busca web externa incompleta: falta escolher e ligar backends como Exa, Tavily ou Firecrawl.
- Providers extras ainda não configurados: OpenRouter, Anthropic, Gemini, xAI e outros.
- Uma credencial antiga do Codex está rate-limited: não quebra o fluxo porque a segunda está ativa.
- Busca web externa e providers opcionais continuam separados do núcleo: isso simplifica o desenho, mas deixa recursos extras dependentes de configuração futura.
Recomendações pertinentes
- Manter os auxiliares de Kanban e monitoramento em
gpt-5.4-minifaz sentido: são tarefas curtas, estruturadas e mais baratas que o modelo principal. - Se você passar a usar Gemini TTS com frequência, vale revisar o slot
tts_audio_tagsseparadamente. - O melhor próximo investimento técnico é a camada web: se você quiser melhorar pesquisa e extração fora do browser local, vale escolher um backend externo entre Exa, Tavily ou Firecrawl.
- Não há urgência em ligar providers extras como Anthropic, OpenRouter ou Gemini se o seu fluxo principal já está bem servido por Codex + DeepSeek fallback.
- Se a credencial rate-limited antiga do Codex não tiver mais utilidade, pode valer documentar melhor o pool ou limpar a credencial obsoleta depois, só para reduzir ruído operacional.
Conclusão
A melhor leitura desta instância não é “tem muita coisa faltando”. A melhor leitura é outra: o núcleo já está pronto e operacional. O que aparece como pendência é, em boa parte, expansão opcional.
Se você continuar usando o Hermes principalmente em cima de Codex, terminal, browser local, Telegram e skills, a configuração atual já sustenta esse fluxo. Os próximos ajustes — se você quiser fazê-los — são de refinamento: melhorar a camada de busca web, eventualmente organizar melhor os providers secundários e decidir com mais intenção quais recursos opcionais merecem configuração explícita.