Hermes status: configuração real, modelos e providers

Uma leitura operacional do que esta instância está usando hoje — sem achismo, só com inspeção real.

O quadro geral é bom: o seu Hermes está funcional e coerente para o uso principal. O chat principal roda em openai-codex com gpt-5.4, há fallback configurado para deepseek, os auxiliares principais estão configurados em gpt-5.4-mini e o gateway do Telegram está ativo. O que falta hoje não é base; são peças opcionais como backends externos de busca web e alguns providers secundários.

TL;DR Hoje esta instalação do Hermes está ok para uso diário. O desenho principal é: OpenAI Codex como rota principal, gpt-5.4-mini como auxiliar, DeepSeek como fallback e duas credenciais Codex no pool — uma antiga rate-limited e outra ativa. Os avisos do doctor seguem majoritariamente opcionais: providers extras não configurados e toolsets que dependem de chaves que você ainda não escolheu ligar.

De onde esta página saiu

Esta página foi montada a partir da inspeção real da instância, com estes comandos e arquivos:

  • hermes config;
  • hermes config check;
  • hermes doctor;
  • hermes status --all;
  • hermes auth list;
  • hermes tools list;
  • ~/.hermes/config.yaml.

Trecho real do modelo principal

model:
  base_url: https://chatgpt.com/backend-api/codex
  default: gpt-5.4
  provider: openai-codex

Trecho real do fallback

fallback_providers:
- model: deepseek-v4-flash
  provider: deepseek

Mapa geral da configuração

Bloco Estado atual Leitura operacional
Modelo principal openai-codex + gpt-5.4 é a rota principal do agente
Auxiliares principais openai-codex + gpt-5.4-mini compression, approval, vision, web_extract, title_generation e outros blocos auxiliares
Fallback deepseek + deepseek-v4-flash há uma rota alternativa explícita
Terminal backend local · timeout 180s execução local consistente com o uso do host
Timezone America/Bahia alinhado com o seu fuso
STT / TTS STT local · TTS Edge pt-BR-FranciscaNeural boa combinação para uso em português
Gateway Telegram configurado · serviço rodando mensageria principal está ativa
Principal openai-codex gpt-5.4 Auxiliares openai-codex gpt-5.4-mini Fallback deepseek deepseek-v4-flash Gateway Telegram running Chat sessão principal Side tasks compressão · visão · títulos Resiliência fallback de provider
O desenho atual é simples: uma rota principal clara, uma camada auxiliar definida, fallback explícito e gateway funcionando.

Modelo principal

O modelo principal desta instalação está definido de forma direta: openai-codex com gpt-5.4. É essa rota que sustenta a conversa principal do agente.

Trecho real do modelo principal

model:
  default: gpt-5.4
  provider: openai-codex

Modelos auxiliares

O bloco auxiliar está concentrado principalmente em openai-codex com gpt-5.4-mini. A exceção atual é tts_audio_tags, que mantém provider definido, mas sem model explícito.

Trecho real dos auxiliares

auxiliary:
  approval:
    model: gpt-5.4-mini
    provider: openai-codex
  compression:
    model: gpt-5.4-mini
    provider: openai-codex
  curator:
    model: gpt-5.4-mini
    provider: openai-codex
  kanban_decomposer:
    model: gpt-5.4-mini
    provider: openai-codex
  mcp:
    model: gpt-5.4-mini
    provider: openai-codex
  monitor:
    model: gpt-5.4-mini
    provider: openai-codex
  profile_describer:
    model: gpt-5.4-mini
    provider: openai-codex
  skills_hub:
    model: gpt-5.4-mini
    provider: openai-codex
  title_generation:
    model: gpt-5.4-mini
    provider: openai-codex
  triage_specifier:
    model: gpt-5.4-mini
    provider: openai-codex
  tts_audio_tags:
    model: ''
    provider: openai-codex
  vision:
    model: gpt-5.4-mini
    provider: openai-codex
  web_extract:
    model: gpt-5.4-mini
    provider: openai-codex

O que faz cada auxiliar

Auxiliar Modelo atual Função
approval openai-codex / gpt-5.4-mini apoia fluxos de aprovação e decisões rápidas do runtime
compression openai-codex / gpt-5.4-mini resume e comprime contexto para caber melhor na janela da conversa
curator openai-codex / gpt-5.4-mini faz a revisão e curadoria de skills no fluxo de manutenção
kanban_decomposer openai-codex / gpt-5.4-mini quebra uma tarefa em subtarefas e ajuda a distribuir trabalho no Kanban
mcp openai-codex / gpt-5.4-mini apoia interações auxiliares ligadas ao cliente MCP e integração de ferramentas
monitor openai-codex / gpt-5.4-mini classifica urgência e importância em automações como monitores e filtros
profile_describer openai-codex / gpt-5.4-mini gera descrições curtas de perfis para roteamento e dashboard
skills_hub openai-codex / gpt-5.4-mini apoia busca, descoberta e instalação de skills
title_generation openai-codex / gpt-5.4-mini gera títulos curtos para sessões, resumos e superfícies derivadas
triage_specifier openai-codex / gpt-5.4-mini transforma uma ideia vaga em uma especificação executável no Kanban
tts_audio_tags openai-codex / model unset insere tags expressivas no texto antes do fluxo de Gemini TTS, quando usado
vision openai-codex / gpt-5.4-mini apoia leitura e interpretação auxiliar de imagens
web_extract openai-codex / gpt-5.4-mini faz extração estruturada de conteúdo web em fluxos de leitura e coleta
Leitura prática O desenho é simples: modelo principal para conversa, modelo menor para auxiliares e fallback separado. Isso tende a dar boa relação entre custo, velocidade e previsibilidade.

Providers e credenciais

O estado de providers é bem típico de uma instalação madura: poucos provedores realmente ativos e vários outros ainda não ligados.

Provider Estado Observação
openai-codex ativo provider principal do chat
deepseek ativo há API key e fallback configurado
openai-api configurado chave presente, embora não seja a rota principal do chat
OpenRouter não configurado afeta recursos opcionais e alguns toolsets
Anthropic não configurado sem impacto no fluxo principal atual
Google / Gemini não configurado opcional
xAI não configurado impacta x_search

Saída real de credenciais

openai-codex (2 credentials):
  #1  device_code          oauth   device_code rate-limited usage_limit_reached (429)
  #2  openai-codex-oauth-2 oauth   device_code ←

deepseek (1 credentials):
  #1  DEEPSEEK_API_KEY     api_key env:DEEPSEEK_API_KEY ←

openai-api (1 credentials):
  #1  OPENAI_API_KEY       api_key env:OPENAI_API_KEY ←

Este ponto conversa diretamente com a sua observação de hoje: você está usando duas contas do ChatGPT Plus para isso. Na prática, essa realidade já aparece no Hermes como duas credenciais no provider openai-codex. Uma delas está em cooldown por rate limit; a outra é a credencial ativa neste momento.

O que isso significa O seu Hermes já está estruturado para sobreviver melhor a limites do Codex do que uma instalação com conta única. Não é “só duas contas”; é uma forma concreta de resiliência operacional.

Toolsets e saúde geral

A parte central dos toolsets está habilitada: browser, terminal, file, code_execution, vision, skills, memory, session_search, delegation, cronjob e messaging.

Trecho representativo do runtime

✓ enabled  web
✓ enabled  browser
✓ enabled  terminal
✓ enabled  file
✓ enabled  code_execution
✓ enabled  vision
✓ enabled  tts
✓ enabled  skills
✓ enabled  memory
✓ enabled  delegation
✓ enabled  cronjob
✓ enabled  messaging

Mas aqui existe uma distinção importante: toolset habilitado não significa backend completo configurado. O caso mais visível é web. Ele aparece habilitado, mas o doctor aponta ausência de chaves para backends como Exa, Tavily e Firecrawl.

Aviso útil Isso não quer dizer que o Hermes esteja “quebrado”. Quer dizer apenas que a navegação por browser local está boa, enquanto a busca web por provedores externos ainda não está completa.

O diagnóstico de saúde geral foi positivo. O hermes doctor confirmou:

  • Python, ambiente virtual e versão do Hermes em ordem;
  • certificados SSL válidos;
  • config.yaml e .env presentes e legíveis;
  • OpenAI Codex autenticado;
  • agent-browser e Playwright Chromium instalados;
  • gateway ativo;
  • memória built-in funcionando.

O próprio doctor resumiu o cenário como uma instalação saudável com recursos opcionais ainda não configurados.

Mensageria, voz e ambiente

Fora do núcleo de modelos, o ambiente também está consistente.

Área Estado Leitura
Telegram configurado é a integração viva de mensageria hoje
Discord / Slack / Signal / WhatsApp não configurados sem problema, se não fazem parte do seu uso atual
STT local · modelo base bom para transcrição sem depender de API
TTS Edge · pt-BR-FranciscaNeural boa escolha para português do Brasil
Terminal local execução direta no host, sem camada remota no meio

O que está ok hoje

  1. O caminho principal está claro: Codex com gpt-5.4.
  2. Há redundância útil: duas credenciais Codex + fallback em DeepSeek.
  3. Os auxiliares principais estão amarrados a um modelo menor coerente: gpt-5.4-mini.
  4. O browser local está realmente instalado, não só “habilitado no YAML”.
  5. O gateway está no ar e o Telegram está integrado.
  6. Voz e timezone estão alinhados com seu uso real.

Pendências que existem, mas não são críticas

  1. Busca web externa incompleta: falta escolher e ligar backends como Exa, Tavily ou Firecrawl.
  2. Providers extras ainda não configurados: OpenRouter, Anthropic, Gemini, xAI e outros.
  3. Uma credencial antiga do Codex está rate-limited: não quebra o fluxo porque a segunda está ativa.
  4. Busca web externa e providers opcionais continuam separados do núcleo: isso simplifica o desenho, mas deixa recursos extras dependentes de configuração futura.

Recomendações pertinentes

  1. Manter os auxiliares de Kanban e monitoramento em gpt-5.4-mini faz sentido: são tarefas curtas, estruturadas e mais baratas que o modelo principal.
  2. Se você passar a usar Gemini TTS com frequência, vale revisar o slot tts_audio_tags separadamente.
  3. O melhor próximo investimento técnico é a camada web: se você quiser melhorar pesquisa e extração fora do browser local, vale escolher um backend externo entre Exa, Tavily ou Firecrawl.
  4. Não há urgência em ligar providers extras como Anthropic, OpenRouter ou Gemini se o seu fluxo principal já está bem servido por Codex + DeepSeek fallback.
  5. Se a credencial rate-limited antiga do Codex não tiver mais utilidade, pode valer documentar melhor o pool ou limpar a credencial obsoleta depois, só para reduzir ruído operacional.

Conclusão

A melhor leitura desta instância não é “tem muita coisa faltando”. A melhor leitura é outra: o núcleo já está pronto e operacional. O que aparece como pendência é, em boa parte, expansão opcional.

Se você continuar usando o Hermes principalmente em cima de Codex, terminal, browser local, Telegram e skills, a configuração atual já sustenta esse fluxo. Os próximos ajustes — se você quiser fazê-los — são de refinamento: melhorar a camada de busca web, eventualmente organizar melhor os providers secundários e decidir com mais intenção quais recursos opcionais merecem configuração explícita.

Síntese final Hoje o seu Hermes está saudável, utilizável e coerente. Não está “completo” no sentido de ativar todo provedor opcional, mas está bem montado para o que você realmente usa.