v0.8.0

Hermes Agent v0.8.0 — A Versão Intelligence


Visão Geral

v0.8.0 — The Intelligence Release. Lançada em 8 de abril de 2026. Apenas 5 dias após a v0.7.0: 209 PRs mesclados · 82 issues resolvidas · centenas de arquivos alterados · dezenas de contribuidores da comunidade.

Se a v0.7.0 foi “o release da resiliência” (provedores de memória intercambiáveis, navegador anti-detecção Camofox, endurecimento profundo do gateway), a v0.8.0 tem um único foco — ficar mais inteligente. O Hermes aprendeu a diagnosticar seus próprios modos de falha e corrigir a si mesmo. Aprendeu a notificar você quando tarefas em segundo plano terminam. Aprendeu a monitorar a atividade real das ferramentas em vez do tempo de relógio ao decidir se deve encerrar por timeout. Não são apenas itens de funcionalidade. São um aumento sistemático na inteligência do agente.


Principais Funcionalidades

1. Notificações Automáticas de Tarefas em Segundo Plano (notify_on_complete) — Chega de Polling

Tarefas em segundo plano agora notificam automaticamente o agente quando terminam. Inicie um processo de longa duração — treinamento de modelos, suítes de teste, deploys, builds — e o agente captura os resultados ao finalizar. Nada de ps, nada de tail -f, nada de loops de polling. O agente simplesmente avisa quando estiver pronto.

# Inicia um job de treinamento em segundo plano
hermes run "python train.py --epochs 100" --background

# Continue trabalhando em outras coisas com o agente
# Quando o treinamento terminar, o agente é notificado e reporta os resultados

(#5779)

2. Xiaomi MiMo v2 Pro Gratuito no Nous Portal

O plano gratuito do Nous Portal agora inclui o Xiaomi MiMo v2 Pro para tarefas auxiliares — compressão, visão, sumarização. A interface de seleção de modelos exibe os preços ao lado de cada modelo, e o controle de acesso do plano gratuito é transparente. Se você estava adiando usar o Hermes por causa da carteira, esta semana o plano gratuito melhorou significativamente.

(#6018, #5880)

3. Troca de Modelos ao Vivo (Comando /model) — Alterne Modelos Durante a Sessão

Alterne modelos e provedores no meio da sessão pelo CLI, Telegram, Discord, Slack ou qualquer plataforma do gateway. O resolvedor reconhece agregadores — se você estiver usando OpenRouter ou Nous Portal, ele mantém você no agregador quando o modelo está disponível lá, recorrendo a provedores diretos apenas quando necessário. Telegram e Discord recebem seletores interativos com botões inline — toque para selecionar, sem necessidade de digitar.

# Alterne a qualquer momento durante uma sessão
/model claude-sonnet-4-20250514

# Ou abra o seletor interativo
/model

(#5181, #5742)

4. Orientação de Uso de Ferramentas Auto-Otimizada para GPT/Codex — O Agente Corrigiu a Si Mesmo

Este é o PR mais fascinante tecnicamente da v0.8.0. A equipe construiu um pipeline automatizado de benchmark comportamental que testou sistematicamente os modelos GPT e Codex, identificou cinco modos específicos de falha na chamada de ferramentas, gerou strings de orientação direcionadas para corrigi-los, mediu a melhoria e enviou o resultado como parte do system prompt. O agente se diagnosticou e se corrigiu — os humanos participaram como revisores, não como engenheiros de prompt.

Junto com isso, há orientação de disciplina de execução nos system prompts e preenchimento de prefácio exclusivo para raciocínio (thinking-only prefill continuation) para raciocínio estruturado, tudo isso melhorando drasticamente a confiabilidade ao executar o Hermes em modelos da OpenAI.

(#6120, #5414, #5931)

5. Google AI Studio (Gemini) como Provedor Nativo

Acesso direto aos modelos Gemini através da API do Google AI Studio. Integrado ao registro models.dev para detecção automática em tempo real do comprimento de contexto — chega de especificar limites de tokens manualmente.

(#5577)

6. Timeouts Inteligentes por Inatividade — Agentes Ativos Nunca São Mortos

Os timeouts do gateway e do cron agora monitoram a atividade real das ferramentas em vez do tempo de relógio. Tarefas de longa duração que estão produzindo saída ativamente (executando comandos, lendo/escrevendo arquivos) nunca serão terminadas. Apenas agentes verdadeiramente ociosos sofrem timeout.

(#5389, #5440)

7. Botões de Aprovação no Slack e Telegram — Diga Adeus a Digitar /approve

As aprovações de comandos perigosos agora acontecem através de botões nativos da plataforma. O Slack preserva o contexto da thread, o Telegram exibe reações emoji para o status de aprovação. Muito mais rápido do que digitar /approve toda vez.

(#5890, #5975)

8. MCP OAuth 2.1 PKCE + Verificação de Malware OSV

Cliente OAuth 2.1 PKCE totalmente compatível com os padrões para autenticação de servidores MCP. Além disso, pacotes de extensão MCP são verificados automaticamente no banco de dados de vulnerabilidades OSV no momento da instalação — detectando código malicioso antes que ele seja executado.

(#5420, #5305)

9. Logging Centralizado e Validação de Configuração

Logging estruturado em ~/.hermes/logs/ (agent.log + errors.log), com o novo comando hermes logs para acompanhar e filtrar. A validação da estrutura de configuração detecta YAML malformado na inicialização com mensagens acionáveis — chega de “falhas misteriosas”.

# Ver logs recentes
hermes logs

# Apenas erros
hermes logs --level WARNING

(#5430, #5426)

10. Expansão do Sistema de Plugins

Plugins agora podem:

  • Registrar subcomandos CLI independentes sem tocar no código principal
  • Receber hooks de API com escopo de requisição com IDs de correlação
  • Solicitar variáveis de ambiente obrigatórias durante a instalação
  • Conectar-se a eventos do ciclo de vida da sessão (finalizar / resetar)

(#5295, #5427, #5470, #6129)

11. Matrix Promovido a Tier 1

Matrix ganha reações, confirmações de leitura, formatação rica e gerenciamento de salas — atingindo paridade de funcionalidades com Telegram e Discord como plataforma de primeira classe.

12. Reforço de Segurança

Proteções contra SSRF, mitigações de ataques de timing, prevenção de travessia de diretórios em tar, proteções contra vazamento de credenciais, isolamento entre sessões — uma auditoria de segurança sistemática em toda a base de código.

(#5944, #5613, #5629)


Agente Principal e Arquitetura

Suporte a Provedores e Modelos

  • Provedor nativo Google AI Studio (Gemini) com detecção automática models.dev para comprimento de contexto
  • Comando /model — revisão completa do sistema de provedor+modelo com troca ao vivo no CLI e em todos os gateways
  • Seletor interativo de modelos para Telegram e Discord com botões inline
  • Controle de acesso do plano gratuito do Nous Portal com exibição de preços na seleção de modelos
  • Cache de prompt do xAI (Grok) via cabeçalho x-grok-conv-id
  • Provedor TTS MiniMax (speech-2.8)
  • Aviso de modelo não-agentic — alerta ao carregar LLMs do Hermes não projetados para uso de ferramentas
  • Autenticação Ollama Cloud, persistência de troca de modelo, autocompletar de alias com Tab
  • Exibição de preços de modelos para OpenRouter e Nous Portal
  • Fallback de pagamento do cliente auxiliar — tenta novamente com o próximo provedor ao receber 402
  • Cliente auxiliar resolve provedores customizados nomeados e alias ‘main’
  • Janelas de reset de credenciais do provedor respeitadas no failover em pool
  • Sincronização de token OAuth entre pool de credenciais e arquivo de credenciais
  • Credenciais OAuth expiradas não bloqueiam mais a detecção automática do OpenRouter
  • Pool de credenciais OAuth do Codex — correções de desconexão e importação de token expirado
  • Detecção automática de visão tenta o provedor principal primeiro
  • Comprimentos de contexto do MiniMax, guarda de thinking, modelo auxiliar, correções de base_url de configuração
  • Detecção automática de endpoint Z.AI via sonda e cache
  • Correções de resolução de provedor/modelo da comunidade — resgatados 4 PRs da comunidade

Loop do Agente e Conversação

  • Orientação de uso de ferramentas auto-otimizada para GPT/Codex — benchmark comportamental automatizado identificou e corrigiu 5 modos de falha
  • Orientação de disciplina de execução para GPT/Codex nos system prompts
  • Preenchimento de prefácio exclusivo para raciocínio (thinking-only prefill continuation) para raciocínio estruturado
  • Aceitar respostas apenas de raciocínio sem novas tentativas — define conteúdo como “(empty)” em vez de repetir infinitamente
  • Backoff com jitter para novas tentativas — backoff exponencial com jitter para retentativas de API
  • Gerenciamento inteligente de assinaturas de bloco de thinking — preserva assinaturas de thinking do Anthropic entre turnos
  • Coerção de argumentos de chamada de ferramenta para corresponder aos tipos do JSON Schema — corrige modelos que enviam strings em vez de números/booleanos
  • Salvar resultados de ferramentas muito grandes em arquivo em vez de truncamento destrutivo
  • Fallback de streaming melhorado após falhas de edição
  • Lacunas de saída vazia do Codex cobertas no fallback + normalizador + cliente auxiliar
  • Preenchimento retroativo da saída de stream do Codex a partir de eventos output_item.done
  • Consumidor de stream cria nova mensagem após limites de ferramenta
  • Filtrar roles apenas de transcrição do payload de chat-completions
  • Sanitizar tool_calls para todas as APIs strict (Fireworks, Mistral, etc.)
  • Fazer bridge de tool-calls no adaptador copilot-acp

Memória e Sessões

  • Provedor de memória Supermemory — multi-container, search_mode, template de identidade, override de variável de ambiente
  • Sessões de thread compartilhadas por padrão — suporte multi-usuário em plataformas de gateway
  • Sessões de subagente vinculadas ao pai e ocultas da lista de sessões
  • Isolamento de memória com escopo de perfil e suporte a clone
  • Thread gateway user_id para plugins de memória para escopo por usuário
  • Revisão do plugin Honcho + sistema de registro de CLI de plugins
  • Compatibilidade com mem0 API v2, isolamento de contexto de prefetch, redação de secrets
  • RetainDB — rotas de API, fila de escrita, correções de dialética e modelo de agente
  • Revisão do plugin de memória Hindsight + correções do assistente de configuração de memória
  • Rede de segurança OpenViking atexit para commit de sessão, cabeçalhos de escopo de tenant
  • Consulta brv do ByteRover executada sincronamente antes da chamada ao LLM
  • Mensagem limpa do usuário usada para todas as operações do provedor de memória

Plataformas de Mensageria (Gateway)

Núcleo do Gateway

  • Timeout baseado em inatividade substitui tempo de relógio — tarefas ativas nunca são mortas
  • Botões de aprovação para Slack e Telegram + preservação de contexto de thread no Slack
  • Live-stream de saída de /update + encaminhamento de prompts interativos ao usuário
  • Suporte a timeout infinito + notificações periódicas + mensagens de erro acionáveis
  • Prevenção de mensagens duplicadas — dedup do gateway + proteção de stream parcial
  • Persistência de delivery_info do webhook + session id completo em /status
  • Truncamento de pré-visualização de ferramenta respeita tool_preview_length em todos os modos de progresso (novos e existentes)
  • Chave de sessão de aprovação isolada por turno
  • Bypass da proteção de sessão ativa para /approve, /deny, /stop, /new
  • Indicador de digitação pausado durante esperas de aprovação
  • Verificação de caption usa correspondência exata linha por linha em vez de substring (todas as plataformas)
  • Tags MEDIA: removidas das mensagens de gateway em streaming, extraídas da entrega do cron
  • Unidades de serviço com reconhecimento de perfil + limpeza de transcrição de voz
  • PairingStore thread-safe com escritas atômicas
  • Wrappers de métodos estáticos do Cron para evitar self-binding

Melhorias por Plataforma

Plataforma Principais Mudanças
Telegram Vinculação de skills a tópicos de grupo, aprovações por reação emoji, prevenção de mensagens duplicadas, sanitização de nomes de comando, skills desabilitadas por plataforma
Discord Controles de canal (ignored_channels / no_thread_channels), skills como slash commands nativos, /approve registrado como slash commands, remoção do intent de membros desnecessário
Slack Engajamento automático em threads, mrkdwn em edit_message, respostas em thread sem @mentions
Matrix Upgrade para Tier 1: reações, confirmações de leitura, formatação rica, gerenciamento de salas, entrada CJK, E2EE, reconexão
Signal Entrega completa de tags MEDIA:
Mattermost Suporte a anexos de arquivo
Feishu Botões de aprovação em cards interativos, correções de reconexão e ACL
Webhooks Token de template {__raw__}, passagem de thread_id para tópicos de fórum

CLI e Experiência do Usuário

CLI Interativo

  • Adiar conteúdo da resposta até que o bloco de raciocínio seja concluído
  • Linhas fantasmas da barra de status limpas ao redimensionar o terminal
  • Normalizar finais de linha \r\n e \r em texto colado
  • Suporte nativo a colagem de imagens no Windows
  • --yolo e outras flags não são mais silenciosamente descartadas quando posicionadas antes do subcomando ‘chat’
  • Erros do ChatConsole, scroll do curses, banner com reconhecimento de skin, correções de estado do git

Configuração e Setup

  • Validação da estrutura de configuração — detecta YAML malformado na inicialização com mensagens acionáveis
  • Logging centralizado em ~/.hermes/logs/ (agent.log + errors.log) com comando hermes logs
  • Diagnósticos do Doctor — verificações de sincronização de provedores, migração de configuração, diagnósticos de WAL e mem0
  • Logging de debug de timeout e diagnósticos voltados ao usuário melhorados
  • Esforço de raciocínio unificado apenas em config.yaml
  • Lista de permissão permanente de comandos carregada na inicialização
  • hermes auth remove agora limpa permanentemente credenciais semeadas por variáveis de ambiente
  • Skills empacotadas sincronizadas com todos os perfis durante a atualização
  • hermes update não mata mais o serviço de gateway recém-reiniciado
  • Timeouts de subprocess.run() adicionados a todos os comandos CLI do gateway
  • Links da documentação adicionados às seções do assistente de configuração

Sistema Cron

  • Timeout de cron baseado em inatividade — tarefas ativas executam indefinidamente
  • Injeção de script pré-execução para coleta de dados e detecção de mudanças
  • Rastreamento de falhas de entrega no status do job
  • Orientação de entrega nos prompts do cron — evita uso excessivo de send_message
  • Arquivos MEDIA entregues como anexos nativos da plataforma
  • Supressão [SILENT] funciona em qualquer lugar da resposta
  • Endurecimento contra path traversal no cron

Sistema de Ferramentas

Terminal e Execução

  • Execute_code em backends remotos — Docker, SSH, Modal e outros backends de terminal remoto
  • Contexto de código de saída para ferramentas CLI comuns — ajuda o agente a entender o que deu errado
  • Descoberta progressiva de dicas de subdiretórios — o agente aprende a estrutura do projeto enquanto navega
  • notify_on_complete para processos em segundo plano
  • Configuração de ambiente Docker — variáveis de ambiente explícitas do container via docker_env
  • Metadados de aprovação incluídos nos resultados da ferramenta de terminal
  • Parâmetro workdir sanitizado em todos os backends
  • Provedor de navegador gerenciado alterado de Browserbase para Browser Use
  • Provedor de navegador em nuvem Firecrawl
  • Avaliação JS via parâmetro expression do browser_console
  • Correções para navegador no Windows

MCP

  • MCP OAuth 2.1 PKCE — cliente OAuth totalmente compatível com os padrões
  • Verificação de malware OSV para pacotes de extensão MCP
  • Preferir structuredContent sobre text + sentinela no_mcp
  • Aviso de toolsets desconhecidos suprimido para nomes de servidor MCP

Web e Arquivos

  • Suporte a documentos .zip + montagem automática de diretórios de cache em backends remotos
  • Redação de secrets de consulta em erros de send_message

Delegação

  • Compartilhamento de pool de credenciais + dicas de caminho de workspace para subagentes

ACP (VS Code / Zed / JetBrains)

  • Melhorias agregadas do ACP — compatibilidade de auth, correções de protocolo, anúncios de comando, delegação, eventos SSE

Ecossistema de Skills

Sistema de Skills

  • Interface de configuração de skills — skills podem declarar configurações obrigatórias em config.yaml, solicitadas durante o setup, injetadas no carregamento
  • Sistema de registro de CLI de plugins — plugins registram seus próprios subcomandos CLI sem tocar no main.py
  • Hooks de API com escopo de requisição com IDs de correlação de chamada de ferramenta para plugins
  • Hooks de ciclo de vida da sessão — on_session_finalize e on_session_reset para CLI e gateway
  • Solicitar variáveis de ambiente obrigatórias durante a instalação do plugin
  • Validação de nome de plugin — rejeita nomes que resolvem para o diretório raiz de plugins
  • Contexto de plugin pre_llm_call movido para a mensagem do usuário para preservar o cache de prompt

Skills Novas e Atualizadas

  • popular-web-designs — 54 sistemas de design de websites em produção
  • p5js creative coding
  • manim-video — animações matemáticas e técnicas
  • llm-wiki — LLM Wiki do Karpathy
  • gitnexus-explorer — indexação de base de código e serviço de conhecimento
  • research-paper-writing — padrões AI-Scientist e GPT-Researcher
  • blogwatcher atualizado para o fork JulienTant
  • Claude Code skill reescrita abrangente v2.0 + v2.2
  • Documentação de referência do Manim CE expandida — geometria, animações, LaTeX
  • Skills de verificação de código consolidadas em uma única

Segurança e Confiabilidade

Reforço de Segurança

  • Segurança consolidada — proteções contra SSRF, mitigações de ataques de timing, prevenção de travessia de diretórios em tar, proteções contra vazamento de credenciais
  • Isolamento entre sessões + endurecimento contra path traversal no cron
  • Parâmetro workdir sanitizado na ferramenta de terminal em todos os backends
  • Escalação de sessão de aprovação ‘once’ prevenida + validação de plataforma de entrega do cron
  • Tokens OAuth do Google Workspace com escopo de perfil protegidos

Confiabilidade

  • Limpeza agressiva de worktree e branches para evitar acúmulo
  • Backtracking catastrófico O(n²) na regex de redação corrigido — melhoria de 100x em saídas grandes
  • Correções de estabilidade em tempo de execução nas ferramentas core, web, delegate e browser
  • Correção de streaming do servidor API + suporte a histórico de conversas
  • Caminhos de endpoint da API OpenViking e análise de resposta corrigidos

Correções de Bugs Notáveis

  • 9 correções de bugs da comunidade resgatadas — gateway, cron, dependências, launchd do macOS em um único lote
  • Correções em lote do core — configuração de modelo, reset de sessão, fallback de alias, launchctl, delegação, escritas atômicas
  • Correções em lote de gateway/plataforma — E2EE do Matrix, entrada CJK, navegador Windows, reconexão e ACL do Feishu
  • Skips de teste obsoletos removidos, backtracking de regex, bug de busca de arquivos e flaky tests
  • Nix flake — leitura de versão, regeneração de uv.lock, adição de hermes_logging
  • Testes de regressão de redação de variáveis em minúsculas

Testes

  • 57 testes CI com falha reparados em 14 arquivos
  • Rearquitetura da suíte de testes + correções de falhas de CI
  • Limpeza de lint em toda a base de código — imports não utilizados, código morto e padrões ineficientes
  • Ferramenta browser_close removida — a limpeza automática cuida disso

Documentação

  • Auditoria abrangente da documentação — corrigir informações desatualizadas, expandir páginas superficiais, adicionar profundidade
  • Mais de 40 discrepâncias corrigidas entre documentação e base de código
  • 13 funcionalidades documentadas dos PRs da última semana
  • Revisão da seção de Guias — corrigir existentes + adicionar 3 novos tutoriais
  • Resgatados 4 PRs de documentação — configuração Docker, validação pós-atualização, guia de LLM local, instalação do signal-cli
  • Referência de configuração do Discord
  • Entradas de FAQ da comunidade para fluxos de trabalho comuns e solução de problemas
  • Guia de rede WSL2 para servidores de modelo local
  • Referência CLI do Honcho + documentação de registro de CLI de plugins
  • Configuração do Obsidian Headless para servidores no llm-wiki
  • Editor visual de skins Hermes Mod adicionado à página de skins

Atualização

hermes update

Para novas instalações, visite o guia de instalação.


Changelog completo no GitHub

← Hermes Agent Changelog