v0.9.0

Hermes Agent v0.9.0 — A Versão Onipresente


Visão Geral

v0.9.0 — A Versão Onipresente. Publicada em 13 de abril de 2026. Desde a v0.8.0: 487 commits · 269 PRs mesclados · 167 issues resolvidas · 493 arquivos modificados · 63.281 inserções · 24 colaboradores.

Esta versão tem um único propósito: estar em todos os lugares. O Hermes saiu do terminal e de um punhado de plataformas de chat, mergulhando no ecossistema Apple (iMessage), no ecossistema chinês (WeChat) e até no mobile (Android/Termux). Um novo Painel Web local permite gerenciar tudo sem editar arquivos de configuração. O Modo Rápido elimina o tempo de espera para fluxos de trabalho sensíveis à latência. O monitoramento de processos em segundo plano livra você do inferno do polling. E 11 correções de reforço de segurança garantem que tudo rode rápido e seguro.


Principais Funcionalidades

1. Painel Web Local — Gerencie Tudo no Seu Navegador

O Hermes agora vem com um painel de gerenciamento baseado em navegador para uso local. Configure definições, monitore sessões, explore habilidades e gerencie seu gateway — tudo a partir de uma interface web limpa, sem arquivos de configuração, sem terminal. A maneira mais fácil de começar com o Hermes.

O painel é construído sobre FastAPI + Uvicorn, rodando em 127.0.0.1:9119 por padrão, com status do gateway em tempo real, histórico de sessões e análises de uso.

2. Modo Rápido (/fast) — Pipeline de Inferência Prioritária

Digite /fast no chat para encaminhar sua sessão atual por filas de processamento prioritário para modelos OpenAI e Anthropic, reduzindo drasticamente a latência de inferência. Modelos suportados incluem GPT-5.4, Codex, Claude e mais.

# Ativar modo rápido
/fast

# Todas as chamadas subsequentes ao LLM passam por filas prioritárias com latência muito menor
# Digite /fast novamente para desativar

Baseado no Processamento Prioritário da OpenAI e no nível rápido da Anthropic, expandido para todos os modelos elegíveis. (#6875, #6960, #7037)

3. iMessage via BlueBubbles — O Hermes Entra no Ecossistema Apple

Integração completa com iMessage através do BlueBubbles. Registro automático de webhooks, integração com o assistente de configuração e resiliência a falhas — o Hermes agora pode enviar e receber iMessages do seu Mac.

# Selecione BlueBubbles no assistente de configuração e siga o guia de pareamento
hermes setup

(#6437, #6460, #6494)

4. WeChat (Weixin) e Modo Callback do WeCom — Ecossistema de Mensagens Chinês Completo

WeChat (Weixin): Suporte nativo ao WeChat via API iLink Bot, com cursor de streaming, upload de mídia e tratamento de links Markdown.

Modo Callback do WeCom: Um adaptador em modo callback para aplicativos empresariais autoconstruídos com persistência de estado atômica.

O Hermes agora cobre o ecossistema de mensagens chinês de ponta a ponta — do WeChat pessoal ao WeCom empresarial. (#7166, #7943)

5. Suporte a Termux / Android — O Hermes Vai para o Mobile

Execute o Hermes nativamente no Android via Termux. Caminhos de instalação adaptados, TUI otimizada para telas mobile, suporte a backend de voz e comando /image funcionando no dispositivo.

# Instalar no Termux usando o pacote especializado para termux
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash -s -- --bundle termux

(#6834)

6. Monitoramento de Processos em Segundo Plano (watch_patterns) — Seja Notificado, Não Faça Polling

Defina padrões regex para monitorar na saída de processos em segundo plano e receba notificações em tempo real quando houver correspondência. Monitore erros, aguarde eventos específicos (“listening on port 3000”) ou acompanhe logs de build — chega de polling.

# hermes.config.yaml
watch_patterns:
  - pattern: "Error:.*"
    notify: true
  - pattern: "listening on port \\d+"
    notify: true
    label: "Serviço pronto"

(#7635)

7. xAI (Grok) e Xiaomi MiMo — Suporte Nativo a Provedores

Dois grandes provedores de modelo ganham suporte de primeira classe:

  • xAI (Grok): Acesso direto à API, catálogo de modelos, integração com assistente de configuração
  • Xiaomi MiMo: Assistente de configuração, catálogo de modelos, recuperação automática de respostas vazias

Além disso, OAuth Qwen com suporte a requisições via portal. (#7372, #7855)

8. Mecanismo de Contexto Plugável — Personalize o Que o Agente Vê

O gerenciamento de contexto agora é um slot plugável via hermes plugins. Troque por mecanismos de contexto personalizados que controlam exatamente o que o agente vê a cada turno — filtragem, sumarização ou injeção de contexto específico de domínio.

# Instalar um plugin de mecanismo de contexto personalizado
hermes plugins install meu-mecanismo-de-contexto

(#7464)

9. Suporte Unificado a Proxy — Funciona Atrás de Firewalls

Proxy SOCKS, DISCORD_PROXY e detecção automática de proxy do sistema em todas as plataformas do gateway. O Hermes funciona atrás de firewalls corporativos — macOS detecta automaticamente as configurações de proxy do sistema, Windows/Linux precisam apenas de configuração manual. (#6814)

10. Reforço de Segurança Abrangente — 11 Correções Críticas

A rodada mais profunda de reforço de segurança na história do Hermes:

Vulnerabilidade Correção PR
RCE por SMS Validação de assinatura de webhook do Twilio #7933
Injeção de Shell Escape de caminho na escrita do sandbox #7940
Injeção de Argumentos Git Proteção contra travessia de caminho + injeção de argumentos #7944
SSRF Proteção contra redirecionamento no upload de imagens do Slack #7151
Travessia de Caminho Reforço de limites no gerenciador de checkpoints + gerenciador de habilidades #7156
Proteção de Bind da API Exigir API_SERVER_KEY para binds não-loopback #7455
Autenticação do Botão de Aprovação Exigir autenticação para continuação de sessão #6930

11. hermes backup e hermes import — Backup e Restauração com Um Clique

Backup e restauração completos da sua configuração do Hermes, sessões, habilidades e memória. Migre entre máquinas ou tire um snapshot antes de grandes mudanças — um único comando resolve tudo.

# Fazer backup de tudo
hermes backup

# Restaurar em uma nova máquina
hermes import ./backup-2026-04-13.tar.gz

(#7997)

12. 16 Plataformas Suportadas — Verdadeiramente Onipresente

A partir desta versão, o Hermes suporta 16 plataformas de mensagens:

Telegram, Discord, Slack, WhatsApp, Signal, Matrix, iMessage (novo), WeChat (novo), WeCom, Email, SMS, DingTalk, Feishu, Mattermost, Home Assistant, Webhooks

13. Kit de Depuração — /debug e hermes debug share

Novos comandos de depuração: comando slash /debug disponível em todas as plataformas para diagnósticos rápidos, além de hermes debug share para enviar um relatório completo de depuração para um pastebin e facilitar o compartilhamento durante a resolução de problemas. (#8681)

# Diagnósticos rápidos na CLI
/debug

# Exportar e compartilhar um relatório de depuração
hermes debug share

Agente Principal & Arquitetura

Suporte a Provedores & Modelos

  • Provedor nativo xAI (Grok) com acesso direto à API e catálogo de modelos
  • Xiaomi MiMo como provedor de primeira classe — assistente de configuração, catálogo de modelos, recuperação de respostas vazias
  • Provedor OAuth Qwen com suporte a requisições via portal
  • Modo Rápido — alternador /fast para Processamento Prioritário OpenAI + nível rápido Anthropic
  • Classificação estruturada de erros de API para decisões inteligentes de failover
  • Captura de cabeçalhos de limite de taxa exibida em /usage
  • Nome do modelo no servidor API derivado do nome do perfil
  • Provedores personalizados agora incluídos nas listagens e resolução de /model
  • Ativação de provedor de fallback em respostas vazias repetidas com status visível ao usuário
  • Tags de variantes OpenRouter (:free, :extended, :fast) preservadas durante troca de modelo
  • TTL de esgotamento de credenciais reduzido de 24 horas para 1 hora
  • Reforço do ciclo de vida de credenciais OAuth — chaves de pool obsoletas, sincronização de auth.json, correções de corrida no Codex CLI
  • Recuperação de resposta vazia para modelos de raciocínio (MiMo, Qwen, GLM)
  • Comprimentos de contexto MiniMax, proteção de thinking, correções de endpoint
  • Detecção automática de endpoint Z.AI via sondagem e cache

Loop do Agente & Conversação

  • Slot de mecanismo de contexto plugável via hermes plugins
  • Monitoramento de processos em segundo planowatch_patterns para alertas de saída em tempo real
  • Compressão de contexto aprimorada — limites mais altos, rastreamento de ferramentas, avisos de degradação, proteção de cauda do orçamento de tokens
  • /compress <foco> — compressão guiada com um tópico de foco
  • Avisos escalonados de pressão de contexto com deduplicação no gateway
  • Aviso de inatividade em estágios antes da escalada de timeout
  • Impedir que o agente pare no meio da tarefa — piso de compressão, revisão de orçamento, rastreamento de atividade
  • Propagar atividade filha para o pai durante delegate_task
  • Detecção de chamada de ferramenta de streaming truncada antes da execução
  • Retentativa de resposta vazia (3 tentativas com cutucada)
  • Backoff adaptativo de streaming + remoção de cursor para evitar truncamento de mensagens
  • Compressão usa modelo da sessão ativa em vez de configuração persistida obsoleta
  • Remover tags <thought> das respostas do Gemma 4
  • Impedir que <think> em prosa suprima a saída da resposta
  • Log de diagnóstico de saída de turno no loop do agente
  • Escopo do sinal de interrupção de ferramenta por thread para evitar vazamentos entre sessões

Memória & Sessões

  • Plugin de memória Hindsight — paridade de funcionalidades, assistente de configuração, melhorias de configuração (@nicoloboschi)
  • HonchoinitOnSessionStart opcional para modo de ferramentas (@Kathie-yu)
  • Tornar filhos órfãos em vez de excluir em cascata no prune/delete
  • Comando doctor verifica apenas o provedor de memória ativo

Plataformas de Mensagens (Gateway)

Novas Plataformas

  • BlueBubbles (iMessage) — adaptador completo com registro automático de webhooks, assistente de configuração e resiliência a falhas
  • WeChat (Weixin) — suporte nativo via API iLink Bot com streaming, upload de mídia, links markdown
  • Modo Callback do WeCom — adaptador para aplicativo empresarial autoconstruído com persistência de estado atômica

Melhorias nas Plataformas

Discord:

  • Configuração de whitelist de canais permitidos
  • Herança de tópico de canal de fórum em sessões de thread
  • Configuração DISCORD_REPLY_TO_MODE
  • Aceitar anexos .log, limite de tamanho de documento aumentado
  • Desacoplar sincronização de comandos slash da prontidão

Slack:

  • Melhorias consolidadas do Slack — 7 PRs da comunidade resgatados em um só
  • Tratar eventos de ciclo de vida de thread de assistente

Matrix:

  • Migrado de matrix-nio para mautrix-python
  • Armazenamento criptográfico SQLite substituindo pickle (corrige descriptografia E2EE)
  • Verificação de chave de recuperação de cross-signing para migração E2EE
  • Threads de menção em DM + eventos de chat em grupo para Feishu

Núcleo do Gateway

  • Suporte unificado a proxy — SOCKS, DISCORD_PROXY, multiplataforma com detecção automática no macOS
  • Agrupamento de texto de entrada para Discord, Matrix, WeCom + atraso adaptativo
  • Exibir mensagens naturais do assistente no meio do turno nas plataformas de chat
  • Gateway com reconhecimento de WSL com detecção inteligente de systemd
  • Todas as plataformas ausentes adicionadas ao assistente de configuração
  • Sobrescritas de tool_progress por plataforma
  • Intervalo configurável de notificação “ainda trabalhando”
  • /model switch persiste entre mensagens
  • /usage mostra limites de taxa, custo e detalhes de tokens entre turnos
  • Drenar trabalho em andamento antes de reiniciar
  • Não remover agente em cache em execuções com falha — previne loop de reinicialização do MCP
  • Substituir estado de sessão os.environ por contextvars
  • Derivar plataformas de diretório de canais do enum em vez de lista fixa
  • Validar downloads de imagem antes de armazenar em cache (multiplataforma)
  • Entrega de webhook multiplataforma para todas as plataformas
  • Suporte a entrega em thread_id do Discord via Cron
  • Onboarding de bot do Feishu baseado em QR
  • Status do gateway com escopo no perfil ativo
  • Impedir que notificações de processos em segundo plano disparem falsas solicitações de pareamento

CLI & Experiência do Usuário

CLI Interativa

  • Suporte a Termux / Android — caminhos de instalação adaptados, TUI, voz, /image
  • Modal nativo de seletor /model para seleção provedor → modelo
  • Temporizador ao vivo por ferramenta restaurado no spinner da TUI
  • Retrocesso de progresso de ferramentas empilhadas na TUI
  • Dicas aleatórias ao iniciar nova sessão (CLI + gateway, 279 dicas)
  • hermes dump — resumo de configuração pronto para copiar e colar para depuração
  • hermes backup / hermes import — backup e restauração completa da configuração
  • Dica de ambiente WSL no prompt do sistema
  • UX de criação de perfil — gerar SOUL.md + aviso de credenciais
  • Detecção de sudo com reconhecimento de shell, suporte a senha vazia
  • Limpar stdin após menus curses/terminal para evitar vazamento de sequências de escape
  • Tratar stdin quebrado na inicialização do prompt_toolkit

Configuração

  • Configuração de verbosidade de exibição por plataforma
  • Logging separado por componentes com contexto de sessão e filtragem
  • Configuração network.force_ipv4 para corrigir problemas de timeout IPv6
  • Padronizar espaçamento de mensagens e formatação JSON
  • Rebranding OpenClaw → Hermes durante migração
  • config.yaml tem prioridade sobre variáveis de ambiente para configurações auxiliares
  • Reforçar fluxos de configuração de provedores + atualização ao vivo do catálogo OpenRouter
  • Normalizar ordenação de esforço de raciocínio em todas as superfícies
  • Remover variável de ambiente LLM_MODEL obsoleta + migração para limpar entradas antigas
  • Remover comando slash /prompt — armadilha de expansão de prefixo
  • Variável de ambiente HERMES_HOME_MODE para sobrescrever permissões
  • Fallback para modelo padrão quando a configuração de modelo está vazia
  • Avisar quando o contexto do modelo de compressão é muito pequeno

Sistema de Ferramentas

Ambientes & Execução

  • Camada de execução unificada por chamada para ambientes
  • Sincronização de arquivos unificada com rastreamento de mtime, exclusão e estado transacional
  • Ambientes sandbox persistentes sobrevivem entre turnos
  • Sincronização de arquivos em lote via pipe tar para backends SSH/Modal
  • Daytona — upload em lote, ponte de configuração, limite de disco silencioso
  • Limite de timeout em primeiro plano para evitar deadlocks de sessão
  • Proteção contra valores de comando inválidos

MCP

  • Suporte a hermes mcp add --env e --preset
  • Combinar content e structuredContent quando ambos estiverem presentes
  • Correções de desambiguação de nomes de ferramentas MCP
  • Reforço do navegador — remoção de código morto, cache, desempenho de scroll, segurança, segurança de threads
  • Auto-lançamento do /browser connect usa diretório de perfil Chrome dedicado
  • Eliminar sessões de navegador órfãs na inicialização

Voz & Visão

  • Provedor TTS Voxtral (Mistral AI)
  • Suporte a velocidade TTS para Edge TTS, OpenAI TTS, MiniMax
  • Redimensionamento automático de visão para imagens muito grandes, limite aumentado para 20 MB, retentativa em falha
  • Correção de incompatibilidade provedor-modelo STT (whisper-1 vs faster-whisper)

Outras Ferramentas

  • Comando hermes dump para resumo de configuração
  • Armazenamento TODO impõe unicidade de ID durante operações de substituição
  • Listar todos os conjuntos de ferramentas disponíveis na descrição do schema delegate_task
  • Servidor API: progresso de ferramenta como evento SSE personalizado para evitar corrupção de modelo
  • Servidor API: compartilhar um contêiner Docker entre todas as conversas

Ecossistema de Habilidades

  • Índice centralizado de habilidades + cache em árvore — elimina falhas de limite de taxa na instalação
  • Instruções de carregamento de habilidades mais agressivas no prompt do sistema (v3)
  • Habilidade Google Workspace migrada para backend GWS CLI
  • Habilidade de estratégias de divergência criativa (@SHL0MS)
  • Ideação criativa — geração de projetos baseada em restrições (@SHL0MS)
  • Paralelizar navegação/busca de habilidades para evitar travamentos
  • Ler nome do frontmatter do SKILL.md no skills_sync

Segurança & Confiabilidade

Reforço de Segurança

  • Validação de assinatura de webhook do Twilio — correção de RCE por SMS
  • Neutralização de injeção de shell em _write_to_sandbox via escape de caminho
  • Injeção de argumentos Git e prevenção de travessia de caminho no gerenciador de checkpoints
  • Bypass de redirecionamento SSRF em uploads de imagem do Slack + helpers de cache base.py
  • Travessia de caminho, proteção de credenciais, lacunas DANGEROUS_PATTERNS
  • Proteção de bind da API — exigir API_SERVER_KEY para binding não-loopback
  • Autorização do botão de aprovação — exigir autenticação para continuação de sessão
  • Reforço de limites de caminho nas operações do gerenciador de habilidades
  • Validação de origem de URL de webhook DingTalk/API, rejeição de injeção de cabeçalho

Confiabilidade

  • Diagnósticos de erro contextuais para respostas de API inválidas
  • Impedir que erros de formato 400 disparem loop de compressão no Codex
  • Não reduzir context_length pela metade em erros de output-cap-too-large
  • Recuperar cliente primário em erros de transporte OpenAI
  • Rotação de pool de credenciais em erros 400 classificados como cobrança
  • Aumentar automaticamente timeout de leitura de stream para provedores LLM locais
  • Fallback para certificados padrão quando o caminho do bundle CA não existe
  • Desambiguar padrões de limite de uso no classificador de erros
  • Reforçar timeout de script cron e recuperação de provedor
  • Detecção de interrupção do gateway resiliente a falhas de tarefas de monitoramento
  • Impedir reset automático indesejado de sessão após reinicializações graciosas do gateway
  • Impedir spam de aviso de atualização duplicado no watcher do gateway
  • Deduplicar itens de raciocínio na entrada da API Responses

Infraestrutura

  • Imagem Docker multi-arquitetura — amd64 + arm64
  • Docker executa como usuário não-root com virtualenv
  • Usar uv para resolução de dependências no Docker
  • CLI Nix com reconhecimento de contêiner — roteamento automático para contêiner gerenciado
  • Modelo de permissão de estado compartilhado Nix para usuários de CLI interativa
  • Isolamento de HOME de subprocesso por perfil
  • Caminhos de perfil corrigidos no Docker — perfis vão para o volume montado
  • Caminho do gateway em contêiner Docker reforçado
  • Habilitar stdout sem buffer para logs Docker ao vivo
  • Instalar procps na imagem Docker
  • Clone git raso para instalação mais rápida
  • hermes update sempre faz reset em conflito de stash
  • Escrever código de saída da atualização antes de reiniciar o gateway (corrida de kill do cgroup)
  • Nix: setupSecrets opcional, dependência de runtime tirith
  • Parada do launchd usa bootout para que KeepAlive não reinicie o processo

Correções de Bugs Notáveis

  • Correção: troca de /model não persiste entre mensagens do gateway
  • Correção: sobrescritas de modelo do gateway com escopo de sessão ignoradas
  • Correção: comprimento de contexto do modelo de compactação ignorando configuração (3 issues relacionadas)
  • Correção: janela de contexto do OpenCode.ai resolvida para 128K em vez de 1M
  • Correção: busca de auth-store de fallback do Codex
  • Correção: notificações de conclusão duplicadas quando processo é encerrado
  • Correção: thread daemon do agente impede processos CLI órfãos ao fechar aba
  • Correção: anexo de imagem obsoleto ao colar texto e entrada de voz
  • Correção: propagação de sessão de thread DM causando contaminação entre threads
  • Correção: migração OpenClaw mostra prévia dry-run antes de executar
  • Correção: erros de autenticação classificados incorretamente como tentáveis novamente
  • Correção: cabeçalho Copilot-Integration-Id ausente
  • Correção: capacidades de sessão ACP
  • Correção: uso de PromptResponse ACP a partir de campos de nível superior
  • Correção: vários testes falhando/intermitentes na main
  • Correção: nomes de arquivo de marcador de backup
  • Correção: NoneType na verificação de fast_mode
  • Correção: imports ausentes em uninstall.py

Documentação

  • Guia do desenvolvedor de adaptador de plataforma + documentação de Callback WeCom
  • Guia de resolução de problemas de cron
  • Detecção automática de timeout de streaming para LLMs locais
  • Documentação de reforço de uso de ferramentas expandida
  • Instruções de pareamento BlueBubbles
  • Seção de suporte a proxy do Telegram
  • Referência CLI hermes dump e hermes logs
  • Referência de configuração tool_progress_overrides
  • Documentação de aviso de comprimento de contexto do modelo de compressão

Atualização

hermes update

Para novas instalações, visite o guia de instalação.


Changelog completo no GitHub

← Hermes Agent Changelog