Hermes Agent v0.4.0 — A versão Expansão de Plataformas
Visão Geral
v0.4.0 — The Platform Expansion Release. Lançado em 23 de março de 2026. Apenas 11 dias após v0.2.0 (primeiro lançamento público) e v0.3.0 (streaming + arquitetura de plugins), esta versão elevou o Hermes Agent de um ótimo agente CLI para um produto de plataforma genuíno — com uma API, cobertura multi-plataforma de mensagens, gerenciamento do ecossistema MCP e segurança de nível empresarial.
Se v0.2.0 mostrou ao mundo o que o Hermes podia fazer e v0.3.0 tornou a experiência fluida, v0.4.0 tornou o Hermes integrável em qualquer sistema. A partir deste ponto, o Hermes não é apenas um agente no seu terminal — pode ser seu backend de API, seu chatbot, seu centro de automação.
A manchete em uma frase: Transformar o Hermes em um servidor API acessível via /v1/chat/completions, enquanto o conecta a quase todas as principais plataformas de mensagens do mercado.
Funcionalidades Principais
1. Servidor API Compatível com OpenAI — Hermes como Serviço de Backend
Esta é a funcionalidade mais estrategicamente significativa da v0.4.0: o Hermes agora pode ser exposto como um endpoint padrão /v1/chat/completions. Qualquer cliente compatível com a API OpenAI — outros agentes, scripts de automação, aplicações web — pode chamar o Hermes diretamente.
Iniciando o servidor API:
# Iniciar o servidor API do Hermes
hermes serve
# Sistemas externos agora podem chamar o Hermes através do SDK padrão da OpenAI
# Qualquer código usando o SDK da OpenAI pode se conectar ao Hermes
from openai import OpenAI
client = OpenAI(base_url="http://localhost:8000/v1")
response = client.chat.completions.create(
model="hermes",
messages=[{"role": "user", "content": "Revise este código em busca de problemas de segurança"}]
)
A API REST complementar /api/jobs permite gerenciar tarefas cron via HTTP — criar, visualizar, excluir — tudo através de endpoints REST padrão.
A segurança foi projetada desde o início, não adicionada depois:
- Limites de entrada + listas brancas de campos: previnem ataques de requisições maliciosas
- Persistência de respostas baseada em SQLite: sobrevive a reinicializações
- Proteção de origem CORS: bloqueia acesso não autorizado via navegador
- Essas proteções foram integradas ao servidor API desde o primeiro dia
2. Seis Novos Adaptadores de Mensagens — Chat em Todo Lugar
v0.4.0 adiciona 6 novas plataformas de mensagens de uma vez. Combinado com o suporte existente ao Telegram, Discord e WhatsApp, o Hermes Gateway agora oferece cobertura unificada de mensagens em 9 plataformas principais:
| Plataforma | Destaques |
|---|---|
| Signal | Adaptador completo com manipulação de anexos, filtragem de mensagens em grupo e proteção anti-eco “Nota para si mesmo” |
| DingTalk | Integração com Gateway + documentação de configuração, suporte nativo para fluxos de trabalho empresariais chineses |
| SMS (Twilio) | Canal SMS para cenários offline/baixa conectividade |
| Mattermost | Filtro de canal apenas @-menções, ideal para equipes auto-hospedadas |
| Matrix | Protocolo de comunicação descentralizado, suporte a visão e cache de imagens |
| Webhook | Adaptador webhook universal para qualquer sistema de gatilho de eventos externos |
Atualizações principais do Gateway:
- Reconexão automática com backoff exponencial: recupera-se silenciosamente de desconexões de plataforma
- Contexto de mensagem de resposta: inclui automaticamente o contexto da mensagem original para respostas fora da sessão
- Ignorar DMs não autorizadas: filtragem configurável de mensagens diretas de usuários não autorizados
# hermes.config.yaml — exemplo de configuração multi-plataforma
gateway:
platforms:
- signal
- dingtalk
- telegram
- discord
auto_reconnect: true
ignore_unauthorized_dms: true
3. Referências de Contexto @ — Interação Estilo Claude Code
Digite @ na CLI e use Tab para autocompletar caminhos de arquivo ou URLs. O Hermes injeta automaticamente o conteúdo referenciado no contexto da conversa.
# Referência @file — injetar conteúdo do arquivo na conversa
> @src/auth/handler.ts Revise esta lógica de autenticação
# Referência @url — injetar conteúdo da página web na conversa
> @https://docs.example.com/api Escreva um cliente baseado nesta documentação de API
Isso empresta do modelo de interação do Claude Code, mas o Hermes o implementa como autocompletar com Tab + integração CLI nativa — sem necessidade de plugin de editor. Particularmente útil em ambientes de terminal puro sem IDE, como sessões SSH em servidores remotos.
4. Quatro Novos Provedores de Inferência — Liberdade de Escolha de Modelo
O sistema de provedores do Hermes expandiu-se ainda mais na v0.4.0:
GitHub Copilot (OAuth + Validação de Token)
- Fluxo completo de autenticação OAuth, sem chaves API hardcoded
- Janela de contexto de 400K para análise de código ultra-longo
- Validação automática de tokens e gerenciamento de expiração Contribuído por @mchzimm
Alibaba Cloud / DashScope
- Integração completa com DashScope v1 runtime
- Suporte para toda a família de modelos Qwen (qwen-*)
- Nomes de modelo que preservam pontos (ex.
qwen-plus-v2)
Kilo Code
- Provedor de inferência otimizado para cenários de codificação
OpenCode Zen / Go
- Backends de provedor leves Correções relacionadas ao Zen contribuídas por @0xbyt4
Melhorias do sistema de provedores:
- Degradação automática por limite de taxa: troca automática para o modelo de backup em erros de limite de taxa — conversas nunca são interrompidas
- Reformulação da detecção de comprimento de contexto: integração com models.dev, resolução consciente do provedor, correspondência difusa para endpoints personalizados, suporte a
/v1/propsdo llama.cpp - Atualizações do catálogo de modelos: adicionados gpt-5.4-mini, gpt-5.4-nano, haiku-4.5, claude 4.6 (contexto de 1M), minimax-m2.7 e mais
- Melhorias em endpoints personalizados: suporte à configuração
model.base_url, endpoints locais sem chave API, falha rápida em chaves ausentes em vez de falha silenciosa
5. CLI de Gerenciamento de Servidores MCP — Fluxo Completo OAuth 2.1 PKCE
O ecossistema MCP (Model Context Protocol) deu um salto qualitativo na v0.4.0: de arquivos de configuração manuais para uma experiência completa de gerenciamento por CLI.
# Instalar um servidor MCP
hermes mcp install <nome-do-servidor>
# Configurar um servidor MCP
hermes mcp configure <nome-do-servidor>
# Autenticação OAuth 2.1 PKCE (totalmente guiada)
hermes mcp auth <nome-do-servidor>
- Fluxo completo OAuth 2.1 PKCE: redirecionamento do navegador, manipulação de callback, renovação de token — tudo guiado pela CLI
- Servidores MCP expostos como conjuntos de ferramentas independentes: cada servidor MCP é um toolset ativável/desativável
- Configuração interativa de ferramentas MCP: configure ferramentas MCP diretamente no
hermes tools, sem edição de YAML
6. Cache de Prompts no Gateway — Redução Dramática de Custos para Conversas Longas
No modo Gateway, as instâncias AIAgent agora são cacheadas por sessão, preservando o cache de prompts do Anthropic entre turnos.
O que isso significa?
- Para conversas longas, o cache de prompts do Anthropic não é mais invalidado e reconstruído a cada turno
- Redução massiva de custos (a diferença de preço entre escrita e leitura do cache de prompts do Anthropic é de ordens de magnitude)
- O cache é restaurado junto com a retomada da sessão
# Automaticamente ativo no modo Gateway, sem configuração necessária
# A instância AIAgent de cada sessão é cacheada em memória
# O cache de prompts é preservado entre turnos
7. Reformulação Completa da Compressão de Contexto — Nenhuma Conversa É Longa Demais
O mecanismo de compressão de contexto foi completamente reescrito na v0.4.0:
- Resumos estruturados: não mais simples truncamento — atualizações de resumo estruturadas e iterativas
- Proteção de cauda do orçamento de tokens: preserva o conteúdo de conversa mais recente durante a compressão
- Endpoint de resumo configurável:
summary_base_urlpermite usar um modelo auto-hospedado para sumarização, economizando custos de API - Suporte a modelo de fallback: troca automática para um modelo de backup quando o sumarizador principal está indisponível
8. Streaming Habilitado por Padrão — O Que Você Vê É O Que Você Obtém
O streaming na CLI agora está habilitado por padrão a partir da v0.4.0, com amplas melhorias:
- Exibição correta de spinner e progresso de ferramentas durante o modo streaming
- Corrigida a perda de espaços em branco durante a concatenação de fragmentos de streaming
- Corrigidos problemas de quebra de linha nos limites de iteração que causavam corrupção do streaming
- Supressão automática da animação do spinner em ambientes não TTY
- Suporte à exibição de blocos de raciocínio/pensamento (
show_reasoning)
Novos Comandos CLI
| Comando | Função | Uso |
|---|---|---|
/statusbar |
Alternar barra de status persistente (info de modelo + provedor) | /statusbar |
/queue |
Enfileirar prompts sem interromper o agente em execução | /queue <mensagem> |
/permission |
Alternar dinamicamente o modo de aprovação durante uma sessão | /permission |
/browser |
Iniciar sessão de navegador interativa a partir da CLI | /browser |
/cost |
Acompanhamento de custos e uso em tempo real no modo Gateway | /cost |
/approve / /deny |
Comandos explícitos de aprovar/negar no Gateway | /approve ou /deny |
Melhorias no Gerenciamento de Configuração
# Recarga de configuração em tempo real — edite config.yaml sem reiniciar
# Entra em vigor automaticamente, sem ação manual necessária
# Substituição de variáveis de ambiente — use ${ENV_VAR} no config.yaml
# Exemplo:
# api_key: ${OPENAI_API_KEY}
# Modelos personalizados — custom_models.yaml
# Adicione seus próprios modelos fora do catálogo oficial
- Substituição
${ENV_VAR}: referencie variáveis de ambiente diretamente no config.yaml - Recarga de configuração em tempo real: alterações no config.yaml são aplicadas sem reinicialização
custom_models.yaml: adições de modelos gerenciadas pelo usuário- Mesclagem YAML aninhada: mesclagem profunda na atualização de configuração em vez de substituição brusca
- Seleção de arquivos de contexto baseada em prioridade + suporte a CLAUDE.md
Novas Ferramentas
| Ferramenta | Descrição | Uso |
|---|---|---|
| Email IMAP | Ler e enviar emails via protocolo IMAP | O agente pode lidar com emails diretamente |
| STT (Fala para Texto) | Reconhecimento de fala via API Whisper | Transcrever arquivos de áudio |
| Tavily | Backend de busca/extração/rastreamento web | hermes tools enable tavily |
| Parallel | Backend alternativo de busca/extração web | hermes tools enable parallel |
| Backend Web Configurável | Seleção Firecrawl / BeautifulSoup / Playwright | Configurar conforme necessário |
| Precificação com Reconhecimento de Rota | Estimativas de custo precisas por rota de provedor | Cálculo automático |
Melhorias de TTS
- NeuTTS: provedor TTS local com fluxo de configuração integrado, substituindo o antigo skill opcional
- Suporte a
base_urlpersonalizado para OpenAI TTS
Melhorias nas Ferramentas de Visão
- Timeout configurável
- Expansão de til em caminhos de arquivo
- Múltiplas imagens em DMs do Gateway + fallback base64
Segurança e Confiabilidade
Reforço de Segurança
- Proteção SSRF: abrangente para
vision_toolseweb_tools - Prevenção de injeção de shell: sufixos de caminho
~usernão são mais interpretados pelo shell - Proteção de origem do navegador: bloqueia acesso não autorizado via navegador ao servidor API
- Isolamento de credenciais do sandbox: credenciais do backend do sandbox nunca vazam para variáveis de ambiente de subprocessos
- Restrição de caminho de referência @: bloqueia a leitura de arquivos sensíveis fora do espaço de trabalho (contribuído por @Gutslabs)
- Scanner de código malicioso pré-execução: verifica comandos
terminal_toolem busca de padrões maliciosos antes da execução - Eliminação de injeção SQL: todas as chamadas
execute()convertidas para consultas parametrizadas (contribuído por @dusterbloom) - Reforço da API de Jobs: limites de entrada + lista branca de campos + verificações de inicialização
Melhorias de Confiabilidade
- Bloqueios de thread em 4 métodos críticos do SessionDB
- Bloqueio de arquivos para escritas concorrentes em memória
- Tratamento elegante de erros do OpenRouter
- Robustez do loop do agente significativamente melhorada: recuperação automática de
tool_choicerejeitado pelo provedor, tratamento correto de resultados de ferramentas vazios, erros de análise JSON retornados ao modelo em vez de executar com argumentos vazios, prevenção de perda silenciosa de resultados de ferramentas
Melhorias do Sistema Cron
- Respostas
[SILENT]: agentes cron podem executar silenciosamente sem enviar resultados - A janela de tolerância de tarefas perdidas escala com a frequência de agendamento
- Recuperar tarefas pontuais recentes
- Correção da normalização de timestamps ISO (anteriormente, timestamps sem fuso horário causavam execução de tarefas em horários incorretos)
Ecossistema de Skills
Novos Skills
| Skill | Descrição |
|---|---|
| OCR-and-documents | OCR para PDF/DOCX/XLS/PPTX/imagens com aceleração GPU opcional |
| Huggingface-hub | Interação integrada com HuggingFace Hub |
| Sherlock OSINT | Busca de nomes de usuário multiplataforma |
| Meme-generation | Geração de imagens com Pillow |
| Bioinformatics | Skill gateway que indexa mais de 400 skills de bioinformática |
| 3D-model-viewer | Visualizador de modelos 3D |
| FastMCP | Skill de desenvolvimento rápido MCP |
| Base blockchain | Interação com blockchain |
Melhorias do Sistema de Skills
- Skills criados pelo agente: descobertas de nível Caution permitidas, skills perigosos perguntam em vez de bloquear
- Flag
--yes: pular confirmação na instalação/desinstalação de skills - Skills desabilitados respeitados globalmente: ausentes do banner, system prompt e comandos slash
Melhorias do Sistema de Plugins
- Hooks de extensão TUI: construa CLIs personalizadas sobre o Hermes
hermes plugins install/remove/list: gerenciamento completo do ciclo de vida de plugins- Registro de comandos slash: plugins podem registrar seus próprios comandos slash
- Evento de ciclo de vida
session:end: plugins podem se conectar a eventos de fim de sessão
Atualização
hermes update
Para novas instalações, visite o guia de instalação.
← Hermes Agent Changelog