Hermes Agent v0.3.0 — Streaming, Plugins e Multi-Provedor
Visão Geral
v0.3.0 — Streaming, Plugins e Multi-Provedor. Lançado em 17 de março de 2026, apenas 5 dias após o primeiro lançamento público v0.2.0. Esta foi a versão que transformou o Hermes Agent de um agente open-source promissor em uma plataforma de operações autônomas de nível de produção.
Se o v0.2.0 mostrou ao mundo o que o Hermes podia fazer, o v0.3.0 o fez parecer um produto polido. A entrega de tokens em streaming eliminou o problema de “ficar olhando para uma tela em branco”. A arquitetura de plugins abriu as portas para contribuições da comunidade sem tocar no código central. E a reconstrução do sistema de provedores significou que você podia alternar entre OpenAI, Anthropic, os mais de 200 modelos do OpenRouter ou qualquer endpoint personalizado com um único comando.
A resposta da comunidade foi imediata e massiva: quando este lançamento foi publicado, o Hermes Agent já estava sendo chamado de “o sistema operacional para operações autônomas” pela comunidade Zero-Human Companies.
Estatísticas principais: ~50+ correções de bugs · 14 funcionalidades principais · 10+ novas skills · 4 reformulações de plataformas de mensagens
Funcionalidades Principais
1. Infraestrutura de Streaming Unificada
A mudança mais visível para o usuário no v0.3.0: as respostas agora são transmitidas token por token no CLI e em todas as plataformas do gateway.
O que muda:
- Cada provedor agora transmite através de uma infraestrutura unificada
- CLI, Telegram, Discord, Slack e todas as plataformas do gateway recebem tokens à medida que são gerados
- Chamadas de ferramentas de longa duração transmitem o progresso em tempo real
Isso mudou fundamentalmente o modelo de interação. Os usuários agora podem interromper no meio da geração, redirecionar o agente ou fazer perguntas esclarecedoras sem esperar por um bloco de resposta completo.
# O streaming agora é o padrão — sem necessidade de configuração
hermes
> Escreva um script Python que processe um arquivo de log de 10GB
# Os tokens são transmitidos à medida que são gerados. Você pode:
# - Ver exatamente o que o agente está pensando em tempo real
# - Interromper com Ctrl+C se estiver indo na direção errada
# - Redirecionar no meio: "use Rust em vez disso"
2. Arquitetura de Plugins de Primeira Classe
O sistema de plugins foi a chave para o crescimento da comunidade. Coloque arquivos Python em ~/.hermes/plugins/ e o Hermes os detecta automaticamente — ferramentas personalizadas, comandos slash, hooks de ciclo de vida, tudo sem fazer fork do repositório.
# ~/.hermes/plugins/meu_plugin.py
from hermes.plugin import Plugin, tool
class MeuPlugin(Plugin):
"""Um plugin que adiciona uma ferramenta de clima personalizada."""
@tool
def obter_clima(self, cidade: str) -> dict:
"""Obter o clima atual de uma cidade."""
import requests
resp = requests.get(f"https://api.clima.exemplo/{cidade}")
return resp.json()
@tool
def analisar_sentimento(self, texto: str) -> dict:
"""Analisar o sentimento de um texto."""
return {"sentimento": "positivo", "pontuacao": 0.85}
Hooks de ciclo de vida do plugin:
on_load— executado quando o plugin é carregado pela primeira vezon_unload— limpeza antes da remoçãoon_tool_call— interceptar e modificar qualquer chamada de ferramentaon_response— pós-processar respostas do agente
3. Provedor Nativo Anthropic
Antes do v0.3.0, usar modelos Claude significava rotear pelo OpenRouter. O provedor nativo Anthropic mudou tudo.
O que ele desbloqueia:
- Chamadas diretas à API Anthropic — menor latência, sem intermediário OpenRouter
- Descoberta automática de credenciais do Claude Code — se você usou o Claude Code, o Hermes encontra suas credenciais automaticamente
- Fluxos OAuth PKCE — autenticação segura e compatível com padrões, com renovação de token
- Cache nativo de prompts — o cache de prompts da Anthropic reduz os custos de conversas longas em até 90%
# Executar configuração com provedor Anthropic
hermes setup --provider anthropic
# Ou alternar para ele no meio da sessão
/hermes model claude-sonnet-4-20250514
# O Hermes detecta automaticamente as credenciais do Claude Code, se disponíveis
# hermes.config.yaml
providers:
- name: anthropic
provider: anthropic
model: claude-sonnet-4-20250514
prompt_caching: true
4. Aprovações Inteligentes + Comando /stop
Inspirado na abordagem do Codex para segurança de comandos, o sistema de aprovação inteligente aprende quais comandos são seguros e lembra suas preferências.
> Executar: pip install pandas numpy scikit-learn
# Primeira vez: "Aprovar este comando pip install? [s/n/sempre]"
# Escolha 's' (sempre) → nunca mais perguntado para pip install
> Executar: rm -rf /tmp/build-cache
# "Aprovar esta exclusão?" — categoria diferente, pergunta novamente
O comando /stop é seu freio de emergência:
# O agente está indo na direção errada — parar imediatamente
/stop
5. Modo de Voz
O modo de voz chegou no v0.3.0 em três superfícies:
CLI: Pressionar para Falar
# Mantenha Espaço pressionado para falar, solte para enviar
hermes --voice
# Ou alterne o modo de voz no meio da sessão
/voice
Plataformas de Mensagens: Notas de Voz
- Envie notas de voz no Telegram ou Discord — o Hermes transcreve e responde
- As transcrições usam faster-whisper para processamento local gratuito
Canais de Voz do Discord
- O Hermes pode entrar em canais de voz do Discord
- Escuta menções e responde verbalmente
# hermes.config.yaml — configuração de voz
voice:
stt:
enabled: true
engine: faster-whisper # local, gratuito, sem chave API necessária
tts:
enabled: true
engine: openai
6. Execução Concorrente de Ferramentas
Múltiplas chamadas de ferramentas independentes agora são executadas em paralelo via ThreadPoolExecutor.
Antes do v0.3.0: Execução sequencial — ~9 segundos para 3 pesquisas Depois do v0.3.0: Execução paralela — ~3 segundos para 3 pesquisas
7. Integração de Memória Honcho
O Honcho (por @erosika) trouxe modelagem dialética do usuário para o Hermes — o agente constrói um modelo de teoria da mente sobre você ao longo do tempo.
# hermes.config.yaml
memory:
honcho:
enabled: true
recall_mode: recent # recent | relevant | all
max_memories_per_turn: 5
8. Anonimização de PII
Quando privacy.redact_pii está habilitado, informações pessoais identificáveis são automaticamente removidas antes do envio do contexto aos provedores LLM.
privacy:
redact_pii: true
A anonimização acontece localmente antes que qualquer dado saia da sua máquina.
9. /browser connect via CDP
Conecte as ferramentas do navegador a uma instância do Chrome em execução através do Chrome DevTools Protocol.
# Iniciar o Chrome com depuração remota habilitada
chrome --remote-debugging-port=9222
# No Hermes, conectar-se a ele
/browser connect --port 9222
10. Provedor Vercel AI Gateway
Roteie o Hermes através do AI Gateway da Vercel para acessar seu catálogo de modelos e infraestrutura.
providers:
- name: vercel
provider: vercel-ai-gateway
api_key: ${VERCEL_AI_GATEWAY_KEY}
11. Roteador de Provedores Centralizado
O sistema de provedores foi completamente reconstruído em torno de uma única API call_llm.
# Alternar entre modelos sem problemas
/hermes model gpt-5 # → OpenAI
/hermes model claude-sonnet-4 # → Anthropic (detectado automaticamente)
/hermes model grok-3 # → xAI
# A correspondência por prefixo também funciona
/mod gpt-5 # resolve para /model gpt-5
12. Servidor ACP — Integração com IDEs
VS Code, Zed e JetBrains agora podem se conectar ao Hermes como backend de agente através do Agent Communication Protocol.
# Iniciar o Hermes no modo servidor ACP
hermes serve --acp
13. Modo Shell Persistente
Por @alt-glitch. Os backends de terminal local e SSH mantêm o estado do shell entre as chamadas de ferramentas.
> cd /meu-projeto
> ls
# (mesmo shell, estado persiste)
# Mostra o conteúdo de /meu-projeto ✓
> export DATABASE_URL=postgres://localhost/mydb
> python manage.py migrate
# DATABASE_URL está definido ✓
14. Agentic On-Policy Distillation (OPD)
Novo ambiente de treinamento RL para destilar políticas de agente, expandindo o ecossistema de treinamento Atropos.
Melhorias no CLI e UX
| Funcionalidade | Descrição |
|---|---|
| Barra de Status Persistente | Modelo, provedor e contagem de tokens sempre visíveis |
| Autocompletar de Caminhos | Tab-complete de caminhos de arquivos no prompt |
Comando /plan |
Gerar planos de implementação a partir de especificações |
| Correspondência por Prefixo | /mod → /model, /sta → /status |
| Pré-carregamento de Skills | Skills carregadas na inicialização, prontas antes do primeiro prompt |
Configuração
- Migração do OpenClaw — migração perfeita do OpenClaw durante a primeira instalação
- Configuração headless — fluxo completo funciona em servidores apenas SSH
- Recarga de
.env— alterações de ambiente detectadas sem reinicialização
Atualizações de Plataforma
Núcleo do Gateway
| Funcionalidade | Impacto |
|---|---|
| Modo Serviço do Sistema | Executar como serviço systemd no nível do sistema |
| Recarga a Quente de Raciocínio | Alterar configurações de raciocínio sem reiniciar |
| Isolamento de Sessão por Usuário | Chats em grupo não compartilham mais estado entre usuários |
| Detecção Automática de SSL | Funciona no NixOS e sistemas não padronizados |
Telegram
- Buffer de grupos de mídia evita interrupções por rajadas de fotos
- Nova tentativa em falhas TLS transitórias
Discord
- Comando
/threadcom configuraçãoauto_thread - Criação automática de thread ao @mencionar
Slack
- Reformulação completa do tratamento de threads
- Correção do comprimento máximo de mensagem (3900 → 39000)
- Rastreamento de UID IMAP e verificação TLS SMTP
- Opção
skip_attachmentsvia config.yaml
Novas Skills
| Skill | Descrição |
|---|---|
| Linear | Integração de gerenciamento de projetos |
| X/Twitter | Redes sociais via x-cli |
| Telephony | Twilio SMS e chamadas com IA |
| 1Password | Gerenciamento de senhas (por @arceus77-7) |
| NeuroSkill BCI | Integração de interface cérebro-computador |
| Blender MCP | Modelagem 3D |
| OSS Security Forensics | Kit de análise de segurança |
| Parallel CLI | Skill de pesquisa |
| OpenCode | Skill CLI |
| ASCII Video | Refatorado (por @SHL0MS) |
Melhorias no MCP
- Carregamento seletivo de ferramentas — filtrar quais ferramentas MCP estão disponíveis
- Recarga automática — ferramentas MCP recarregam quando a configuração muda
- Correções de conexão npx — resolvidas falhas de conexão stdio
Sistema Cron
- Ferramenta única
cronjobsubstitui vários comandos - Tarefas persistem no SQLite — sobrevivem a reinicializações
- Sobrescritas de tempo de execução por tarefa (provider, model, base_url)
Segurança
- Varredura pré-execução Tirith — análise estática de comandos antes da execução
- Remoção de variáveis de ambiente do provedor — todas as variáveis de ambiente do provedor/gateway removidas dos subprocessos
- Montagem Docker cwd explícita — montagens de diretórios do host agora são explícitas, nunca automáticas
Principais Correções de Bugs
| Problema | Correção |
|---|---|
/status mostrava 0 tokens |
Agora relata estado ao vivo e contagem de tokens |
| Endpoints de modelos personalizados quebrados | Resolução de endpoint restaurada |
| Ferramentas MCP invisíveis até reiniciar | Recarga automática na alteração de config |
Subprocessos do terminal herdando OPENAI_BASE_URL |
Variáveis de ambiente removidas de todos os subprocessos |
| Degradação de desempenho do Gateway | Acumulação de manipuladores de log corrigida |
| Tarefas cron não persistentes | Agora armazenadas no SQLite |
| Configuração travada em SSH headless | Fluxo headless completo |
| Troca de modelo sem efeito | Resolução de provedor na troca corrigida |
O Que a Comunidade Disse
“O Hermes não é um copiloto de código preso a um IDE. Não é um wrapper de chatbot em torno de uma única API. É um agente autônomo persistente, multiplataforma e multi-modelo que cresce com sua implantação.” — ZHC Institute, Field Notes sobre v0.3.0
Mudanças Quebradoras
- Formato de configuração do provedor atualizado — configurações personalizadas do v0.2.0 podem precisar de reestruturação
- Configurações legadas do OpenClaw devem passar pelo fluxo de migração (
hermes claw migrate)
Atualizar
hermes update
Migrando do OpenClaw:
hermes claw migrate
Para novas instalações, visite o guia de instalação.
← Hermes Agent Changelog