Hermes Agent v0.2.0 — O Primeiro Lançamento Público
Visão Geral
v0.2.0 — O Primeiro Lançamento Público. 12 de março de 2026. 216 pull requests mesclados · 63 contribuidores · 119 issues resolvidas · de quase zero testes para 3.289.
Este é o momento em que o Hermes Agent foi apresentado ao mundo. Em pouco mais de duas semanas após a fundação interna do v0.1.0, o projeto explodiu de um pequeno protótipo de pesquisa para uma plataforma de agentes de IA completa e orientada pela comunidade. O que torna este lançamento notável não é apenas a lista de funcionalidades — é a velocidade. 63 pessoas da comunidade open-source contribuíram com código, testes, documentação e correções de segurança, moldando a arquitetura do projeto desde o primeiro dia.
O v0.2.0 estabelece o DNA central que definiria o Hermes em todos os lançamentos subsequentes: skills que se auto-aprimoram, um gateway de mensagens que alcança os usuários onde quer que estejam, MCP para extensibilidade de ferramentas e um foco incansável em segurança desde o início.
Principais Funcionalidades
1. Gateway de Mensagens Multi-Plataforma
O Hermes não é apenas uma ferramenta de CLI — ele vive onde você vive. O sistema de gateway traz a experiência completa do agente para sete plataformas de mensagens, com gerenciamento unificado de sessões, anexos de mídia e configuração de ferramentas por plataforma.
| Plataforma | Principais Capacidades |
|---|---|
| Telegram | Anexos de arquivos, processamento de documentos (PDF/Office), isolamento de tópicos em fóruns, capturas de tela do navegador, compartilhamento de localização |
| Discord | Contexto de tópicos de canal, suporte a documentos/vídeos, filtragem de mensagens de bots |
| Slack | Tratamento de menções ao app, compartilhamento de documentos/vídeos, registro estruturado de logs |
| Envio nativo de mídia (imagens/vídeos/docs), isolamento de sessão multi-usuário, tratamento de portas entre plataformas | |
| Signal | Gateway completo via signal-cli-rest-api, suporte a URLs de mídia |
| Email (IMAP/SMTP) | Gateway de email completo — envie e receba através de qualquer provedor de email |
| Home Assistant | Ferramentas REST + integração WebSocket, descoberta de serviços |
O núcleo do gateway também introduziu funcionalidades entre plataformas: visibilidade de chamadas de ferramentas de subagentes, notificações configuráveis de processos em segundo plano, edit_message() com fallbacks por plataforma e comandos slash como /compress, /usage e /update.
2. Cliente MCP (Model Context Protocol)
O suporte nativo ao MCP foi uma das primeiras decisões arquiteturais do Hermes — e uma decisão visionária. Antes que o MCP se tornasse o padrão da indústria que é hoje, o Hermes já possuía um cliente pronto para produção.
# Servidores MCP são configurados no config.yaml
# O Hermes descobre ferramentas, recursos e prompts automaticamente
hermes tools # Navegue e ative ferramentas MCP na interface curses
/reload-mcp # Recarregue servidores MCP sem reiniciar
Principais capacidades:
- Transportes stdio e HTTP — conecte-se a servidores MCP locais e remotos
- Suporte a Sampling — servidores MCP podem iniciar requisições LLM de volta através do Hermes
- Descoberta de recursos e prompts — expõe automaticamente as capacidades do servidor
- Reconexão automática — recupera de falhas do servidor sem perder estado
- Reforço de segurança — ferramentas de servidores MCP estão sujeitas às mesmas políticas de aprovação
3. Ecossistema de Skills — Mais de 70 Skills, Agente Auto-Aprimorável
O sistema de skills — o diferencial característico do Hermes — já era abrangente no lançamento. Mais de 70 skills integradas e opcionais em mais de 15 categorias, com um Skills Hub para descoberta pela comunidade.
Como as skills funcionam:
Skills são documentos Markdown armazenados em ~/.hermes/skills/. Quando o Hermes encontra uma tarefa relevante, ele carrega a skill correspondente no contexto como orientação procedural. Após concluir uma tarefa, um “fork de revisão” em segundo plano avalia se a skill ajudou — e escreve ou atualiza skills automaticamente.
# Navegue pelo skills hub
hermes skills browse
# Skills podem ser ativadas/desativadas por plataforma
# Ativação condicional baseada na disponibilidade de ferramentas
# Pré-requisitos garantem que skills com dependências não atendidas permaneçam ocultas
Novas skills incluídas no v0.2.0:
- ASCII Art — pyfiglet (571 fontes), cowsay, imagem-para-ascii
- ASCII Video — Pipeline de produção completo para vídeo no terminal
- DuckDuckGo Search — Busca web com foco em privacidade, com fallback para Firecrawl
- Solana Blockchain — Saldos de carteiras, cotação em USD, nomes de tokens
- AgentMail — Caixas de entrada de email gerenciadas por agentes
- Polymarket — Dados de mercado de previsões (somente leitura)
- OpenClaw Migration — Ferramenta oficial de migração do OpenClaw para o Hermes
- Domain Intelligence — Reconhecimento passivo: subdomínios, SSL, WHOIS, DNS
- Superpowers — Skills de desenvolvimento de software
- Hermes-Atropos — Desenvolvimento de ambientes de RL
- Adicionalmente: busca arXiv, OCR/documentos, diagramas Excalidraw, transcrições do YouTube, busca de GIFs e mais de 40 skills de MLOps
(#743 — @teyrebaz33, #785 — @teyrebaz33)
4. Roteador de Providers Centralizado
Antes do v0.2.0, a lógica de providers estava espalhada entre visão, sumarização, compressão e salvamento de trajetórias — cada um chamando LLMs através de seu próprio caminho de código. O roteador de providers centralizado unifica tudo isso por trás de uma única API call_llm() / async_call_llm().
# Todos os consumidores auxiliares agora passam por um único caminho de código:
# resolve_provider_client() → call_llm()
# Resolução automática de credenciais, tratamento de erros e lógica de retry
Providers suportados no lançamento:
- Nous Portal — integração OAuth nativa
- OpenAI Codex — API Responses com suporte a assinatura ChatGPT
- OpenRouter — Mais de 200 modelos com preferências de roteamento
- Kimi Code API — Modelo especializado em código da Moonshot
- MiniMax — IDs de modelo atualizados
- z.ai/GLM — Modelo bilíngue da Tsinghua
- Azure OpenAI — suporte a deploy empresarial
- Firecrawl auto-hospedado — web scraping em sua própria infraestrutura
(#1003)
5. Servidor ACP — Integração com Editores
Os editores VS Code, Zed e JetBrains agora podem se conectar ao Hermes via o padrão Agent Communication Protocol (ACP). Isso significa que o mesmo agente que roda no seu terminal e apps de mensagens pode auxiliar diretamente dentro do seu editor.
(#949)
6. Motor de Skins/Temas da CLI
Um sistema de customização visual orientado a dados com 7 skins integradas (default, ares, mono, slate, poseidon, sisyphus, charizard) além de suporte a skins YAML personalizadas. Banners, spinners, cores e identidade visual são todos configuráveis — sem necessidade de alterar código.
# ~/.hermes/skins/my-skin.yaml
banner: "custom"
spinner: "dots"
colors:
accent: "#00E5A0"
background: "#0A0A0F"
7. Isolamento com Git Worktree
hermes -w inicia sessões de agente isoladas em git worktrees, permitindo trabalho paralelo seguro no mesmo repositório. Cada worktree recebe seu próprio diretório de trabalho, branch e sessão de agente — sem mais conflitos ao executar múltiplos agentes.
# Inicie o Hermes em um git worktree para trabalho paralelo isolado
hermes -w
(#654)
8. Checkpoints e Rollback no Sistema de Arquivos
Snapshots automáticos são criados antes de operações destrutivas em arquivos. O comando /rollback restaura os arquivos para seu estado anterior — uma rede de segurança que permite experimentar sem medo.
# O agente faz snapshots automaticamente antes de operações destrutivas
# /rollback na CLI para restaurar
# Funciona em todos os backends de terminal (local, Docker, SSH, Modal)
(#824)
Agente Principal e Arquitetura
Melhorias no Loop do Agente
O loop do agente recebeu um reforço substancial para lidar com casos extremos do mundo real:
- Modelo de fallback simples — se o provider principal falhar, o Hermes faz fallback transparente para uma alternativa configurada (#740)
- Orçamentos de iteração compartilhados — agente pai e delegação de subagentes compartilham um orçamento unificado, prevenindo loops descontrolados de subagentes
- Tratamento de erro 413 payload-too-large — em vez de abortar, o Hermes comprime o contexto e tenta novamente (#153)
- Middleware de reparo de chamadas de ferramenta — auto-lowercase e tratador de ferramentas inválidas corrige chamadas de ferramenta malformadas do modelo
- Configuração de esforço de raciocínio — controle quanto o modelo pensa antes de agir (comando
/reasoning) - Detecção de loop após compressão — impede o agente de reler/buscar arquivos após a compressão de contexto (#705)
Sessão e Memória
- Sessões nomeadas — atribua títulos únicos às sessões, navegue com filtro de busca, retome pelo nome (#720)
- Modelagem de usuário Honcho — perfil de usuário nativo de IA entre sessões que melhora ao longo do tempo (#38)
- Flush proativo de memória — persistência assíncrona de memória ao expirar a sessão
- Sondagem inteligente de comprimento de contexto — detecta limites de contexto do modelo com cache persistente
CLI e Experiência do Usuário
CLI Interativa
A experiência no terminal recebeu um grande polimento:
- Comando
/personality— personalidade customizada do agente ou desative completamente (#773) - Comandos rápidos definidos pelo usuário — contorne o loop do agente para ações rápidas e pré-determinadas (#746)
/verbose— alternar saída de debug em tempo de execução (#94)/insights— análises de uso, estimativa de custos e padrões de atividade (#552)/background— gerencie processos em segundo plano pela CLI- Sinal sonoro ao concluir — sino do terminal quando o agente termina uma tarefa (#738)
- Histórico com setas para cima/baixo — navegue por comandos anteriores
- Colar imagem do clipboard — Alt+V / Ctrl+V para colar imagens
--quiet/-Q— modo programático de consulta única com saída mínima--fuck-it-ship-it— contorne todos os prompts de aprovação para fluxos de trabalho totalmente automatizados (#724)
Configuração e Setup
- Assistente de setup modular com subcomandos por seção e UX focada em ferramentas
- Sistema de migração de configuração — atualize de forma transparente entre versões de formato de configuração (v7 no lançamento)
hermes tools— ativação/desativação de ferramentas por plataforma com interface curseshermes doctor— verificações de saúde em todos os providers configuradoshermes update— com reinicialização automática para o serviço de gateway- Escritas atômicas para .env — previne perda de chaves de API em caso de crash (#954)
Segurança
O Hermes Agent levou a segurança a sério desde o primeiro dia. O v0.2.0 foi lançado com uma extensa camada de reforço de segurança:
Prevenção de Vulnerabilidades
| Categoria | Descrição |
|---|---|
| Path Traversal | Corrigido em skill_view — impedia a leitura de arquivos arbitrários (#220) |
| Shell Injection | Prevenção no piping de senha sudo (#65), padrões de tee/substituição de processo (#280) |
| Ataques de Symlink | Correções de verificação de limites em skills_guard (#386), bypass da lista de negação de escrita no macOS (#61) |
| Prompt Injection | Prevenção de bypass com múltiplas palavras (#192), correção de bypass do scanner cron (#63) |
| Comandos Perigosos | Detecção de bypass multi-linha (#233), flag --force adequadamente bloqueada (#388) |
Proteção de Dados
- Escritas atômicas em sessões, tarefas cron, configuração .env, checkpoints de processo, batch runner e arquivos de skill — prevenindo perda de dados em caso de crash
- Aplicação de permissões de arquivo — 0600/0700 em arquivos sensíveis, .env restrito apenas ao proprietário
- Sanitização de consultas FTS5 — previne SQL injection através de consultas de busca de texto completo
- Ocultação de segredos — padrões expansíveis para remover segredos de logs e transcrições
- Allowlist permanente em memória — impede que dados sensíveis vazem para o disco (#600)
Testes — Do Zero a 3.289
Quando o desenvolvimento do v0.2.0 começou, o projeto tinha cobertura de testes próxima de zero. A comunidade respondeu com um esforço massivo de testes:
- 3.289 testes nos módulos de agente, gateway, ferramentas, cron e CLI
- Suíte de testes paralelizada com pytest-xdist (#802)
- Quatro lotes de testes unitários cobrindo módulos principais, caminhos críticos de segurança e o loop do AIAgent
- 43 testes de formatação do Telegram para precisão de renderização de itálico/negrito/código
- 42 testes de ferramentas de visão com type hints completos
- Testes de regressão do compressor para tratamento de limites de chamadas de ferramenta
Esta fundação de testes se provaria crítica à medida que o projeto continuasse sua iteração rápida — com 3.289 testes capturando regressões antes que elas chegassem aos usuários.
Ambientes de RL e Avaliação
O Hermes Agent sempre foi projetado como uma plataforma para gerar dados de treinamento agentivos. O v0.2.0 foi lançado com:
- WebResearchEnv — ambiente de RL de pesquisa web em múltiplas etapas (#434)
- YC-Bench — ambiente de benchmark para agentes de longo horizonte
- OpenThoughts-TBLite — ambiente e scripts de avaliação
- Suporte local ao vLLM — execute avaliações em modelos hospedados localmente
- Hermes-Atropos — skill integrada para desenvolvimento de ambientes de RL (#815)
Compatibilidade com Windows
O suporte ao Windows foi uma preocupação de primeira classe desde o início:
- Funções de processo exclusivas do POSIX protegidas para compatibilidade com Windows
- Suporte nativo via Git Bash + fallback de atualização baseado em ZIP
pywinptypara suporte PTY no Windows (#457)- Codificação UTF-8 explícita em todas as operações de E/S de arquivos de configuração/dados (#458)
- Tratamento de caminhos com letra de unidade para saída de busca baseada em regex (#533)
Atualização
hermes update
Para novas instalações:
# Linux / macOS / WSL2
curl -fsSL https://raw.githubusercontent.com/NousResearch/hermes-agent/main/scripts/install.sh | bash
← Hermes Agent Changelog