v0.2.0

Hermes Agent v0.2.0 — O Primeiro Lançamento Público


Visão Geral

v0.2.0 — O Primeiro Lançamento Público. 12 de março de 2026. 216 pull requests mesclados · 63 contribuidores · 119 issues resolvidas · de quase zero testes para 3.289.

Este é o momento em que o Hermes Agent foi apresentado ao mundo. Em pouco mais de duas semanas após a fundação interna do v0.1.0, o projeto explodiu de um pequeno protótipo de pesquisa para uma plataforma de agentes de IA completa e orientada pela comunidade. O que torna este lançamento notável não é apenas a lista de funcionalidades — é a velocidade. 63 pessoas da comunidade open-source contribuíram com código, testes, documentação e correções de segurança, moldando a arquitetura do projeto desde o primeiro dia.

O v0.2.0 estabelece o DNA central que definiria o Hermes em todos os lançamentos subsequentes: skills que se auto-aprimoram, um gateway de mensagens que alcança os usuários onde quer que estejam, MCP para extensibilidade de ferramentas e um foco incansável em segurança desde o início.


Principais Funcionalidades

1. Gateway de Mensagens Multi-Plataforma

O Hermes não é apenas uma ferramenta de CLI — ele vive onde você vive. O sistema de gateway traz a experiência completa do agente para sete plataformas de mensagens, com gerenciamento unificado de sessões, anexos de mídia e configuração de ferramentas por plataforma.

Plataforma Principais Capacidades
Telegram Anexos de arquivos, processamento de documentos (PDF/Office), isolamento de tópicos em fóruns, capturas de tela do navegador, compartilhamento de localização
Discord Contexto de tópicos de canal, suporte a documentos/vídeos, filtragem de mensagens de bots
Slack Tratamento de menções ao app, compartilhamento de documentos/vídeos, registro estruturado de logs
WhatsApp Envio nativo de mídia (imagens/vídeos/docs), isolamento de sessão multi-usuário, tratamento de portas entre plataformas
Signal Gateway completo via signal-cli-rest-api, suporte a URLs de mídia
Email (IMAP/SMTP) Gateway de email completo — envie e receba através de qualquer provedor de email
Home Assistant Ferramentas REST + integração WebSocket, descoberta de serviços

O núcleo do gateway também introduziu funcionalidades entre plataformas: visibilidade de chamadas de ferramentas de subagentes, notificações configuráveis de processos em segundo plano, edit_message() com fallbacks por plataforma e comandos slash como /compress, /usage e /update.

2. Cliente MCP (Model Context Protocol)

O suporte nativo ao MCP foi uma das primeiras decisões arquiteturais do Hermes — e uma decisão visionária. Antes que o MCP se tornasse o padrão da indústria que é hoje, o Hermes já possuía um cliente pronto para produção.

# Servidores MCP são configurados no config.yaml
# O Hermes descobre ferramentas, recursos e prompts automaticamente
hermes tools  # Navegue e ative ferramentas MCP na interface curses
/reload-mcp   # Recarregue servidores MCP sem reiniciar

Principais capacidades:

  • Transportes stdio e HTTP — conecte-se a servidores MCP locais e remotos
  • Suporte a Sampling — servidores MCP podem iniciar requisições LLM de volta através do Hermes
  • Descoberta de recursos e prompts — expõe automaticamente as capacidades do servidor
  • Reconexão automática — recupera de falhas do servidor sem perder estado
  • Reforço de segurança — ferramentas de servidores MCP estão sujeitas às mesmas políticas de aprovação

(#291@0xbyt4, #301, #753)

3. Ecossistema de Skills — Mais de 70 Skills, Agente Auto-Aprimorável

O sistema de skills — o diferencial característico do Hermes — já era abrangente no lançamento. Mais de 70 skills integradas e opcionais em mais de 15 categorias, com um Skills Hub para descoberta pela comunidade.

Como as skills funcionam: Skills são documentos Markdown armazenados em ~/.hermes/skills/. Quando o Hermes encontra uma tarefa relevante, ele carrega a skill correspondente no contexto como orientação procedural. Após concluir uma tarefa, um “fork de revisão” em segundo plano avalia se a skill ajudou — e escreve ou atualiza skills automaticamente.

# Navegue pelo skills hub
hermes skills browse

# Skills podem ser ativadas/desativadas por plataforma
# Ativação condicional baseada na disponibilidade de ferramentas
# Pré-requisitos garantem que skills com dependências não atendidas permaneçam ocultas

Novas skills incluídas no v0.2.0:

  • ASCII Art — pyfiglet (571 fontes), cowsay, imagem-para-ascii
  • ASCII Video — Pipeline de produção completo para vídeo no terminal
  • DuckDuckGo Search — Busca web com foco em privacidade, com fallback para Firecrawl
  • Solana Blockchain — Saldos de carteiras, cotação em USD, nomes de tokens
  • AgentMail — Caixas de entrada de email gerenciadas por agentes
  • Polymarket — Dados de mercado de previsões (somente leitura)
  • OpenClaw Migration — Ferramenta oficial de migração do OpenClaw para o Hermes
  • Domain Intelligence — Reconhecimento passivo: subdomínios, SSL, WHOIS, DNS
  • Superpowers — Skills de desenvolvimento de software
  • Hermes-Atropos — Desenvolvimento de ambientes de RL
  • Adicionalmente: busca arXiv, OCR/documentos, diagramas Excalidraw, transcrições do YouTube, busca de GIFs e mais de 40 skills de MLOps

(#743@teyrebaz33, #785@teyrebaz33)

4. Roteador de Providers Centralizado

Antes do v0.2.0, a lógica de providers estava espalhada entre visão, sumarização, compressão e salvamento de trajetórias — cada um chamando LLMs através de seu próprio caminho de código. O roteador de providers centralizado unifica tudo isso por trás de uma única API call_llm() / async_call_llm().

# Todos os consumidores auxiliares agora passam por um único caminho de código:
# resolve_provider_client() → call_llm()
# Resolução automática de credenciais, tratamento de erros e lógica de retry

Providers suportados no lançamento:

  • Nous Portal — integração OAuth nativa
  • OpenAI Codex — API Responses com suporte a assinatura ChatGPT
  • OpenRouter — Mais de 200 modelos com preferências de roteamento
  • Kimi Code API — Modelo especializado em código da Moonshot
  • MiniMax — IDs de modelo atualizados
  • z.ai/GLM — Modelo bilíngue da Tsinghua
  • Azure OpenAI — suporte a deploy empresarial
  • Firecrawl auto-hospedado — web scraping em sua própria infraestrutura

(#1003)

5. Servidor ACP — Integração com Editores

Os editores VS Code, Zed e JetBrains agora podem se conectar ao Hermes via o padrão Agent Communication Protocol (ACP). Isso significa que o mesmo agente que roda no seu terminal e apps de mensagens pode auxiliar diretamente dentro do seu editor.

(#949)

6. Motor de Skins/Temas da CLI

Um sistema de customização visual orientado a dados com 7 skins integradas (default, ares, mono, slate, poseidon, sisyphus, charizard) além de suporte a skins YAML personalizadas. Banners, spinners, cores e identidade visual são todos configuráveis — sem necessidade de alterar código.

# ~/.hermes/skins/my-skin.yaml
banner: "custom"
spinner: "dots"
colors:
  accent: "#00E5A0"
  background: "#0A0A0F"

7. Isolamento com Git Worktree

hermes -w inicia sessões de agente isoladas em git worktrees, permitindo trabalho paralelo seguro no mesmo repositório. Cada worktree recebe seu próprio diretório de trabalho, branch e sessão de agente — sem mais conflitos ao executar múltiplos agentes.

# Inicie o Hermes em um git worktree para trabalho paralelo isolado
hermes -w

(#654)

8. Checkpoints e Rollback no Sistema de Arquivos

Snapshots automáticos são criados antes de operações destrutivas em arquivos. O comando /rollback restaura os arquivos para seu estado anterior — uma rede de segurança que permite experimentar sem medo.

# O agente faz snapshots automaticamente antes de operações destrutivas
# /rollback na CLI para restaurar
# Funciona em todos os backends de terminal (local, Docker, SSH, Modal)

(#824)


Agente Principal e Arquitetura

Melhorias no Loop do Agente

O loop do agente recebeu um reforço substancial para lidar com casos extremos do mundo real:

  • Modelo de fallback simples — se o provider principal falhar, o Hermes faz fallback transparente para uma alternativa configurada (#740)
  • Orçamentos de iteração compartilhados — agente pai e delegação de subagentes compartilham um orçamento unificado, prevenindo loops descontrolados de subagentes
  • Tratamento de erro 413 payload-too-large — em vez de abortar, o Hermes comprime o contexto e tenta novamente (#153)
  • Middleware de reparo de chamadas de ferramenta — auto-lowercase e tratador de ferramentas inválidas corrige chamadas de ferramenta malformadas do modelo
  • Configuração de esforço de raciocínio — controle quanto o modelo pensa antes de agir (comando /reasoning)
  • Detecção de loop após compressão — impede o agente de reler/buscar arquivos após a compressão de contexto (#705)

Sessão e Memória

  • Sessões nomeadas — atribua títulos únicos às sessões, navegue com filtro de busca, retome pelo nome (#720)
  • Modelagem de usuário Honcho — perfil de usuário nativo de IA entre sessões que melhora ao longo do tempo (#38)
  • Flush proativo de memória — persistência assíncrona de memória ao expirar a sessão
  • Sondagem inteligente de comprimento de contexto — detecta limites de contexto do modelo com cache persistente

CLI e Experiência do Usuário

CLI Interativa

A experiência no terminal recebeu um grande polimento:

  • Comando /personality — personalidade customizada do agente ou desative completamente (#773)
  • Comandos rápidos definidos pelo usuário — contorne o loop do agente para ações rápidas e pré-determinadas (#746)
  • /verbose — alternar saída de debug em tempo de execução (#94)
  • /insights — análises de uso, estimativa de custos e padrões de atividade (#552)
  • /background — gerencie processos em segundo plano pela CLI
  • Sinal sonoro ao concluir — sino do terminal quando o agente termina uma tarefa (#738)
  • Histórico com setas para cima/baixo — navegue por comandos anteriores
  • Colar imagem do clipboard — Alt+V / Ctrl+V para colar imagens
  • --quiet/-Q — modo programático de consulta única com saída mínima
  • --fuck-it-ship-it — contorne todos os prompts de aprovação para fluxos de trabalho totalmente automatizados (#724)

Configuração e Setup

  • Assistente de setup modular com subcomandos por seção e UX focada em ferramentas
  • Sistema de migração de configuração — atualize de forma transparente entre versões de formato de configuração (v7 no lançamento)
  • hermes tools — ativação/desativação de ferramentas por plataforma com interface curses
  • hermes doctor — verificações de saúde em todos os providers configurados
  • hermes update — com reinicialização automática para o serviço de gateway
  • Escritas atômicas para .env — previne perda de chaves de API em caso de crash (#954)

Segurança

O Hermes Agent levou a segurança a sério desde o primeiro dia. O v0.2.0 foi lançado com uma extensa camada de reforço de segurança:

Prevenção de Vulnerabilidades

Categoria Descrição
Path Traversal Corrigido em skill_view — impedia a leitura de arquivos arbitrários (#220)
Shell Injection Prevenção no piping de senha sudo (#65), padrões de tee/substituição de processo (#280)
Ataques de Symlink Correções de verificação de limites em skills_guard (#386), bypass da lista de negação de escrita no macOS (#61)
Prompt Injection Prevenção de bypass com múltiplas palavras (#192), correção de bypass do scanner cron (#63)
Comandos Perigosos Detecção de bypass multi-linha (#233), flag --force adequadamente bloqueada (#388)

Proteção de Dados

  • Escritas atômicas em sessões, tarefas cron, configuração .env, checkpoints de processo, batch runner e arquivos de skill — prevenindo perda de dados em caso de crash
  • Aplicação de permissões de arquivo — 0600/0700 em arquivos sensíveis, .env restrito apenas ao proprietário
  • Sanitização de consultas FTS5 — previne SQL injection através de consultas de busca de texto completo
  • Ocultação de segredos — padrões expansíveis para remover segredos de logs e transcrições
  • Allowlist permanente em memória — impede que dados sensíveis vazem para o disco (#600)

Testes — Do Zero a 3.289

Quando o desenvolvimento do v0.2.0 começou, o projeto tinha cobertura de testes próxima de zero. A comunidade respondeu com um esforço massivo de testes:

  • 3.289 testes nos módulos de agente, gateway, ferramentas, cron e CLI
  • Suíte de testes paralelizada com pytest-xdist (#802)
  • Quatro lotes de testes unitários cobrindo módulos principais, caminhos críticos de segurança e o loop do AIAgent
  • 43 testes de formatação do Telegram para precisão de renderização de itálico/negrito/código
  • 42 testes de ferramentas de visão com type hints completos
  • Testes de regressão do compressor para tratamento de limites de chamadas de ferramenta

Esta fundação de testes se provaria crítica à medida que o projeto continuasse sua iteração rápida — com 3.289 testes capturando regressões antes que elas chegassem aos usuários.


Ambientes de RL e Avaliação

O Hermes Agent sempre foi projetado como uma plataforma para gerar dados de treinamento agentivos. O v0.2.0 foi lançado com:

  • WebResearchEnv — ambiente de RL de pesquisa web em múltiplas etapas (#434)
  • YC-Bench — ambiente de benchmark para agentes de longo horizonte
  • OpenThoughts-TBLite — ambiente e scripts de avaliação
  • Suporte local ao vLLM — execute avaliações em modelos hospedados localmente
  • Hermes-Atropos — skill integrada para desenvolvimento de ambientes de RL (#815)

Compatibilidade com Windows

O suporte ao Windows foi uma preocupação de primeira classe desde o início:

  • Funções de processo exclusivas do POSIX protegidas para compatibilidade com Windows
  • Suporte nativo via Git Bash + fallback de atualização baseado em ZIP
  • pywinpty para suporte PTY no Windows (#457)
  • Codificação UTF-8 explícita em todas as operações de E/S de arquivos de configuração/dados (#458)
  • Tratamento de caminhos com letra de unidade para saída de busca baseada em regex (#533)

Atualização

hermes update

Para novas instalações:

# Linux / macOS / WSL2
curl -fsSL https://raw.githubusercontent.com/NousResearch/hermes-agent/main/scripts/install.sh | bash

Changelog completo no GitHub

← Hermes Agent Changelog