v0.12.0

Hermes Agent v0.12.0 — A versão Curator


Visão Geral

v0.12.0 — The Curator Release. Lançado em 30 de abril de 2026. 1.096 commits · 550 PRs mesclados · 1.270 arquivos alterados · 217.776 inserções · 213 contribuidores da comunidade.

O Curator Release responde a uma pergunta que todo usuário de agentes de longa duração eventualmente enfrenta: quem mantém o conhecimento do agente? A resposta agora é o próprio agente. Um Curator autônomo em segundo plano avalia, consolida e limpa sua biblioteca de skills em um ciclo de 7 dias — sem intervenção humana. O loop de auto-aprimoramento (o motor central que decide o que salvar após cada turno) foi substancialmente reescrito, passando de julgamento livre para avaliação baseada em rubrica. Quatro novos provedores de inferência chegaram, as plataformas de mensagens atingiram 19 com o primeiro adaptador distribuído como plugin (Microsoft Teams), ComfyUI v5 e TouchDesigner-MCP passaram de opcionais para integrados por padrão, Spotify e Google Meet receberam integrações nativas, e a inicialização a frio do TUI foi reduzida em mais da metade.


Funcionalidades Principais

1. Curator Autônomo — O Agente Se Mantém Sozinho

Após meses de uso intenso, sua biblioteca de skills inevitavelmente acumula duplicatas, rascunhos obsoletos e skills de uso único. O Curator é um agente em segundo plano que resolve isso de forma autônoma.

Como funciona:

  • Executa no ticker cron do gateway com um ciclo de 7 dias por padrão
  • Avalia cada skill na biblioteca por uso e relevância
  • Consolida skills sobrepostas em entradas unificadas
  • Limpa skills mortos que não foram usados
  • Classifica skills arquivados como “consolidados” ou “limpos” usando modelo + heurística
  • Escreve relatórios por execução em logs/curator/run.json e REPORT.md
# Verificar status do Curator — classifica skills por uso
hermes curator status
# Saída: skills mais/menos usados, consolidações recentes, relatórios

Proteções integradas:

  • Skills empacotados e do hub são bloqueados com defesa em profundidade
  • Skills fixados são protegidos contra mutação
  • skill_manage recusa escritas em skills fixados
  • Skills de diretórios externos são respeitados como estão

Gerenciamento unificado:

# hermes.config.yaml
auxiliary:
  curator:
    provider: openrouter
    model: deepseek-v4-flash  # modelo auxiliar barato é ideal
    enabled: true

curator:
  cycle_days: 7
  max_prunes_per_run: 20
  min_skill_age_days: 3  # proteger skills muito recentes

2. Loop de Auto-Aprimoramento — A Reescrita por Rubrica

O loop de auto-aprimoramento é o motor de aprendizado central do Hermes: após cada turno de conversa, um fork de revisão em segundo plano decide quais memórias e skills salvar ou atualizar. v0.12 reescreveu este sistema completamente.

O que mudou:

  • Avaliação baseada em rubrica em vez de perguntas livres “devemos atualizar isso?”
  • Viés de atualização ativa — prefere atualizar o skill que o agente acabou de carregar
  • Lida com subarquivos — diretórios references/ e templates/ são rastreados corretamente
  • Herança correta do runtime — provedor, modelo e credenciais agora se propagam do pai
  • Ferramentas restritas — fork de revisão limitado a ferramentas de memória + skills; sem shell, sem web
  • Desligamento limpo — provedores de memória encerram corretamente após revisão
  • Contexto limpo — mensagens de ferramentas de turnos anteriores são excluídas do resumo de revisão

3. LM Studio — Provedor de Primeira Classe

O LM Studio passou de um alias de endpoint personalizado para um provedor nativo completo:

hermes setup --provider lmstudio
hermes model --provider lmstudio

Com autenticação dedicada, verificações de saúde hermes doctor, suporte a transporte reasoning e listagem de modelos ao vivo.

4. Quatro Novos Provedores de Inferência

Provedor Detalhes
GMI Cloud Provedor API-key de primeira classe
Azure AI Foundry Detecção automática, integração empresarial completa
MiniMax OAuth Fluxo PKCE no navegador com integração OAuth completa
Tencent Tokenhub Novo provedor para o ecossistema de modelos Tencent

Novos modelos: gpt-5.5 / gpt-5.5-pro, deepseek-v4-pro / deepseek-v4-flash, qwen3.6-plus, e um manifesto remoto de catálogo de modelos.

5. Gateway Plugável + Microsoft Teams (19ª Plataforma)

# Plataforma Tipo
18 Tencent Yuanbao (元宝) Adaptador nativo com entrega de texto + mídia
19 Microsoft Teams Primeiro adaptador distribuído como plugin

6. Integração Nativa do Spotify

Sete ferramentas com PKCE OAuth e assistente de configuração interativo:

hermes spotify setup
Ferramenta Função
Reproduzir/pausar Controlar reprodução em qualquer dispositivo
Buscar Encontrar faixas, álbuns, artistas, playlists
Fila Gerenciar a fila de reprodução
Playlists Criar e gerenciar playlists
Dispositivos Alternar entre dispositivos disponíveis

7. Plugin do Google Meet

Participar de chamadas, transcrever conversas, responder por voz, fazer acompanhamento:

hermes meet join https://meet.google.com/xxx-xxxx-xxx

8. ComfyUI v5 & TouchDesigner-MCP — Agora Integrados por Padrão

ComfyUI v5 passou de opcional para integrado, com CLI oficial + REST + instalação local com verificação de hardware.

TouchDesigner-MCP agora integrado por padrão: shaders GLSL, configuração de pós-FX, setups reativos a áudio, programação de nós geométricos, 9 novos documentos de referência.

9. Expansão do Ecossistema de Skills

Skill Descrição
Humanizer Remove marcas de IA do texto gerado
claude-design Skill de artefatos HTML
design-md Especificação DESIGN.md do Google
airtable Integração com banco de dados Airtable
pretext Demos criativas de navegador
spike + sketch Experimentos descartáveis + mockups HTML
hermes skills install https://example.com/skill.tar.gz
/reload-skills
hermes skills list

10. hermes -z — Modo One-Shot

hermes -z "Resuma esta base de código"
hermes -z "Revise este diff de PR" --model gpt-5.5 --provider openrouter

11. Painel Web — Aba Modelos

Nova aba Modelos com análises detalhadas por modelo. Configure modelos principais e auxiliares diretamente do navegador.

12. Performance — Inicialização 57% Mais Rápida

Tempo de inicialização a frio visível do TUI reduzido em mais da metade através de: inicialização tardia do agente, imports preguiçosos, load_config() com cache mtime, get_tool_definitions() memoizado e padrões de comandos perigosos pré-compilados.

13. Roteamento Nativo de Imagens Multimodais

Imagens agora são roteadas com base na capacidade visual real do modelo, não nos padrões do provedor.

14. Paridade de Mídia do Gateway

Envio nativo de múltiplas imagens no Telegram, Discord, Slack, Mattermost, Email e Signal. Roteamento de áudio centralizado com suporte FLAC.


Novas Ferramentas & Comandos Integrados

Ferramenta / Comando Descrição Uso
hermes curator Agente de manutenção da biblioteca de skills hermes curator status
hermes -z Modo one-shot não interativo hermes -z "<prompt>"
hermes update --check Verificação prévia antes de atualizar hermes update --check
hermes fallback Gerenciar cadeias de provedores de fallback hermes fallback list
/busy Modo de entrada ocupado (steer/queue) /busy steer
/btw Atalho para /background /btw <tarefa>
/reload-skills Recarregar skills sem reiniciar /reload-skills
/reload Recarregar .env a quente no TUI /reload
/mouse Alternar modo mouse /mouse

TUI — Grande Atualização

  • Renderização LaTeX — expressões matemáticas nativas
  • Estilos de indicador de ocupado plugáveis
  • Auto-retomada opcional da última sessão
  • Exclusão de sessão do seletor /resume com tecla d
  • Rolagem linha a linha com roda do mouse
  • Edição de fila — excluir com ctrl-x, cancelar com esc
  • Detecção automática expandida de terminal claro
  • Paridade do modo de voz com CLI
  • Mini menu de ajuda com ? no campo de entrada
  • Desativação proativa do mouse no ConPTY + comando /mouse

TTS — Registro de Provedores Plugável

tts:
  providers:
    piper:           # TTS local — sem necessidade de nuvem
      voice: en_US-lessac-medium
    openai:          # TTS na nuvem
      voice: alloy

Melhorias

Agente Principal & Arquitetura

  • TTL de cache de prompt configurável (prompt_caching.cache_ttl)
  • child_timeout_seconds padrão aumentado para 600s
  • Dump de diagnóstico em timeout de subagente com 0 chamadas API
  • Gateway invalida agente em cache em edições de configuração
  • Rodapé de metadados de runtime opcional
  • Whitelist /fast ampliada para todos os modelos OpenAI + Anthropic

Compressão

  • Nova tentativa de resumo no modelo principal antes de desistir
  • Notificar usuários quando modelo auxiliar falha
  • /compress bloqueia entrada durante compressão

Sessão & Memória

  • Índice trigrama FTS5 para busca CJK
  • tool_name + tool_calls indexados no FTS5
  • Limpeza automática de checkpoints órfãos
  • Preservar links simbólicos durante escritas atômicas

Plataformas de Mensagens

Plataforma Melhoria
Telegram Listas de permissão de chat; renderização de tabelas markdown; multi-imagem nativo
Discord Toolsets opcionais + injeção de ID
Slack Comandos slash nativos; strict_mention; channel_skill_bindings
Signal Formatação markdown nativa; multi-imagem

Cron

  • Respeita configuração hermes tools
  • workdir por tarefa
  • Campo context_from
  • Supervisor CDP
  • Inicialização automática do Chromium local

Execução de Código

  • Backend Vercel Sandbox
  • Docker: executar contêiner como usuário host

Observabilidade

  • Plugin empacotado Langfuse
  • Plugin empacotado hermes-achievements

Segurança & Confiabilidade

  • Redação de segredos desativada por padrão — evita corrupção de patches. Ativar com redaction.enabled: true
  • [SYSTEM:[IMPORTANT: em todos os marcadores injetados
  • Lista de bloqueio restrita para comandos irrecuperáveis
  • Helper canônico mask_secret
  • Limpeza programada de uploads paste.rs expirados
  • Preservar links simbólicos durante escritas atômicas

Correções de Bugs Notáveis

360 PRs fix: nesta janela. Destaques:

  • Fork de revisão herda runtime ao vivo do pai
  • Raciocínio em streaming persiste nos turnos do assistente
  • Isolamento de raciocínio entre provedores
  • croniter promovido a dependência principal
  • Recuperação de compressão
  • Busca FTS5 com tool_name + tool_calls indexados
  • Cache de visão usa HERMES_HOME
  • Refs definitions MCP reescritas para $defs
  • Compatibilidade com filtro de conteúdo Azure
  • Parâmetro limit do Discord convertido para int antes de min()

Removido / Revertido

  • Quadro Kanban multi-perfil — revertido para redesign
  • cua-driver computer-use — PRs preparatórios revertidos
  • Hook integrado BOOT.md removido
  • Comandos slash /provider + /plan removidos
  • flush_memories completamente removido

Atualização

hermes update

Para novas instalações, consulte o guia de instalação.


Changelog completo no GitHub

← Hermes Agent Changelog