Hermes Agent Lab

Blog do Hermes Agent — Guias Práticos e Insights

Últimos artigos e insights.

Post em destaque

Hermes v0.20.0 Herald em detalhes: voz conversacional, wake words, citações fundamentadas e A2A

O Hermes Agent v0.20.0 (Herald) chegou: fale com o Hermes com voz com barge-in, wake words mãos-livres, voz em todas as plataformas, pesquisa com fontes verificáveis e citações, interoperabilidade A2A entre agentes, Artifacts no desktop, webhooks de saída e uma leva de comandos poderosos de CLI.

Ler mais

Busque Uma Vez, Pergunte Três: tool_search Multi-Query com Stemming

O tool_search do Hermes acabou de ganhar uma atualização séria: agora ele aceita um array de queries pesquisadas em paralelo, retorna resultados agrupados por query com um único mapa compartilhado de tools, e o stemming Snowball faz 'browsing' casar com 'browser' e 'issues' com 'create_issue'. O tool_describe também processa nomes em lote, então um nome errado não derruba mais a chamada inteira. Menos round-trips, descoberta mais barata, melhor recall.

Ler mais

Chega de Chatice do Keychain: Criptografia Opcional no Keychain do SO para Segredos Armazenados

O safeStorage do Electron costumava estacionar uma chave por app no keychain de login do macOS — e em máquinas com keychain bloqueado ou ausente, toda inicialização do Hermes Desktop virava um prompt de senha bloqueante de 'Keychain Not Found'. A v0.20.6 torna a criptografia com keychain um opt-in explícito: o caminho padrão nunca toca no safeStorage, uma migração única converte blobs criptografados antigos em arquivos simples 0600, e ligar o toggle recodifica cada segredo armazenado no lugar.

Ler mais

Navegue como Você: Navegação com Perfil Real no Hermes Agent

O browser do Hermes costumava iniciar toda sessão deslogado — uma parede no momento em que uma tarefa precisava dos seus logins. A navegação com perfil real sob consentimento copia o perfil ativo do seu browser padrão para um snapshot gerenciado e o dirige com o Chromium empacotado do Hermes: o agente navega como você, com seus cookies e logins salvos, sempre sob consentimento explícito e desativado por padrão. Veja como funciona, como ativar e os cuidados com o Windows.

Ler mais

Publique com Um Comando: a skill publish-site para deploys versionados de sites

A nova skill publish-site transforma 'colocar este site no ar' num pipeline disciplinado de cinco etapas: build, pré-visualização local (ou via um túnel compartilhável), versionamento de cada deploy com uma git tag, deploy através de uma escada de providers (GitHub Pages → Cloudflare Pages → Netlify) e verificação de que a URL ao vivo retorna HTTP 200 antes de reportar sucesso. O rollback está a um comando de distância.

Ler mais

Hermes v0.20.6: o agente aprende a navegar como você, um catálogo de MCP com 50+ servidores e segredos sem a chatice do keychain

A v0.20.6 é um rolamento constante de substância: a navegação com perfil real sob consentimento deixa o agente usar seus logins reais de browser, o Browser do desktop ganha janela própria do SO e um mecanismo gerenciado de atualização remota via SSH, o catálogo remoto de MCP passa de 50 servidores de fornecedores verificados ao vivo, web_search/web_extract ganham cache de resultados com TTL, a compactação lean-tail vira o padrão, o tool_search aprende buscas multi-query com stemming e segredos armazenados podem optar pela criptografia no keychain do SO — chega de prompts do Keychain a cada inicialização.

Ler mais

A Dieta de Contexto do Hermes: Corte o Gasto de Tokens por Turno do Jeito Oficial

Cada turno reenvia toda a conversa ao modelo — e você paga tudo. Este guia prático percorre as quatro camadas que o Hermes oferece para enxugar o contexto: compressão automática dupla, a reforma da compressão na v0.20 (micro-compactação, cauda de N mensagens, defesa ghost-skill, lean tail), limites por modelo e higiene diária com /context, /usage e /compress.

Ler mais

A Compaction do Hermes Ganha um Padrão Lean: Modelos de Janela Grande Deixam de Acumular Tails de 170K Tokens

O compression.tail_mode agora tem lean como padrão: a compaction mantém um tail verbatim limitado a 2,5% da janela (10K–25K tokens) em vez da acumulação de 100K–240K da fórmula legada em modelos de janela grande.

Ler mais

GLM-5.3-Flash Chega ao Hermes: Uma Opção de 1M de Contexto no Model Picker

O z-ai/glm-5.3-flash junta-se aos catálogos de modelos do Hermes para OpenRouter (43 modelos) e Nous Portal (32 modelos): uma janela de contexto de 1.048.576 tokens a $0,075/M de input e $0,25/M de output — feito para sessões maratona e bases de código grandes.

Ler mais