
Busque Uma Vez, Pergunte Três: tool_search Multi-Query com Stemming
O tool_search do Hermes acabou de ganhar uma atualização séria: agora ele aceita um array de queries pesquisadas em paralelo, retorna resultados agrupados por query com um único mapa compartilhado de tools, e o stemming Snowball faz 'browsing' casar com 'browser' e 'issues' com 'create_issue'. O tool_describe também processa nomes em lote, então um nome errado não derruba mais a chamada inteira. Menos round-trips, descoberta mais barata, melhor recall.
Ler mais
Chega de Chatice do Keychain: Criptografia Opcional no Keychain do SO para Segredos Armazenados
O safeStorage do Electron costumava estacionar uma chave por app no keychain de login do macOS — e em máquinas com keychain bloqueado ou ausente, toda inicialização do Hermes Desktop virava um prompt de senha bloqueante de 'Keychain Not Found'. A v0.20.6 torna a criptografia com keychain um opt-in explícito: o caminho padrão nunca toca no safeStorage, uma migração única converte blobs criptografados antigos em arquivos simples 0600, e ligar o toggle recodifica cada segredo armazenado no lugar.
Ler mais
Navegue como Você: Navegação com Perfil Real no Hermes Agent
O browser do Hermes costumava iniciar toda sessão deslogado — uma parede no momento em que uma tarefa precisava dos seus logins. A navegação com perfil real sob consentimento copia o perfil ativo do seu browser padrão para um snapshot gerenciado e o dirige com o Chromium empacotado do Hermes: o agente navega como você, com seus cookies e logins salvos, sempre sob consentimento explícito e desativado por padrão. Veja como funciona, como ativar e os cuidados com o Windows.
Ler mais
Publique com Um Comando: a skill publish-site para deploys versionados de sites
A nova skill publish-site transforma 'colocar este site no ar' num pipeline disciplinado de cinco etapas: build, pré-visualização local (ou via um túnel compartilhável), versionamento de cada deploy com uma git tag, deploy através de uma escada de providers (GitHub Pages → Cloudflare Pages → Netlify) e verificação de que a URL ao vivo retorna HTTP 200 antes de reportar sucesso. O rollback está a um comando de distância.
Ler mais
Hermes v0.20.6: o agente aprende a navegar como você, um catálogo de MCP com 50+ servidores e segredos sem a chatice do keychain
A v0.20.6 é um rolamento constante de substância: a navegação com perfil real sob consentimento deixa o agente usar seus logins reais de browser, o Browser do desktop ganha janela própria do SO e um mecanismo gerenciado de atualização remota via SSH, o catálogo remoto de MCP passa de 50 servidores de fornecedores verificados ao vivo, web_search/web_extract ganham cache de resultados com TTL, a compactação lean-tail vira o padrão, o tool_search aprende buscas multi-query com stemming e segredos armazenados podem optar pela criptografia no keychain do SO — chega de prompts do Keychain a cada inicialização.
Ler mais
A Dieta de Contexto do Hermes: Corte o Gasto de Tokens por Turno do Jeito Oficial
Cada turno reenvia toda a conversa ao modelo — e você paga tudo. Este guia prático percorre as quatro camadas que o Hermes oferece para enxugar o contexto: compressão automática dupla, a reforma da compressão na v0.20 (micro-compactação, cauda de N mensagens, defesa ghost-skill, lean tail), limites por modelo e higiene diária com /context, /usage e /compress.
Ler mais
A Compaction do Hermes Ganha um Padrão Lean: Modelos de Janela Grande Deixam de Acumular Tails de 170K Tokens
O compression.tail_mode agora tem lean como padrão: a compaction mantém um tail verbatim limitado a 2,5% da janela (10K–25K tokens) em vez da acumulação de 100K–240K da fórmula legada em modelos de janela grande.
Ler mais
GLM-5.3-Flash Chega ao Hermes: Uma Opção de 1M de Contexto no Model Picker
O z-ai/glm-5.3-flash junta-se aos catálogos de modelos do Hermes para OpenRouter (43 modelos) e Nous Portal (32 modelos): uma janela de contexto de 1.048.576 tokens a $0,075/M de input e $0,25/M de output — feito para sessões maratona e bases de código grandes.
Ler mais