Snapshots de browser limitados a 15 000 carateres? O Hermes torna o orçamento configurável — e elimina o custo oculto dos resumos com LLM

Pedes ao Hermes para ler uma página de documentação online longa, e ele só vê os parágrafos iniciais — o resto foi cortado pelo orçamento de snapshot. Ou o oposto: a página nem é assim tão grande, mas o Hermes fez discretamente uma chamada ao “modelo de sumarização” para comprimir a página por ti, acrescentando uma linha à fatura de tokens que nunca notaste. Dois PRs fundidos a 25 de agosto corrigem ambas as coisas de uma vez: o PR #94453 transforma o orçamento de carateres dos snapshots de browser numa opção de configuração, e o PR #94401 retira por completo o caminho de “chamar um LLM auxiliar para resumir snapshots”.
Contexto: o que é um snapshot de browser e porque existe o orçamento
Quando o Hermes “olha” para uma página web, não enfia um screenshot completo no modelo — isso é lento e caro. Em vez disso, converte a árvore de acessibilidade da página (uma descrição normalizada da estrutura da página) num snapshot de texto para o modelo ler. Snapshot maior = mais página que o modelo consegue ver, mas também mais contexto (tokens) consumido. Por isso o Hermes dá aos snapshots um orçamento de carateres: tudo o que ultrapassar o orçamento é truncado.
Esse orçamento costumava ser uma constante hardcoded (15 000 carateres) — não ajustável pelo utilizador. O PR #94453 transforma-o em browser.snapshot_threshold:
# verifica o valor atual
hermes config get browser.snapshot_threshold
# aumenta-o: guarda mais das páginas de documentação longas
hermes config set browser.snapshot_threshold 30000
# baixa-o: poupa espaço de contexto
hermes config set browser.snapshot_threshold 8000
O padrão continua a ser 15 000, com um mínimo de 1 000. No config.yaml vive na secção browser:
browser:
snapshot_threshold: 30000
Valores inválidos (por exemplo, 0 ou negativos) voltam ao padrão em vez de rebentar. Os caminhos de snapshot do Camofox respeitam a mesma definição.
A mudança maior: os snapshots deixam de pagar por resumos de LLM
O PR #94401 corrige um desperdício silencioso. Anteriormente, quando um snapshot de página excedia o orçamento, o Hermes pedia emprestado um slot de modelo auxiliar chamado auxiliary.web_extract — a opção “Web extract” que vês no hermes model — para gerar um resumo. Por outras palavras, cada página demasiado grande podia despoletar uma chamada extra de LLM, e a entrada do seletor tinha até um nome enganador, “Web extract”: parecia uma funcionalidade de scraping, mas só servia para resumos de snapshots de browser, e o texto original era truncado à mesma.
Depois da mudança, os snapshots usam uma estratégia uniforme de truncar-e-armazenar: tudo o que ultrapassar o orçamento é cortado nos limites de linha, e o snapshot completo fica guardado na cache local — quando o modelo precisar do conteúdo inteiro, percorre-o com read_file. É o mesmo padrão determinístico que o web_extract já usa. Resultados:
- Zero chamadas extra de LLM: a truncagem é processamento de texto determinístico — sem gastar tokens;
- Nada se perde: o snapshot completo fica em disco, paginável a qualquer momento;
- O slot morto desaparece:
auxiliary.web_extracté removido da lista de tarefas auxiliares dohermes model, do dashboard e das definições do desktop.
Se configuraste auxiliary.web_extract anteriormente no config.yaml, deixa-o estar — os valores obsoletos são ignorados em segurança.
O que isto significa na prática
| Cenário | Antes | Depois |
|---|---|---|
| A página excede o orçamento de snapshot | Uma chamada de resumo com LLM auxiliar (tokens gastos) | Truncagem determinística; snapshot completo armazenado e paginável |
| Queres ver mais de uma página longa | Impossível — 15 000 hardcoded | Ajusta browser.snapshot_threshold à vontade |
Tarefas auxiliares do hermes model |
Um slot web_extract enganador | Removido; superfície mais limpa |
Resumo
Uma adição, uma remoção: a adição é a liberdade de configuração (browser.snapshot_threshold, padrão 15 000, mínimo 1 000); a remoção é o custo oculto (os resumos de snapshots deixam de chamar um LLM). O fluxo de trabalho geral da ferramenta de browser não muda, mas a leitura de páginas longas fica mais controlável e a fatura mais limpa. Para a visão completa das ferramentas de browser do Hermes, consulta quando o browser-use se tornou o padrão e a pré-visualização de leitura no desktop; mais truques de poupança de tokens no nosso compilado de quatro truques escondidos. As operações de configuração estão cobertas pela referência de comandos hermes config.