Hermes v0.21.0: Bot Mode integrado, agentes que se mensajean entre sí y trabajos cron que recuerdan

Tienes un agente de investigación y un agente de programación, y nunca se hablan: cuando uno encuentra la respuesta, copias el texto de una ventana de chat, lo pegas en la otra y esperas que el formato sobreviva. v0.21.0 (tag v2026.8.31, publicado el 31 de agosto de 2026) ataca exactamente ese muro: «The Pantheon Release» convierte Bot Mode en una parte integrada de la aplicación de escritorio, donde tus agentes tienen nombres, caras y chats de grupo; añade el comando hermes peer para que cualquier agente pueda enviarse mensajes directos con cualquier otro a través de perfiles y máquinas; y dota a los trabajos cron de memoria para que tu informe de las 9 de la mañana sepa realmente lo que te contó ayer.
El alcance es grande incluso para los estándares de este proyecto: aproximadamente 5.800 commits, ~2.475 PRs fusionados y ~5.680 archivos modificados desde v0.20.0, con más de 760 colaboradores y unas 2.100 issues cerradas. También incluye las ventanas de parches v0.20.1–v0.20.6, que ya cubrimos cuando se publicaron (v0.20.6 steady roll, v0.20.5 housekeeping). Esto es lo que importa de la nueva versión.
Una sociedad de agentes, integrada en el escritorio
Bot Mode deja de ser un plugin y se convierte en la forma activada por defecto del escritorio para ejecutar varios agentes. Cada perfil recibe un nombre, una cara de avatar determinista (con controles de aleatorizar/bloquear) y un lugar en un directorio compartido. Puedes crear chats de grupo estilo Discord donde varios bots y tú habláis en una misma sala, mencionar con @ a cualquier bot desde el compositor y poner nombre e imagen a las salas. La historia multiagente solía ser pura fontanería — conectar APIs a mano; ahora parece una app de chat llena de compañeros de trabajo. Si has seguido las guías de Bot Mode desde la era del plugin, la versión integrada es la misma idea, empaquetada y activada por defecto.
hermes peer: los agentes se envían mensajes directos
El comando CLI estrella de esta versión es hermes peer — mensajes directos entre bots a través de perfiles y gateways, desde la terminal o desde dentro de una conversación. Registra otro gateway de Hermes como peer y luego envía mensajes a sus agentes por su handle:
hermes peer add spark --url http://spark.lan:8377 --key <API_SERVER_KEY>
hermes peer dm spark "disk status on the homelab?"
hermes peer run spark "analyze this long log" --idempotency-key ticket-123
hermes peer status spark run_abc123
Las respuestas llegan al Bot Chat canónico de cada agente, así que las conversaciones entre agentes son duraderas e inspeccionables en lugar de lanzar y olvidar. Las tareas largas pueden ejecutarse de forma asíncrona (hermes peer run) con una idempotency key, y los códigos de salida siguen siendo amigables para scripts (0 ok, 1 error de entrega/peer, 2 error de uso). Escribimos un tutorial completo en la guía de hermes peer.
Trabajos cron con memoria
Los trabajos programados dejaron de tener memoria de pez. Los agentes cron ahora cargan y actualizan memoria persistente como cualquier otro agente (MEMORY.md está en el system prompt), y un nuevo flag continuity=true traslada la salida de cada ejecución a la siguiente — así un monitor puede deduplicar contra lo que ya informó en lugar de volver a avisarte. Cada trabajo tiene una libreta duradera (hermes cron notepad <job_id> get|set|delete|list), los trabajos en modo monitor pueden saltarse el LLM por completo cuando nada ha cambiado, y la salida de cron puede aterrizar en el Bot Chat canónico de un bot, donde el bot realmente responde. Tu informe de las 9 de la mañana ya sabe lo que te dijo ayer. Más en nuestra guía de memoria cron.
Dirige a los subagentes mientras se ejecutan
delegate_task creció con orquestación en vivo: lista los hijos en ejecución, dirige a uno en pleno vuelo con una corrección de rumbo, o detenlo antes de tiempo y conserva el resultado parcial. Las salidas de los hijos pueden validarse contra un JSON schema opcional, el coste por delegación aparece en los resultados y los valores por defecto subieron a 250 iteraciones / 10 hijos concurrentes. La delegación pasó de lanzar y rezar a trabajo paralelo realmente gestionado — consulta nuestra guía de orquestación en vivo para ver la superficie de la herramienta.
El centro de mando MCP
Los servidores MCP y el catálogo se fusionaron en una única página coherente del escritorio: importación por arrastre «pega lo que sea», health checks en segundo plano que te animan a re-autenticarte antes de que falle una llamada a una herramienta, una superposición de coste/uso de la flota (estimaciones de tokens por schema + uso de 30 días por servidor) y deep links hermes:// que instalan un servidor MCP con confirmación explícita. Gestionar veinte servidores solía ser arqueología de archivos de configuración; ahora es un panel de control. Lectura relacionada: el catálogo MCP remoto oficial.
Una ola de potencia en la CLI
Ctrl+P abre una paleta de comandos difusa, el selector /model filtra mientras escribes, /status muestra el modo de razonamiento, las aprobaciones pendientes y el uso de contexto, y la barra de estado puede mostrar en vivo % de cache-hit, latencia y tokens/seg con alternadores por campo (lo cubrimos en el post de métricas de la barra de estado). El pin/unpin de sesiones desde la CLI mantiene los hilos importantes, los placeholders rotatorios orientados a tareas del compositor mantienen útil la caja de entrada y — porque un compañero merece un compañero — hay mascotas en la terminal (mascotas animadas estilo Ghostty, gestionadas con hermes pets). La guía de la paleta de comandos tiene el recorrido completo.
El agente maneja el navegador del escritorio
El navegador integrado dejó de ser una ventana que el agente solo podía mirar: Hermes ahora navega, hace clic y lee directamente, y las páginas pueden sacarse a tu navegador del sistema con menús contextuales de enlace completos. Pídele que recorra un sitio de documentación o depure una app web y míralo suceder dentro de tu propia aplicación. Esto complementa el trabajo de navegación con perfil real de v0.20.6 — el mismo navegador, ahora con manos.
Seis nuevos providers y una ola de modelos
El plantel de providers da un salto: Meta Model API (Muse Spark) llega como provider integrado, acompañado de CommandCode, Tencent TokenPlan, Nebius Token Factory, Ramp Router y Actual Computer. Los catálogos incorporaron GLM-5.3-Flash, qwen3.8-max/flash, Gemini 3.7 Flash, MiniMax M3 free y Nemotron 3.5 Lightning — y model_overrides sigue permitiéndote ajustar tú mismo la ventana de contexto o los precios de cualquier modelo (consulta nuestra guía de model overrides). Cubrimos el trío Ramp/Nebius/Tencent en la guía de nuevos providers.
Refuerzo de seguridad en todos los frentes
- Archivos de instrucciones protegidos: las escrituras en AGENTS.md, skills y almacenes de memoria ahora siempre requieren aprobación (
security.protected_instruction_files: truepor defecto), así un agente con prompt injection no puede reescribir en silencio sus propias órdenes permanentes. - Barrido de redacción: cerradas las fugas de secretos en errores de terminal, lecturas de
.env, checkpoints y logs de ACP. - Aprobaciones en Windows: los comandos y rutas destructivos de Windows ahora activan el sistema de aprobaciones, cerrando la brecha de plataforma.
- Identidad TCC en macOS: los permisos concedidos sobreviven a cada actualización mediante
hermes desktop --setup-tcc-identity.
Revertido (no se publica)
Tres cosas aterrizaron y fueron retiradas durante la ventana: el modo Model Council (/council), el motor de contexto DCP y el servidor gateway solo-WS. Ninguna está en esta versión — si las viste debatidas, por eso no aparecen.
Upgrade
hermes update
Tras actualizar, hermes doctor verifica la instalación y puede que quieras reiniciar el gateway (hermes gateway) para que los cambios de las plataformas de mensajería surtan efecto. La página de la versión v0.21.0 está en /releases/v0-21-0/ con el changelog completo categorizado.