Hermes Agent v0.8.0 — La Versión Intelligence
Resumen
v0.8.0 — The Intelligence Release. Publicado el 8 de abril de 2026. Solo 5 días después de v0.7.0: 209 PRs fusionados · 82 issues resueltos · cientos de archivos modificados · decenas de colaboradores de la comunidad.
Si v0.7.0 fue “la versión de la resiliencia” (proveedores de memoria intercambiables, navegador anti-detección Camofox, endurecimiento profundo del gateway), v0.8.0 trata de una sola cosa — volverse más inteligente. Hermes aprendió a diagnosticar sus propios modos de fallo y a parchearse a sí mismo. Aprendió a notificarte cuando las tareas en segundo plano terminan. Aprendió a rastrear la actividad real de las herramientas en lugar del tiempo de reloj para decidir si hacer timeout. No son viñetas de funcionalidades. Son una mejora sistemática en la inteligencia del agente.
Funcionalidades principales
1. Notificaciones automáticas de tareas en segundo plano (notify_on_complete) — Olvídate del polling
Las tareas en segundo plano ahora notifican automáticamente al agente cuando terminan. Inicia un proceso de larga duración — entrenamiento de modelos, suites de tests, despliegues, builds — y el agente recoge los resultados al finalizar. Sin ps, sin tail -f, sin bucles de polling. El agente simplemente te avisa cuando está listo.
# Iniciar un job de entrenamiento en segundo plano
hermes run "python train.py --epochs 100" --background
# Sigue trabajando en otras cosas con el agente
# Cuando el entrenamiento termine, el agente recibe la notificación y muestra los resultados
(#5779)
2. Xiaomi MiMo v2 Pro gratis en Nous Portal
El plan gratuito de Nous Portal ahora incluye Xiaomi MiMo v2 Pro para tareas auxiliares — compresión, visión, resúmenes. La interfaz de selección de modelos muestra los precios junto a cada modelo, y el control de acceso del plan gratuito es transparente. Si estabas posponiendo usar Hermes porque tu cartera estaba cansada, esta semana el plan gratuito mejoró de verdad.
3. Cambio de modelo en vivo (comando /model) — Cambia de modelo a mitad de sesión
Cambia de modelo y proveedor a mitad de sesión desde CLI, Telegram, Discord, Slack o cualquier plataforma del gateway. El resolutor reconoce el agregador — si estás en OpenRouter o Nous Portal, te mantiene en el agregador cuando el modelo está disponible allí, y solo recurre a proveedores directos cuando es necesario. Telegram y Discord incluyen selectores interactivos con botones inline — toca para seleccionar, no necesitas escribir.
# Cambia en cualquier momento durante una sesión
/model claude-sonnet-4-20250514
# O abre el selector interactivo
/model
4. Guía de uso de herramientas auto-optimizada para GPT/Codex — El agente se parcheó a sí mismo
Este es el PR técnicamente más fascinante de v0.8.0. El equipo construyó un pipeline automatizado de evaluación de comportamiento que probó sistemáticamente los modelos GPT y Codex, identificó cinco modos de fallo específicos en el uso de herramientas, generó cadenas de guía dirigidas para corregirlos, midió la mejora y publicó el resultado como parte del system prompt. El agente se diagnosticó a sí mismo y se parcheó — los humanos participaron como revisores, no como ingenieros de prompts.
Junto con esto vienen guías de disciplina de ejecución en los system prompts y prefill de continuación solo de pensamiento para razonamiento estructurado, todo mejorando drásticamente la fiabilidad al ejecutar Hermes con modelos de OpenAI.
5. Proveedor nativo de Google AI Studio (Gemini)
Acceso directo a los modelos Gemini a través de la API de Google AI Studio. Integrado con el registro de models.dev para detección automática en tiempo real de la longitud de contexto — olvídate de especificar manualmente los límites de tokens.
(#5577)
6. Timeouts inteligentes por inactividad — Los agentes trabajando nunca mueren
Los timeouts del gateway y de cron ahora rastrean la actividad real de las herramientas en lugar del tiempo de reloj. Las tareas de larga duración que están produciendo salida activamente (ejecutando comandos, leyendo/escribiendo archivos) nunca serán terminadas. Solo los agentes verdaderamente inactivos hacen timeout.
7. Botones de aprobación en Slack y Telegram — Di adiós a escribir /approve
Las aprobaciones de comandos peligrosos ahora se realizan mediante botones nativos de la plataforma. Slack conserva el contexto del hilo, Telegram muestra reacciones emoji para el estado de aprobación. Mucho más rápido que escribir /approve cada vez.
8. MCP OAuth 2.1 PKCE + Escaneo de malware OSV
Cliente OAuth 2.1 PKCE totalmente compatible con los estándares para autenticación de servidores MCP. Además, los paquetes de extensión MCP se escanean automáticamente contra la base de datos de vulnerabilidades OSV al instalarse — detectando código malicioso antes de que se ejecute.
9. Registros centralizados y validación de configuración
Registro estructurado en ~/.hermes/logs/ (agent.log + errors.log), con el nuevo comando hermes logs para seguimiento y filtrado. La validación de la estructura de configuración detecta YAML mal formado al iniciar con mensajes de error accionables — se acabaron los “bloqueos misteriosos”.
# Ver registros recientes
hermes logs
# Solo errores
hermes logs --level WARNING
10. Expansión del sistema de plugins
Los plugins ahora pueden:
- Registrar subcomandos CLI independientes sin tocar el código central
- Recibir hooks de API con ámbito de solicitud con IDs de correlación
- Solicitar variables de entorno requeridas durante la instalación
- Engancharse a eventos del ciclo de vida de la sesión (finalizar / reiniciar)
11. Matrix promovido a Tier 1
Matrix obtiene reacciones, confirmaciones de lectura, formato enriquecido y gestión de salas — alcanzando paridad de funcionalidades con Telegram y Discord como plataforma de primera clase.
12. Refuerzo de seguridad
Protecciones SSRF, mitigaciones de ataques de timing, prevención de path traversal en tar, protección contra fugas de credenciales, aislamiento entre sesiones — una auditoría de seguridad sistemática en todo el código base.
Agente central y arquitectura
Soporte de proveedores y modelos
- Proveedor nativo de Google AI Studio (Gemini) con detección automática de longitud de contexto vía models.dev
- Comando
/model— revisión completa del sistema de proveedor+modelo con cambio en vivo en CLI y todos los gateways - Selector interactivo de modelos para Telegram y Discord con botones inline
- Control de acceso del plan gratuito de Nous Portal con visualización de precios en la selección de modelos
- Caché de prompts de xAI (Grok) mediante el header
x-grok-conv-id - Proveedor TTS MiniMax (speech-2.8)
- Advertencia de modelo no agentivo — alerta al cargar LLMs de Hermes no diseñados para uso de herramientas
- Autenticación Ollama Cloud, persistencia de cambio de modelo, autocompletado de alias con tab
- Visualización de precios de modelos para OpenRouter y Nous Portal
- Fallback de pago en cliente auxiliar — reintenta con el siguiente proveedor ante error 402
- El cliente auxiliar resuelve proveedores personalizados por nombre y el alias ‘main’
- Ventanas de reinicio de credenciales de proveedor respetadas en failover agrupado
- Sincronización de tokens OAuth entre el pool de credenciales y el archivo de credenciales
- Credenciales OAuth expiradas ya no bloquean la detección automática de OpenRouter
- Pool de credenciales OAuth de Codex — correcciones de desconexión e importación de tokens expirados
- Detección automática de visión prueba primero el proveedor principal
- Longitudes de contexto de MiniMax, guardia de pensamiento, modelo auxiliar, correcciones de base_url en configuración
- Detección automática de endpoint Z.AI mediante sondeo y caché
- Correcciones de resolución de proveedor/modelo de la comunidad — rescatados 4 PRs comunitarios
Bucle del agente y conversación
- Guía de uso de herramientas auto-optimizada para GPT/Codex — evaluación comparativa automatizada identificó y parcheó 5 modos de fallo
- Guías de disciplina de ejecución para GPT/Codex en los system prompts
- Prefill de continuación solo de pensamiento para razonamiento estructurado
- Aceptar respuestas de solo razonamiento sin reintentos — establece el contenido a “(empty)” en lugar de reintentar infinitamente
- Backoff con jitter — retroceso exponencial con jitter para reintentos de API
- Gestión inteligente de firmas de bloques de pensamiento — preserva las firmas de pensamiento de Anthropic entre turnos
- Forzar argumentos de tool calls para que coincidan con los tipos de JSON Schema — corrige modelos que envían strings en lugar de números/booleanos
- Guardar resultados de herramientas sobredimensionados en archivo en lugar de truncamiento destructivo
- Fallback de streaming mejorado tras fallos de edición
- Huecos de salida vacía de Codex cubiertos en fallback + normalizador + cliente auxiliar
- Relleno de salida de stream de Codex desde eventos output_item.done
- El consumidor de stream crea nuevo mensaje tras los límites de herramientas
- Filtrar roles solo de transcripción del payload de chat-completions
- Sanear tool_calls para todas las APIs estrictas (Fireworks, Mistral, etc.)
- Puente tool-calls en el adaptador copilot-acp
Memoria y sesiones
- Proveedor de memoria Supermemory — multi-contenedor, search_mode, plantilla de identidad, sobrescritura de variables de entorno
- Sesiones de hilo compartido por defecto — soporte de hilos multiusuario en plataformas del gateway
- Sesiones de subagente vinculadas al padre y ocultas de la lista de sesiones
- Aislamiento de memoria con ámbito de perfil y soporte de clonación
- Pasar user_id del gateway de hilo a los plugins de memoria para ámbito por usuario
- Revisión del plugin Honcho + sistema de registro CLI de plugins
- Compatibilidad con mem0 API v2, protección de contexto de prefetch, redacción de secretos
- RetainDB — rutas API, cola de escritura, dialéctica, correcciones de modelo de agente
- Revisión del plugin de memoria Hindsight + correcciones del asistente de configuración de memoria
- Red de seguridad atexit de OpenViking para commit de sesión, headers de ámbito de tenant
- Consulta brv de ByteRover se ejecuta sincrónicamente antes de la llamada al LLM
- Mensaje de usuario limpio usado para todas las operaciones del proveedor de memoria
Plataformas de mensajería (Gateway)
Núcleo del Gateway
- Timeout basado en inactividad reemplaza al de tiempo de reloj — las tareas activas nunca se matan
- Botones de aprobación para Slack y Telegram + preservación del contexto de hilo en Slack
- Transmisión en vivo de /update + reenvío de prompts interactivos al usuario
- Soporte de timeout infinito + notificaciones periódicas + mensajes de error accionables
- Prevención de mensajes duplicados — deduplicación del gateway + guardia de stream parcial
- Persistencia de delivery_info de webhook + session id completo en /status
- Truncamiento de vista previa de herramientas respeta tool_preview_length en modos de progreso all/new
- Clave de sesión de aprobación aislada por turno
- Omisión de guardia de sesión activa para /approve, /deny, /stop, /new
- Indicador de escritura pausado durante esperas de aprobación
- Verificación de caption usa coincidencia exacta línea por línea en lugar de subcadena (todas las plataformas)
- Etiquetas MEDIA: eliminadas de mensajes de gateway en streaming, extraídas de entregas de cron
- Unidades de servicio conscientes del perfil + limpieza de transcripción de voz
- PairingStore thread-safe con escrituras atómicas
- Wrappers de métodos estáticos de cron para prevenir self-binding
Mejoras por plataforma
| Plataforma | Cambios clave |
|---|---|
| Telegram | Vinculación de skills a temas de grupo, aprobaciones con reacción emoji, prevención de mensajes duplicados, saneamiento de nombres de comandos, skills deshabilitadas por plataforma |
| Discord | Controles de canal (ignored_channels / no_thread_channels), skills como slash commands nativos, /approve registrado como slash commands, eliminado el intent de members innecesario |
| Slack | Auto-enganche en hilos, mrkdwn en edit_message, respuestas en hilo sin @menciones |
| Matrix | Actualización a Tier 1: reacciones, confirmaciones de lectura, formato enriquecido, gestión de salas, entrada CJK, E2EE, reconexión |
| Signal | Entrega completa de etiquetas MEDIA: |
| Mattermost | Soporte de archivos adjuntos |
| Feishu | Botones interactivos de aprobación en tarjeta, correcciones de reconexión + ACL |
| Webhooks | Token de plantilla {__raw__}, paso de thread_id para temas de foro |
CLI y experiencia de usuario
CLI interactiva
- Diferir el contenido de respuesta hasta que el bloque de razonamiento termine
- Líneas fantasma de la barra de estado limpiadas al redimensionar el terminal
- Normalizar finales de línea \r\n y \r en texto pegado
- Soporte nativo de pegado de imágenes en Windows
--yoloy otras flags ya no se descartan silenciosamente cuando se colocan antes del subcomando ‘chat’- Errores de ChatConsole, scroll de curses, banner consciente del skin, correcciones de estado de git
Configuración
- Validación de estructura de configuración — detecta YAML mal formado al iniciar con mensajes accionables
- Registro centralizado en
~/.hermes/logs/(agent.log + errors.log) con el comandohermes logs - Diagnósticos del doctor — verificación de proveedores sincronizados, migración de configuración, diagnósticos de WAL y mem0
- Registro de depuración de timeouts y diagnósticos orientados al usuario mejorados
- Esfuerzo de razonamiento unificado solo en config.yaml
- Lista blanca de comandos permanentes cargada al iniciar
hermes auth removeahora limpia permanentemente las credenciales sembradas por variables de entorno- Skills empaquetadas sincronizadas a todos los perfiles durante la actualización
hermes updateya no mata el servicio de gateway recién reiniciado- Timeouts de subprocess.run() añadidos a todos los comandos CLI del gateway
- Enlaces a documentación añadidos a las secciones del asistente de configuración
Sistema Cron
- Timeout de cron basado en inactividad — las tareas activas se ejecutan indefinidamente
- Inyección de script pre-ejecución para recolección de datos y detección de cambios
- Seguimiento de fallos de entrega en el estado del job
- Guía de entrega en los prompts de cron — detiene el uso excesivo de send_message
- Archivos MEDIA entregados como adjuntos nativos de la plataforma
- Supresión [SILENT] funciona en cualquier parte de la respuesta
- Endurecimiento de path traversal de cron
Sistema de herramientas
Terminal y ejecución
- Execute_code en backends remotos — Docker, SSH, Modal y otros backends de terminal remotos
- Contexto de código de salida para herramientas CLI comunes — ayuda al agente a entender qué salió mal
- Descubrimiento progresivo de subdirectorios — el agente aprende la estructura del proyecto mientras navega
- notify_on_complete para procesos en segundo plano
- Configuración de Docker env — variables de entorno explícitas del contenedor mediante docker_env
- Metadatos de aprobación incluidos en los resultados de herramientas de terminal
- Parámetro workdir saneado en todos los backends
Navegador
- Cambio de proveedor de navegador gestionado de Browserbase a Browser Use
- Proveedor de navegador en la nube Firecrawl
- Evaluación JS mediante el parámetro expression de browser_console
- Correcciones del navegador en Windows
MCP
- MCP OAuth 2.1 PKCE — cliente OAuth totalmente compatible con los estándares
- Verificación de malware OSV para paquetes de extensión MCP
- Preferir structuredContent sobre text + centinela no_mcp
- Advertencia de toolsets desconocidos suprimida para nombres de servidor MCP
Web y archivos
- Soporte de documentos .zip + montaje automático de directorios caché en backends remotos
- Redactar secretos de consulta en errores de send_message
Delegación
- Compartición del pool de credenciales + sugerencias de ruta de espacio de trabajo para subagentes
ACP (VS Code / Zed / JetBrains)
- Mejoras agregadas de ACP — compatibilidad de autenticación, correcciones de protocolo, command ads, delegación, eventos SSE
Ecosistema de Skills
Sistema de Skills
- Interfaz de configuración de skills — las skills pueden declarar ajustes requeridos de config.yaml, solicitados durante la configuración, inyectados al cargar
- Sistema de registro CLI de plugins — los plugins registran sus propios subcomandos CLI sin tocar main.py
- Hooks de API con ámbito de solicitud con IDs de correlación de tool calls para plugins
- Hooks de ciclo de vida de sesión — on_session_finalize y on_session_reset para CLI + gateway
- Solicitar variables de entorno requeridas durante la instalación del plugin
- Validación de nombre de plugin — rechaza nombres que resuelven a la raíz de plugins
- Contexto de plugin pre_llm_call movido al mensaje de usuario para preservar la caché de prompts
Skills nuevas y actualizadas
- popular-web-designs — 54 sistemas de diseño web de producción
- p5js creative coding
- manim-video — animaciones matemáticas y técnicas
- llm-wiki — LLM Wiki de Karpathy
- gitnexus-explorer — indexación de codebase y servicio de conocimiento
- research-paper-writing — patrones AI-Scientist y GPT-Researcher
- blogwatcher actualizado al fork de JulienTant
- Skill de Claude Code reescritura completa v2.0 + v2.2
- Documentación de referencia de Manim CE ampliada — geometría, animaciones, LaTeX
- Skills de verificación de código consolidadas en una sola
Seguridad y fiabilidad
Refuerzo de seguridad
- Seguridad consolidada — protecciones SSRF, mitigaciones de ataques de timing, prevención de path traversal en tar, protección contra fugas de credenciales
- Aislamiento entre sesiones + endurecimiento de path traversal de cron
- Parámetro workdir saneado en la herramienta de terminal en todos los backends
- Escalada de sesión de aprobación ‘once’ prevenida + validación de plataforma de entrega de cron
- Tokens OAuth de Google Workspace con ámbito de perfil protegidos
Fiabilidad
- Limpieza agresiva de worktree y ramas para prevenir acumulación
- Backtracking catastrófico O(n²) en regex de redacción corregido — mejora de 100x en salidas grandes
- Correcciones de estabilidad en tiempo de ejecución en herramientas core, web, delegate y browser
- Corrección de streaming del servidor API + soporte de historial de conversación
- Rutas de endpoint de API de OpenViking y análisis de respuesta corregidos
Correcciones de bugs notables
- 9 correcciones comunitarias rescatadas — gateway, cron, dependencias, launchd de macOS en un solo lote
- Lote de correcciones del núcleo — configuración de modelos, reinicio de sesión, fallback de alias, launchctl, delegación, escrituras atómicas
- Lote de correcciones de gateway/plataforma — E2EE de Matrix, entrada CJK, navegador Windows, reconexión de Feishu + ACL
- Eliminación de tests obsoletos saltados, backtracking de regex, bug de búsqueda de archivos y fragilidad de tests
- Nix flake — leer versión, regenerar uv.lock, añadir hermes_logging
- Tests de regresión de redacción de variables en minúscula
Testing
- 57 tests de CI fallidos reparados en 14 archivos
- Re-arquitectura del conjunto de tests + correcciones de fallos de CI
- Limpieza de lint en todo el código base — imports no usados, código muerto y patrones ineficientes
- Herramienta browser_close eliminada — la limpieza automática se encarga de ello
Documentación
- Auditoría completa de documentación — corregir información obsoleta, ampliar páginas escasas, añadir profundidad
- Más de 40 discrepancias corregidas entre documentación y código base
- 13 funcionalidades documentadas de los PRs de la semana pasada
- Revisión de la sección de guías — corregir existentes + añadir 3 nuevos tutoriales
- Rescatados 4 PRs de documentación — configuración de docker, validación post-actualización, guía de LLM local, instalación de signal-cli
- Referencia de configuración de Discord
- Entradas de FAQ de la comunidad para flujos de trabajo comunes y solución de problemas
- Guía de redes WSL2 para servidores de modelos locales
- Referencia CLI de Honcho + documentación de registro CLI de plugins
- Configuración de Obsidian Headless para servidores en llm-wiki
- Editor visual de skins Hermes Mod añadido a la página de skins
Actualizar
hermes update
Para nuevas instalaciones, visita la guía de instalación.
← Hermes Agent Changelog