Hermes Agent v0.9.0 — La Versión Omnipresente
Resumen
v0.9.0 — La Versión Omnipresente. Publicada el 13 de abril de 2026. Desde v0.8.0: 487 commits · 269 PRs fusionados · 167 incidencias resueltas · 493 archivos modificados · 63.281 inserciones · 24 colaboradores.
Esta versión gira en torno a una sola idea: estar en todas partes. Hermes salió de la terminal y de un puñado de plataformas de chat, adentrándose en el ecosistema Apple (iMessage), el ecosistema chino (WeChat) e incluso el móvil (Android/Termux). Un nuevo Panel Web local te permite gestionarlo todo sin tocar archivos de configuración. El Modo Rápido elimina los tiempos de espera en flujos sensibles a la latencia. El monitoreo de procesos en segundo plano te libera del infierno del sondeo constante. Y 11 correcciones de refuerzo de seguridad garantizan que todo funcione rápido y seguro.
Funcionalidades Principales
1. Panel Web Local — Gestiona Todo desde el Navegador
Hermes ahora incluye un panel de gestión basado en navegador para uso local. Configura ajustes, monitorea sesiones, explora habilidades y gestiona tu gateway — todo desde una interfaz web limpia, sin archivos de configuración, sin necesidad de terminal. La forma más sencilla de comenzar con Hermes.
El panel está construido sobre FastAPI + Uvicorn, ejecutándose en 127.0.0.1:9119 por defecto, con estado del gateway en tiempo real, historial de sesiones y analíticas de uso.
2. Modo Rápido (/fast) — Canal de Inferencia Prioritaria
Escribe /fast en el chat para enrutar tu sesión actual a través de colas de procesamiento prioritario para los modelos de OpenAI y Anthropic, reduciendo drásticamente la latencia de inferencia. Los modelos compatibles incluyen GPT-5.4, Codex, Claude y más.
# Activar el modo rápido
/fast
# Todas las llamadas posteriores al LLM pasan por colas prioritarias con mucha menor latencia
# Escribe /fast de nuevo para desactivarlo
Respaldado por el Procesamiento Prioritario de OpenAI y el nivel rápido de Anthropic, extendido a todos los modelos elegibles. (#6875, #6960, #7037)
3. iMessage vía BlueBubbles — Hermes Entra en el Ecosistema Apple
Integración completa con iMessage a través de BlueBubbles. Registro automático de webhooks, integración con el asistente de configuración y resistencia a fallos — Hermes ahora puede enviar y recibir iMessages desde tu Mac.
# Selecciona BlueBubbles en el asistente de configuración y sigue la guía de vinculación
hermes setup
4. WeChat (Weixin) y Modo Callback de WeCom — Ecosistema de Mensajería Chino Completo
WeChat (Weixin): Soporte nativo para WeChat mediante la API de iLink Bot, con cursor de streaming, carga de archivos multimedia y manejo de enlaces Markdown.
Modo Callback de WeCom: Un adaptador en modo callback para aplicaciones empresariales autoalojadas con persistencia atómica de estado.
Hermes ahora cubre el ecosistema de mensajería chino de extremo a extremo — desde WeChat personal hasta WeCom empresarial. (#7166, #7943)
5. Soporte para Termux / Android — Hermes se Vuelve Móvil
Ejecuta Hermes de forma nativa en Android mediante Termux. Rutas de instalación adaptadas, TUI optimizada para pantallas móviles, soporte para backend de voz y el comando /image funciona en el dispositivo.
# Instalar en Termux usando el paquete especializado para Termux
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash -s -- --bundle termux
(#6834)
6. Monitoreo de Procesos en Segundo Plano (watch_patterns) — Recibe Notificaciones, No Hagas Sondeos
Define patrones regex para vigilar en la salida de procesos en segundo plano y recibe notificaciones en tiempo real cuando coincidan. Monitorea errores, espera eventos específicos (“listening on port 3000”) o vigila registros de compilación — se acabó el sondeo manual.
# hermes.config.yaml
watch_patterns:
- pattern: "Error:.*"
notify: true
- pattern: "listening on port \\d+"
notify: true
label: "Servicio listo"
(#7635)
7. xAI (Grok) y Xiaomi MiMo — Soporte Nativo de Proveedores
Dos grandes proveedores de modelos obtienen soporte de primera clase:
- xAI (Grok): Acceso directo a la API, catálogo de modelos, integración con el asistente de configuración
- Xiaomi MiMo: Asistente de configuración, catálogo de modelos, recuperación automática ante respuestas vacías
Además, OAuth de Qwen con soporte para solicitudes vía portal. (#7372, #7855)
8. Motor de Contexto Conectable — Personaliza lo que el Agente Ve
La gestión de contexto ahora es un módulo conectable mediante hermes plugins. Intercambia motores de contexto personalizados que controlan exactamente lo que el agente ve en cada turno — filtrado, resumen o inyección de contexto específico del dominio.
# Instalar un motor de contexto personalizado como plugin
hermes plugins install my-context-engine
(#7464)
9. Soporte Unificado de Proxy — Funciona Detrás de Firewalls
Proxy SOCKS, DISCORD_PROXY y detección automática del proxy del sistema en todas las plataformas del gateway. Hermes funciona detrás de firewalls corporativos — macOS detecta automáticamente la configuración de proxy del sistema, Windows/Linux solo requieren configuración manual. (#6814)
10. Refuerzo Integral de Seguridad — 11 Correcciones Críticas
La revisión de seguridad más profunda en la historia de Hermes:
| Vulnerabilidad | Corrección | PR |
|---|---|---|
| RCE por SMS | Validación de firma de webhook de Twilio | #7933 |
| Inyección de Shell | Escapado de rutas de escritura en sandbox | #7940 |
| Inyección de Argumentos Git | Protección contra path traversal e inyección de argumentos | #7944 |
| SSRF | Protección contra redirección en carga de imágenes de Slack | #7151 |
| Path Traversal | Refuerzo de límites en gestor de checkpoints y gestor de habilidades | #7156 |
| Protección de Bind de API | Exigir API_SERVER_KEY para bindings no loopback |
#7455 |
| Autenticación de Botón de Aprobación | Requerir autenticación para continuar sesión | #6930 |
11. hermes backup y hermes import — Respaldo y Restauración en un Solo Paso
Respaldo y restauración completa de tu configuración de Hermes, sesiones, habilidades y memoria. Migra entre máquinas o haz una instantánea antes de cambios importantes — un solo comando lo hace todo.
# Respaldar todo
hermes backup
# Restaurar en una máquina nueva
hermes import ./backup-2026-04-13.tar.gz
(#7997)
12. 16 Plataformas Soportadas — Verdaderamente Omnipresente
A partir de esta versión, Hermes soporta 16 plataformas de mensajería:
Telegram, Discord, Slack, WhatsApp, Signal, Matrix, iMessage (nuevo), WeChat (nuevo), WeCom, Email, SMS, DingTalk, Feishu, Mattermost, Home Assistant, Webhooks
13. Kit de Depuración — /debug y hermes debug share
Nuevos comandos de depuración: el comando slash /debug disponible en todas las plataformas para diagnósticos rápidos, además de hermes debug share para subir un informe completo de depuración a un pastebin y compartirlo fácilmente al resolver problemas. (#8681)
# Diagnóstico rápido en CLI
/debug
# Exportar y compartir un informe de depuración
hermes debug share
Agente Principal y Arquitectura
Soporte de Proveedores y Modelos
- Proveedor nativo xAI (Grok) con acceso directo a la API y catálogo de modelos
- Xiaomi MiMo como proveedor de primera clase — asistente de configuración, catálogo de modelos, recuperación ante respuestas vacías
- Proveedor OAuth de Qwen con soporte para solicitudes vía portal
- Modo Rápido — interruptor
/fastpara Procesamiento Prioritario de OpenAI + nivel rápido de Anthropic - Clasificación estructurada de errores de API para decisiones inteligentes de conmutación por error
- Captura de cabeceras de límite de tasa mostrada en
/usage - Nombre del modelo del servidor API derivado del nombre del perfil
- Proveedores personalizados ahora incluidos en listados y resolución de
/model - Activación de proveedor de respaldo ante respuestas vacías repetidas con estado visible para el usuario
- Etiquetas de variante de OpenRouter (
:free,:extended,:fast) preservadas durante el cambio de modelo - TTL de agotamiento de credenciales reducido de 24 horas a 1 hora
- Refuerzo del ciclo de vida de credenciales OAuth — claves de pool obsoletas, sincronización de auth.json, corrección de condiciones de carrera en Codex CLI
- Recuperación ante respuestas vacías para modelos de razonamiento (MiMo, Qwen, GLM)
- Longitudes de contexto de MiniMax, protección de pensamiento, correcciones de endpoint
- Detección automática de endpoint de Z.AI mediante sonda y caché
Bucle del Agente y Conversación
- Ranura de motor de contexto conectable mediante
hermes plugins - Monitoreo de procesos en segundo plano —
watch_patternspara alertas de salida en tiempo real - Compresión de contexto mejorada — límites más altos, seguimiento de herramientas, advertencias de degradación, protección del final del presupuesto de tokens
/compress <enfoque>— compresión guiada con un tema central- Advertencias de presión de contexto por niveles con deduplicación en el gateway
- Advertencia de inactividad escalonada antes de la escalada de tiempo de espera
- Evitar que el agente se detenga a mitad de tarea — suelo de compresión, revisión de presupuesto, seguimiento de actividad
- Propagar actividad hija al padre durante
delegate_task - Detección de llamadas de herramienta truncadas en streaming antes de la ejecución
- Reintento de respuesta vacía (3 intentos con empujón)
- Retroceso adaptativo de streaming + limpieza de cursor para evitar truncamiento de mensajes
- La compresión usa el modelo de sesión activa en lugar de la configuración persistida obsoleta
- Eliminar etiquetas
<thought>de las respuestas de Gemma 4 - Evitar que
<think>en prosa suprima la salida de respuesta - Registro de diagnóstico de salida de turno en el bucle del agente
- Señal de interrupción de herramienta con alcance por hilo para evitar fugas entre sesiones
Memoria y Sesiones
- Plugin de memoria retrospectiva (hindsight) — paridad de funcionalidades, asistente de configuración, mejoras de configuración (@nicoloboschi)
- Honcho —
initOnSessionStartopcional para modo herramientas (@Kathie-yu) - Hijos huérfanos en lugar de eliminación en cascada en prune/delete
- El comando doctor solo verifica el proveedor de memoria activo
Plataformas de Mensajería (Gateway)
Nuevas Plataformas
- BlueBubbles (iMessage) — adaptador completo con registro automático de webhooks, asistente de configuración y resistencia a fallos
- WeChat (Weixin) — soporte nativo mediante API de iLink Bot con streaming, carga de archivos multimedia y enlaces markdown
- Modo Callback de WeCom — adaptador para aplicaciones empresariales autoalojadas con persistencia atómica de estado
Mejoras de Plataformas
Discord:
- Configuración de lista blanca de canales permitidos
- Herencia de tema del canal del foro en sesiones de hilo
- Configuración
DISCORD_REPLY_TO_MODE - Aceptar adjuntos
.log, aumento del límite de tamaño de documentos - Desacoplar la sincronización de comandos slash de la disponibilidad
Slack:
- Mejoras consolidadas de Slack — 7 PRs de la comunidad unificados en uno
- Manejar eventos del ciclo de vida del hilo del asistente
Matrix:
- Migración de matrix-nio a mautrix-python
- Almacén criptográfico SQLite reemplazando pickle (corrige el descifrado E2EE)
- Verificación de clave de recuperación de firma cruzada para migración E2EE
- Hilos de mención en MD + eventos de chat grupal para Feishu
Núcleo del Gateway
- Soporte unificado de proxy — SOCKS, DISCORD_PROXY, multiplataforma con detección automática en macOS
- Agrupación de texto entrante para Discord, Matrix, WeCom + retardo adaptativo
- Mostrar mensajes naturales del asistente a mitad de turno en plataformas de chat
- Gateway compatible con WSL con detección inteligente de systemd
- Todas las plataformas faltantes añadidas al asistente de configuración
- Anulaciones de
tool_progresspor plataforma - Intervalo configurable de notificación “still working”
- El cambio de
/modelpersiste entre mensajes /usagemuestra límites de tasa, coste y detalles de tokens entre turnos- Drenar trabajo en curso antes de reiniciar
- No desalojar agente en caché tras ejecuciones fallidas — previene el bucle de reinicio de MCP
- Reemplazar estado de sesión
os.environporcontextvars - Derivar plataformas de directorio de canales desde enum en lugar de lista fija
- Validar descargas de imágenes antes de almacenar en caché (multiplataforma)
- Entrega de webhooks entre plataformas para todas las plataformas
- Soporte de entrega de cron a thread_id de Discord
- Incorporación de bot Feishu mediante QR
- Estado del gateway limitado al perfil activo
- Evitar que notificaciones de procesos en segundo plano activen solicitudes de vinculación falsas
CLI y Experiencia de Usuario
CLI Interactiva
- Soporte para Termux / Android — rutas de instalación adaptadas, TUI, voz,
/image - Selector modal nativo de
/modelpara selección de proveedor → modelo - Temporizador en vivo por herramienta restaurado en el spinner de TUI
- Retroceso de progreso de herramientas apiladas en TUI
- Consejos aleatorios al iniciar nueva sesión (CLI + gateway, 279 consejos)
hermes dump— resumen de configuración listo para copiar y pegar para depuraciónhermes backup/hermes import— respaldo y restauración completa de configuración- Indicador de entorno WSL en el prompt del sistema
- UX de creación de perfil — SOUL.md inicial + advertencia de credenciales
- Detección de sudo consciente del shell, soporte para contraseña vacía
- Vaciar stdin después de menús de curses/terminal para evitar fugas de secuencias de escape
- Manejar stdin roto en el arranque de prompt_toolkit
Configuración
- Configuración de nivel de detalle de visualización por plataforma
- Registro de logs separado por componentes con contexto de sesión y filtrado
- Configuración
network.force_ipv4para solucionar problemas de timeout IPv6 - Estandarización de espacios en blanco y formato JSON en mensajes
- Cambio de marca OpenClaw → Hermes durante la migración
- config.yaml tiene prioridad sobre variables de entorno para ajustes auxiliares
- Refuerzo de flujos de configuración de proveedores + actualización en vivo del catálogo de OpenRouter
- Normalización del orden de esfuerzo de razonamiento en todas las interfaces
- Eliminación de variable de entorno obsoleta
LLM_MODEL+ migración para limpiar entradas antiguas - Eliminación del comando slash
/prompt— peligro de expansión de prefijos - Variable de entorno
HERMES_HOME_MODEpara anular permisos - Recurrir al modelo predeterminado cuando la configuración del modelo está vacía
- Advertir cuando el contexto del modelo de compresión es demasiado pequeño
Sistema de Herramientas
Entornos y Ejecución
- Capa de ejecución unificada por llamada para entornos
- Sincronización de archivos unificada con seguimiento de mtime, eliminación y estado transaccional
- Entornos sandbox persistentes sobreviven entre turnos
- Sincronización masiva de archivos mediante tubería tar para backends SSH/Modal
- Daytona — carga masiva, puente de configuración, límite silencioso de disco
- Límite de timeout en primer plano para evitar bloqueos de sesión
- Protección contra valores de comando inválidos
MCP
- Soporte para
hermes mcp add --envy--preset - Combinar
contentystructuredContentcuando ambos están presentes - Correcciones de desambiguación de nombres de herramientas MCP
Navegador
- Refuerzo del navegador — eliminación de código muerto, caché, rendimiento de scroll, seguridad, seguridad de hilos
/browser connectcon auto-lanzamiento usa directorio de perfil Chrome dedicado- Eliminar sesiones de navegador huérfanas al iniciar
Voz y Visión
- Proveedor TTS Voxtral (Mistral AI)
- Soporte de velocidad TTS para Edge TTS, OpenAI TTS, MiniMax
- Redimensionamiento automático de visión para imágenes sobredimensionadas, límite aumentado a 20 MB, reintento ante fallo
- Corrección de discrepancia proveedor-modelo STT (whisper-1 vs faster-whisper)
Otras Herramientas
- Comando
hermes dumppara resumen de configuración - El almacén TODO impone unicidad de ID durante operaciones de reemplazo
- Listar todos los conjuntos de herramientas disponibles en la descripción del esquema de
delegate_task - Servidor API: progreso de herramientas como evento SSE personalizado para evitar corrupción del modelo
- Servidor API: compartir un contenedor Docker entre todas las conversaciones
Ecosistema de Habilidades
- Índice centralizado de habilidades + caché en árbol — elimina fallos por límite de tasa en la instalación
- Instrucciones de carga de habilidades más agresivas en el prompt del sistema (v3)
- Habilidad de Google Workspace migrada al backend de GWS CLI
- Habilidad de estrategias de divergencia creativa (@SHL0MS)
- Ideación creativa — generación de proyectos basada en restricciones (@SHL0MS)
- Paralelizar exploración/búsqueda de habilidades para evitar bloqueos
- Leer nombre del frontmatter de SKILL.md en skills_sync
Seguridad y Fiabilidad
Refuerzo de Seguridad
- Validación de firma de webhook de Twilio — corrección de RCE por SMS
- Neutralización de inyección de shell en
_write_to_sandboxmediante escapado de rutas - Prevención de inyección de argumentos Git y path traversal en el gestor de checkpoints
- Omisión de redirección SSRF en cargas de imágenes de Slack + helpers de caché en base.py
- Path traversal, barrera de credenciales, brechas en DANGEROUS_PATTERNS
- Protección de bind de API — exigir
API_SERVER_KEYpara binding no loopback - Autorización del botón de aprobación — requerir autenticación para continuar sesión
- Refuerzo de límites de ruta en operaciones del gestor de habilidades
- Validación de origen de URL de webhook de DingTalk/API, rechazo de inyección de cabeceras
Fiabilidad
- Diagnósticos de error contextuales para respuestas de API inválidas
- Evitar que errores de formato 400 activen el bucle de compresión en Codex
- No reducir a la mitad context_length en errores de output-cap-too-large
- Recuperar cliente principal ante errores de transporte de OpenAI
- Rotación del pool de credenciales en errores 400 clasificados como facturación
- Aumento automático del timeout de lectura de stream para proveedores LLM locales
- Recurrir a certificados por defecto cuando la ruta del bundle CA no existe
- Desambiguar patrones de límite de uso en el clasificador de errores
- Refuerzo del timeout de script cron y recuperación de proveedor
- Detección de interrupción del gateway resistente a fallos de tareas de monitor
- Evitar reinicio automático no deseado de sesión tras reinicios controlados del gateway
- Evitar spam de aviso de actualización duplicado en el observador del gateway
- Deduplicar elementos de razonamiento en la entrada de la API Responses
Infraestructura
- Imagen Docker multiarquitectura — amd64 + arm64
- Docker se ejecuta como usuario no root con virtualenv
- Usar
uvpara resolución de dependencias en Docker - CLI Nix consciente de contenedor — enrutamiento automático al contenedor gestionado
- Modelo de permisos de estado compartido de Nix para usuarios de CLI interactiva
- Aislamiento de HOME de subproceso por perfil
- Rutas de perfil corregidas en Docker — los perfiles van al volumen montado
- Vía del gateway de contenedor Docker reforzada
- Habilitar stdout sin búfer para registros Docker en vivo
- Instalar procps en la imagen Docker
- Clon superficial de git para instalación más rápida
hermes updatesiempre hace reset ante conflicto de stash- Escribir código de salida de actualización antes de reiniciar el gateway (condición de carrera de cgroup kill)
- Nix:
setupSecretsopcional, dependencia de tiempo de ejecución tirith - Parada de launchd usa
bootoutpara queKeepAliveno reincie
Correcciones de Errores Destacadas
- Corrección: cambio de
/modelno persistía entre mensajes del gateway - Corrección: anulaciones de modelo del gateway con ámbito de sesión ignoradas
- Corrección: longitud de contexto del modelo de compactación ignorando la configuración (3 incidencias relacionadas)
- Corrección: ventana de contexto de OpenCode.ai resuelta a 128K en lugar de 1M
- Corrección: búsqueda de almacén de autenticación de respaldo de Codex
- Corrección: notificaciones de finalización duplicadas al matar el proceso
- Corrección: hilo demonio del agente impedía procesos CLI huérfanos al cerrar pestaña
- Corrección: adjunto de imagen obsoleto al pegar texto y entrada de voz
- Corrección: siembra de sesión de hilo de MD causando contaminación entre hilos
- Corrección: migración de OpenClaw muestra vista previa antes de ejecutar
- Corrección: errores de autenticación mal clasificados como reintentables
- Corrección: cabecera Copilot-Integration-Id ausente
- Corrección: capacidades de sesión ACP
- Corrección: uso de PromptResponse de ACP desde campos de nivel superior
- Corrección: varias pruebas fallidas/inestables en main
- Corrección: nombres de archivo de marcadores de respaldo
- Corrección:
NoneTypeen comprobación de fast_mode - Corrección: imports faltantes en uninstall.py
Documentación
- Guía para desarrolladores de adaptadores de plataforma + documentación de WeCom Callback
- Guía de solución de problemas de cron
- Detección automática de timeout de streaming para LLMs locales
- Documentación ampliada de imposición de uso de herramientas
- Instrucciones de vinculación de BlueBubbles
- Sección de soporte de proxy de Telegram
- Referencia CLI de
hermes dumpyhermes logs - Referencia de configuración de
tool_progress_overrides - Documentación de advertencia de longitud de contexto del modelo de compresión
Actualización
hermes update
Para nuevas instalaciones, visita la guía de instalación.
← Hermes Agent Changelog