v0.9.0

Hermes Agent v0.9.0 — La Versión Omnipresente


Resumen

v0.9.0 — La Versión Omnipresente. Publicada el 13 de abril de 2026. Desde v0.8.0: 487 commits · 269 PRs fusionados · 167 incidencias resueltas · 493 archivos modificados · 63.281 inserciones · 24 colaboradores.

Esta versión gira en torno a una sola idea: estar en todas partes. Hermes salió de la terminal y de un puñado de plataformas de chat, adentrándose en el ecosistema Apple (iMessage), el ecosistema chino (WeChat) e incluso el móvil (Android/Termux). Un nuevo Panel Web local te permite gestionarlo todo sin tocar archivos de configuración. El Modo Rápido elimina los tiempos de espera en flujos sensibles a la latencia. El monitoreo de procesos en segundo plano te libera del infierno del sondeo constante. Y 11 correcciones de refuerzo de seguridad garantizan que todo funcione rápido y seguro.


Funcionalidades Principales

1. Panel Web Local — Gestiona Todo desde el Navegador

Hermes ahora incluye un panel de gestión basado en navegador para uso local. Configura ajustes, monitorea sesiones, explora habilidades y gestiona tu gateway — todo desde una interfaz web limpia, sin archivos de configuración, sin necesidad de terminal. La forma más sencilla de comenzar con Hermes.

El panel está construido sobre FastAPI + Uvicorn, ejecutándose en 127.0.0.1:9119 por defecto, con estado del gateway en tiempo real, historial de sesiones y analíticas de uso.

2. Modo Rápido (/fast) — Canal de Inferencia Prioritaria

Escribe /fast en el chat para enrutar tu sesión actual a través de colas de procesamiento prioritario para los modelos de OpenAI y Anthropic, reduciendo drásticamente la latencia de inferencia. Los modelos compatibles incluyen GPT-5.4, Codex, Claude y más.

# Activar el modo rápido
/fast

# Todas las llamadas posteriores al LLM pasan por colas prioritarias con mucha menor latencia
# Escribe /fast de nuevo para desactivarlo

Respaldado por el Procesamiento Prioritario de OpenAI y el nivel rápido de Anthropic, extendido a todos los modelos elegibles. (#6875, #6960, #7037)

3. iMessage vía BlueBubbles — Hermes Entra en el Ecosistema Apple

Integración completa con iMessage a través de BlueBubbles. Registro automático de webhooks, integración con el asistente de configuración y resistencia a fallos — Hermes ahora puede enviar y recibir iMessages desde tu Mac.

# Selecciona BlueBubbles en el asistente de configuración y sigue la guía de vinculación
hermes setup

(#6437, #6460, #6494)

4. WeChat (Weixin) y Modo Callback de WeCom — Ecosistema de Mensajería Chino Completo

WeChat (Weixin): Soporte nativo para WeChat mediante la API de iLink Bot, con cursor de streaming, carga de archivos multimedia y manejo de enlaces Markdown.

Modo Callback de WeCom: Un adaptador en modo callback para aplicaciones empresariales autoalojadas con persistencia atómica de estado.

Hermes ahora cubre el ecosistema de mensajería chino de extremo a extremo — desde WeChat personal hasta WeCom empresarial. (#7166, #7943)

5. Soporte para Termux / Android — Hermes se Vuelve Móvil

Ejecuta Hermes de forma nativa en Android mediante Termux. Rutas de instalación adaptadas, TUI optimizada para pantallas móviles, soporte para backend de voz y el comando /image funciona en el dispositivo.

# Instalar en Termux usando el paquete especializado para Termux
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash -s -- --bundle termux

(#6834)

6. Monitoreo de Procesos en Segundo Plano (watch_patterns) — Recibe Notificaciones, No Hagas Sondeos

Define patrones regex para vigilar en la salida de procesos en segundo plano y recibe notificaciones en tiempo real cuando coincidan. Monitorea errores, espera eventos específicos (“listening on port 3000”) o vigila registros de compilación — se acabó el sondeo manual.

# hermes.config.yaml
watch_patterns:
  - pattern: "Error:.*"
    notify: true
  - pattern: "listening on port \\d+"
    notify: true
    label: "Servicio listo"

(#7635)

7. xAI (Grok) y Xiaomi MiMo — Soporte Nativo de Proveedores

Dos grandes proveedores de modelos obtienen soporte de primera clase:

  • xAI (Grok): Acceso directo a la API, catálogo de modelos, integración con el asistente de configuración
  • Xiaomi MiMo: Asistente de configuración, catálogo de modelos, recuperación automática ante respuestas vacías

Además, OAuth de Qwen con soporte para solicitudes vía portal. (#7372, #7855)

8. Motor de Contexto Conectable — Personaliza lo que el Agente Ve

La gestión de contexto ahora es un módulo conectable mediante hermes plugins. Intercambia motores de contexto personalizados que controlan exactamente lo que el agente ve en cada turno — filtrado, resumen o inyección de contexto específico del dominio.

# Instalar un motor de contexto personalizado como plugin
hermes plugins install my-context-engine

(#7464)

9. Soporte Unificado de Proxy — Funciona Detrás de Firewalls

Proxy SOCKS, DISCORD_PROXY y detección automática del proxy del sistema en todas las plataformas del gateway. Hermes funciona detrás de firewalls corporativos — macOS detecta automáticamente la configuración de proxy del sistema, Windows/Linux solo requieren configuración manual. (#6814)

10. Refuerzo Integral de Seguridad — 11 Correcciones Críticas

La revisión de seguridad más profunda en la historia de Hermes:

Vulnerabilidad Corrección PR
RCE por SMS Validación de firma de webhook de Twilio #7933
Inyección de Shell Escapado de rutas de escritura en sandbox #7940
Inyección de Argumentos Git Protección contra path traversal e inyección de argumentos #7944
SSRF Protección contra redirección en carga de imágenes de Slack #7151
Path Traversal Refuerzo de límites en gestor de checkpoints y gestor de habilidades #7156
Protección de Bind de API Exigir API_SERVER_KEY para bindings no loopback #7455
Autenticación de Botón de Aprobación Requerir autenticación para continuar sesión #6930

11. hermes backup y hermes import — Respaldo y Restauración en un Solo Paso

Respaldo y restauración completa de tu configuración de Hermes, sesiones, habilidades y memoria. Migra entre máquinas o haz una instantánea antes de cambios importantes — un solo comando lo hace todo.

# Respaldar todo
hermes backup

# Restaurar en una máquina nueva
hermes import ./backup-2026-04-13.tar.gz

(#7997)

12. 16 Plataformas Soportadas — Verdaderamente Omnipresente

A partir de esta versión, Hermes soporta 16 plataformas de mensajería:

Telegram, Discord, Slack, WhatsApp, Signal, Matrix, iMessage (nuevo), WeChat (nuevo), WeCom, Email, SMS, DingTalk, Feishu, Mattermost, Home Assistant, Webhooks

13. Kit de Depuración — /debug y hermes debug share

Nuevos comandos de depuración: el comando slash /debug disponible en todas las plataformas para diagnósticos rápidos, además de hermes debug share para subir un informe completo de depuración a un pastebin y compartirlo fácilmente al resolver problemas. (#8681)

# Diagnóstico rápido en CLI
/debug

# Exportar y compartir un informe de depuración
hermes debug share

Agente Principal y Arquitectura

Soporte de Proveedores y Modelos

  • Proveedor nativo xAI (Grok) con acceso directo a la API y catálogo de modelos
  • Xiaomi MiMo como proveedor de primera clase — asistente de configuración, catálogo de modelos, recuperación ante respuestas vacías
  • Proveedor OAuth de Qwen con soporte para solicitudes vía portal
  • Modo Rápido — interruptor /fast para Procesamiento Prioritario de OpenAI + nivel rápido de Anthropic
  • Clasificación estructurada de errores de API para decisiones inteligentes de conmutación por error
  • Captura de cabeceras de límite de tasa mostrada en /usage
  • Nombre del modelo del servidor API derivado del nombre del perfil
  • Proveedores personalizados ahora incluidos en listados y resolución de /model
  • Activación de proveedor de respaldo ante respuestas vacías repetidas con estado visible para el usuario
  • Etiquetas de variante de OpenRouter (:free, :extended, :fast) preservadas durante el cambio de modelo
  • TTL de agotamiento de credenciales reducido de 24 horas a 1 hora
  • Refuerzo del ciclo de vida de credenciales OAuth — claves de pool obsoletas, sincronización de auth.json, corrección de condiciones de carrera en Codex CLI
  • Recuperación ante respuestas vacías para modelos de razonamiento (MiMo, Qwen, GLM)
  • Longitudes de contexto de MiniMax, protección de pensamiento, correcciones de endpoint
  • Detección automática de endpoint de Z.AI mediante sonda y caché

Bucle del Agente y Conversación

  • Ranura de motor de contexto conectable mediante hermes plugins
  • Monitoreo de procesos en segundo planowatch_patterns para alertas de salida en tiempo real
  • Compresión de contexto mejorada — límites más altos, seguimiento de herramientas, advertencias de degradación, protección del final del presupuesto de tokens
  • /compress <enfoque> — compresión guiada con un tema central
  • Advertencias de presión de contexto por niveles con deduplicación en el gateway
  • Advertencia de inactividad escalonada antes de la escalada de tiempo de espera
  • Evitar que el agente se detenga a mitad de tarea — suelo de compresión, revisión de presupuesto, seguimiento de actividad
  • Propagar actividad hija al padre durante delegate_task
  • Detección de llamadas de herramienta truncadas en streaming antes de la ejecución
  • Reintento de respuesta vacía (3 intentos con empujón)
  • Retroceso adaptativo de streaming + limpieza de cursor para evitar truncamiento de mensajes
  • La compresión usa el modelo de sesión activa en lugar de la configuración persistida obsoleta
  • Eliminar etiquetas <thought> de las respuestas de Gemma 4
  • Evitar que <think> en prosa suprima la salida de respuesta
  • Registro de diagnóstico de salida de turno en el bucle del agente
  • Señal de interrupción de herramienta con alcance por hilo para evitar fugas entre sesiones

Memoria y Sesiones

  • Plugin de memoria retrospectiva (hindsight) — paridad de funcionalidades, asistente de configuración, mejoras de configuración (@nicoloboschi)
  • HonchoinitOnSessionStart opcional para modo herramientas (@Kathie-yu)
  • Hijos huérfanos en lugar de eliminación en cascada en prune/delete
  • El comando doctor solo verifica el proveedor de memoria activo

Plataformas de Mensajería (Gateway)

Nuevas Plataformas

  • BlueBubbles (iMessage) — adaptador completo con registro automático de webhooks, asistente de configuración y resistencia a fallos
  • WeChat (Weixin) — soporte nativo mediante API de iLink Bot con streaming, carga de archivos multimedia y enlaces markdown
  • Modo Callback de WeCom — adaptador para aplicaciones empresariales autoalojadas con persistencia atómica de estado

Mejoras de Plataformas

Discord:

  • Configuración de lista blanca de canales permitidos
  • Herencia de tema del canal del foro en sesiones de hilo
  • Configuración DISCORD_REPLY_TO_MODE
  • Aceptar adjuntos .log, aumento del límite de tamaño de documentos
  • Desacoplar la sincronización de comandos slash de la disponibilidad

Slack:

  • Mejoras consolidadas de Slack — 7 PRs de la comunidad unificados en uno
  • Manejar eventos del ciclo de vida del hilo del asistente

Matrix:

  • Migración de matrix-nio a mautrix-python
  • Almacén criptográfico SQLite reemplazando pickle (corrige el descifrado E2EE)
  • Verificación de clave de recuperación de firma cruzada para migración E2EE
  • Hilos de mención en MD + eventos de chat grupal para Feishu

Núcleo del Gateway

  • Soporte unificado de proxy — SOCKS, DISCORD_PROXY, multiplataforma con detección automática en macOS
  • Agrupación de texto entrante para Discord, Matrix, WeCom + retardo adaptativo
  • Mostrar mensajes naturales del asistente a mitad de turno en plataformas de chat
  • Gateway compatible con WSL con detección inteligente de systemd
  • Todas las plataformas faltantes añadidas al asistente de configuración
  • Anulaciones de tool_progress por plataforma
  • Intervalo configurable de notificación “still working”
  • El cambio de /model persiste entre mensajes
  • /usage muestra límites de tasa, coste y detalles de tokens entre turnos
  • Drenar trabajo en curso antes de reiniciar
  • No desalojar agente en caché tras ejecuciones fallidas — previene el bucle de reinicio de MCP
  • Reemplazar estado de sesión os.environ por contextvars
  • Derivar plataformas de directorio de canales desde enum en lugar de lista fija
  • Validar descargas de imágenes antes de almacenar en caché (multiplataforma)
  • Entrega de webhooks entre plataformas para todas las plataformas
  • Soporte de entrega de cron a thread_id de Discord
  • Incorporación de bot Feishu mediante QR
  • Estado del gateway limitado al perfil activo
  • Evitar que notificaciones de procesos en segundo plano activen solicitudes de vinculación falsas

CLI y Experiencia de Usuario

CLI Interactiva

  • Soporte para Termux / Android — rutas de instalación adaptadas, TUI, voz, /image
  • Selector modal nativo de /model para selección de proveedor → modelo
  • Temporizador en vivo por herramienta restaurado en el spinner de TUI
  • Retroceso de progreso de herramientas apiladas en TUI
  • Consejos aleatorios al iniciar nueva sesión (CLI + gateway, 279 consejos)
  • hermes dump — resumen de configuración listo para copiar y pegar para depuración
  • hermes backup / hermes import — respaldo y restauración completa de configuración
  • Indicador de entorno WSL en el prompt del sistema
  • UX de creación de perfil — SOUL.md inicial + advertencia de credenciales
  • Detección de sudo consciente del shell, soporte para contraseña vacía
  • Vaciar stdin después de menús de curses/terminal para evitar fugas de secuencias de escape
  • Manejar stdin roto en el arranque de prompt_toolkit

Configuración

  • Configuración de nivel de detalle de visualización por plataforma
  • Registro de logs separado por componentes con contexto de sesión y filtrado
  • Configuración network.force_ipv4 para solucionar problemas de timeout IPv6
  • Estandarización de espacios en blanco y formato JSON en mensajes
  • Cambio de marca OpenClaw → Hermes durante la migración
  • config.yaml tiene prioridad sobre variables de entorno para ajustes auxiliares
  • Refuerzo de flujos de configuración de proveedores + actualización en vivo del catálogo de OpenRouter
  • Normalización del orden de esfuerzo de razonamiento en todas las interfaces
  • Eliminación de variable de entorno obsoleta LLM_MODEL + migración para limpiar entradas antiguas
  • Eliminación del comando slash /prompt — peligro de expansión de prefijos
  • Variable de entorno HERMES_HOME_MODE para anular permisos
  • Recurrir al modelo predeterminado cuando la configuración del modelo está vacía
  • Advertir cuando el contexto del modelo de compresión es demasiado pequeño

Sistema de Herramientas

Entornos y Ejecución

  • Capa de ejecución unificada por llamada para entornos
  • Sincronización de archivos unificada con seguimiento de mtime, eliminación y estado transaccional
  • Entornos sandbox persistentes sobreviven entre turnos
  • Sincronización masiva de archivos mediante tubería tar para backends SSH/Modal
  • Daytona — carga masiva, puente de configuración, límite silencioso de disco
  • Límite de timeout en primer plano para evitar bloqueos de sesión
  • Protección contra valores de comando inválidos

MCP

  • Soporte para hermes mcp add --env y --preset
  • Combinar content y structuredContent cuando ambos están presentes
  • Correcciones de desambiguación de nombres de herramientas MCP
  • Refuerzo del navegador — eliminación de código muerto, caché, rendimiento de scroll, seguridad, seguridad de hilos
  • /browser connect con auto-lanzamiento usa directorio de perfil Chrome dedicado
  • Eliminar sesiones de navegador huérfanas al iniciar

Voz y Visión

  • Proveedor TTS Voxtral (Mistral AI)
  • Soporte de velocidad TTS para Edge TTS, OpenAI TTS, MiniMax
  • Redimensionamiento automático de visión para imágenes sobredimensionadas, límite aumentado a 20 MB, reintento ante fallo
  • Corrección de discrepancia proveedor-modelo STT (whisper-1 vs faster-whisper)

Otras Herramientas

  • Comando hermes dump para resumen de configuración
  • El almacén TODO impone unicidad de ID durante operaciones de reemplazo
  • Listar todos los conjuntos de herramientas disponibles en la descripción del esquema de delegate_task
  • Servidor API: progreso de herramientas como evento SSE personalizado para evitar corrupción del modelo
  • Servidor API: compartir un contenedor Docker entre todas las conversaciones

Ecosistema de Habilidades

  • Índice centralizado de habilidades + caché en árbol — elimina fallos por límite de tasa en la instalación
  • Instrucciones de carga de habilidades más agresivas en el prompt del sistema (v3)
  • Habilidad de Google Workspace migrada al backend de GWS CLI
  • Habilidad de estrategias de divergencia creativa (@SHL0MS)
  • Ideación creativa — generación de proyectos basada en restricciones (@SHL0MS)
  • Paralelizar exploración/búsqueda de habilidades para evitar bloqueos
  • Leer nombre del frontmatter de SKILL.md en skills_sync

Seguridad y Fiabilidad

Refuerzo de Seguridad

  • Validación de firma de webhook de Twilio — corrección de RCE por SMS
  • Neutralización de inyección de shell en _write_to_sandbox mediante escapado de rutas
  • Prevención de inyección de argumentos Git y path traversal en el gestor de checkpoints
  • Omisión de redirección SSRF en cargas de imágenes de Slack + helpers de caché en base.py
  • Path traversal, barrera de credenciales, brechas en DANGEROUS_PATTERNS
  • Protección de bind de API — exigir API_SERVER_KEY para binding no loopback
  • Autorización del botón de aprobación — requerir autenticación para continuar sesión
  • Refuerzo de límites de ruta en operaciones del gestor de habilidades
  • Validación de origen de URL de webhook de DingTalk/API, rechazo de inyección de cabeceras

Fiabilidad

  • Diagnósticos de error contextuales para respuestas de API inválidas
  • Evitar que errores de formato 400 activen el bucle de compresión en Codex
  • No reducir a la mitad context_length en errores de output-cap-too-large
  • Recuperar cliente principal ante errores de transporte de OpenAI
  • Rotación del pool de credenciales en errores 400 clasificados como facturación
  • Aumento automático del timeout de lectura de stream para proveedores LLM locales
  • Recurrir a certificados por defecto cuando la ruta del bundle CA no existe
  • Desambiguar patrones de límite de uso en el clasificador de errores
  • Refuerzo del timeout de script cron y recuperación de proveedor
  • Detección de interrupción del gateway resistente a fallos de tareas de monitor
  • Evitar reinicio automático no deseado de sesión tras reinicios controlados del gateway
  • Evitar spam de aviso de actualización duplicado en el observador del gateway
  • Deduplicar elementos de razonamiento en la entrada de la API Responses

Infraestructura

  • Imagen Docker multiarquitectura — amd64 + arm64
  • Docker se ejecuta como usuario no root con virtualenv
  • Usar uv para resolución de dependencias en Docker
  • CLI Nix consciente de contenedor — enrutamiento automático al contenedor gestionado
  • Modelo de permisos de estado compartido de Nix para usuarios de CLI interactiva
  • Aislamiento de HOME de subproceso por perfil
  • Rutas de perfil corregidas en Docker — los perfiles van al volumen montado
  • Vía del gateway de contenedor Docker reforzada
  • Habilitar stdout sin búfer para registros Docker en vivo
  • Instalar procps en la imagen Docker
  • Clon superficial de git para instalación más rápida
  • hermes update siempre hace reset ante conflicto de stash
  • Escribir código de salida de actualización antes de reiniciar el gateway (condición de carrera de cgroup kill)
  • Nix: setupSecrets opcional, dependencia de tiempo de ejecución tirith
  • Parada de launchd usa bootout para que KeepAlive no reincie

Correcciones de Errores Destacadas

  • Corrección: cambio de /model no persistía entre mensajes del gateway
  • Corrección: anulaciones de modelo del gateway con ámbito de sesión ignoradas
  • Corrección: longitud de contexto del modelo de compactación ignorando la configuración (3 incidencias relacionadas)
  • Corrección: ventana de contexto de OpenCode.ai resuelta a 128K en lugar de 1M
  • Corrección: búsqueda de almacén de autenticación de respaldo de Codex
  • Corrección: notificaciones de finalización duplicadas al matar el proceso
  • Corrección: hilo demonio del agente impedía procesos CLI huérfanos al cerrar pestaña
  • Corrección: adjunto de imagen obsoleto al pegar texto y entrada de voz
  • Corrección: siembra de sesión de hilo de MD causando contaminación entre hilos
  • Corrección: migración de OpenClaw muestra vista previa antes de ejecutar
  • Corrección: errores de autenticación mal clasificados como reintentables
  • Corrección: cabecera Copilot-Integration-Id ausente
  • Corrección: capacidades de sesión ACP
  • Corrección: uso de PromptResponse de ACP desde campos de nivel superior
  • Corrección: varias pruebas fallidas/inestables en main
  • Corrección: nombres de archivo de marcadores de respaldo
  • Corrección: NoneType en comprobación de fast_mode
  • Corrección: imports faltantes en uninstall.py

Documentación

  • Guía para desarrolladores de adaptadores de plataforma + documentación de WeCom Callback
  • Guía de solución de problemas de cron
  • Detección automática de timeout de streaming para LLMs locales
  • Documentación ampliada de imposición de uso de herramientas
  • Instrucciones de vinculación de BlueBubbles
  • Sección de soporte de proxy de Telegram
  • Referencia CLI de hermes dump y hermes logs
  • Referencia de configuración de tool_progress_overrides
  • Documentación de advertencia de longitud de contexto del modelo de compresión

Actualización

hermes update

Para nuevas instalaciones, visita la guía de instalación.


Changelog completo en GitHub

← Hermes Agent Changelog