v0.12.0

Hermes Agent v0.12.0 — La versión Curator


Resumen

v0.12.0 — The Curator Release. Publicado el 30 de abril de 2026. 1,096 commits · 550 PRs fusionados · 1,270 archivos modificados · 217,776 inserciones · 213 contribuidores de la comunidad.

The Curator Release responde a una pregunta que todo usuario de agentes de larga duración acaba enfrentando: ¿quién mantiene el conocimiento del agente? La respuesta es ahora el propio agente. Un Curator autónomo en segundo plano evalúa, consolida y limpia tu biblioteca de skills en un ciclo de 7 días — sin intervención humana. El bucle de auto-mejora (el motor central que decide qué guardar después de cada turno) fue reescrito sustancialmente, pasando de un juicio libre a una evaluación basada en rúbricas. Cuatro nuevos proveedores de inferencia aterrizaron, las plataformas de mensajería llegaron a 19 con el primer adaptador distribuido como plugin (Microsoft Teams), ComfyUI v5 y TouchDesigner-MCP pasaron de opcionales a integrados por defecto, Spotify y Google Meet recibieron integraciones nativas, y el arranque en frío del TUI se redujo a más de la mitad.


Funcionalidades Principales

1. Curator Autónomo — El Agente Se Mantiene Solo

Después de meses de uso intensivo, tu biblioteca de skills inevitablemente acumula duplicados, borradores obsoletos y skills de un solo uso. El Curator es un agente en segundo plano que soluciona esto de forma autónoma.

Cómo funciona:

  • Se ejecuta en el ticker cron del gateway con un ciclo de 7 días por defecto
  • Evalúa cada skill de la biblioteca por uso y relevancia
  • Consolida skills solapadas en entradas unificadas
  • Limpia skills muertas que no se han usado
  • Clasifica skills archivadas como “consolidadas” o “limpiadas” usando modelo + heurística
  • Escribe informes por ejecución en logs/curator/run.json y REPORT.md
# Verificar estado del Curator — clasifica skills por uso
hermes curator status
# Salida: skills más/menos usadas, consolidaciones recientes, informes por ejecución

Protecciones integradas:

  • Skills empaquetadas y del hub están bloqueadas con defensa en profundidad
  • Skills fijadas están protegidas contra modificaciones
  • skill_manage rechaza escrituras en skills fijadas
  • Skills de directorios externos se respetan tal cual

Gestión unificada:

# hermes.config.yaml
auxiliary:
  curator:
    provider: openrouter
    model: deepseek-v4-flash  # modelo auxiliar económico ideal
    enabled: true

curator:
  cycle_days: 7
  max_prunes_per_run: 20
  min_skill_age_days: 3  # proteger skills muy recientes

Selecciona el modelo del Curator bajo auxiliary.curator en hermes model y adminístralo desde el dashboard. Úsalo con un modelo auxiliar económico como DeepSeek V4 Flash — un ciclo de 7 días en una biblioteca de 500 skills típicamente cuesta menos que una sola sesión de programación.

2. Bucle de Auto-Mejora — La Reescritura por Rúbricas

El bucle de auto-mejora es el motor de aprendizaje central de Hermes: después de cada turno de conversación, un fork de revisión en segundo plano decide qué memorias y skills guardar o actualizar. v0.12 reescribió este sistema de arriba a abajo.

Qué cambió:

  • Evaluación basada en rúbricas en lugar de preguntas libres tipo “¿deberíamos actualizar esto?” — evita que el modelo dude ante mejoras obvias
  • Sesgo de actualización activa — prefiere actualizar la skill que el agente acaba de cargar en lugar de crear duplicados
  • Maneja sub-archivos — directorios references/ y templates/ dentro de skills se rastrean y actualizan correctamente
  • Herencia correcta del runtime — provider, modelo y credenciales ahora se propagan del padre al fork de revisión
  • Herramientas limitadas — el fork de revisión solo puede usar herramientas de memoria + skills; sin shell, sin web, sin descontrol
  • Cierre limpio — los proveedores de memoria salen limpiamente tras la revisión
  • Contexto limpio — mensajes de herramientas de turnos anteriores se excluyen del resumen de revisión

Estos cambios hacen que el bucle de auto-mejora sea más predecible, más preciso y significativamente más seguro.

3. LM Studio — Proveedor de Primera Clase

LM Studio pasó de ser un alias de endpoint personalizado a un proveedor nativo completo:

# Autenticación dedicada, flujo de configuración de primera clase
hermes setup --provider lmstudio

# Listado de modelos en vivo desde la instancia de LM Studio
hermes model --provider lmstudio

Ahora con autenticación dedicada, verificaciones de salud hermes doctor, soporte de transporte reasoning y listado de modelos en vivo.

4. Cuatro Nuevos Proveedores de Inferencia

Proveedor Detalles
GMI Cloud Proveedor de primera clase con API-key, mismo nivel que Arcee/Kilocode/Xiaomi
Azure AI Foundry Detección automática, integración completa para despliegues empresariales
MiniMax OAuth Flujo PKCE en navegador con integración OAuth completa
Tencent Tokenhub Nuevo proveedor para el ecosistema de modelos de Tencent

Además, nuevos modelos en el catálogo: gpt-5.5 / gpt-5.5-pro, deepseek-v4-pro / deepseek-v4-flash, qwen3.6-plus, y un manifiesto remoto de catálogo de modelos para que nuevos modelos aparezcan sin necesidad de un release de Hermes.

5. Gateway Plugable + Microsoft Teams (19ª Plataforma)

El gateway ahora es un host de plugins — los adaptadores de mensajería pueden distribuirse como plugins fuera del código base. Microsoft Teams es la primera plataforma en hacerlo así.

# Plataforma Tipo
18 Tencent Yuanbao (元宝) Adaptador nativo con entrega de texto + multimedia
19 Microsoft Teams Primer adaptador distribuido como plugin

Arquitectura de plugins del Gateway:

  • Hook pre_gateway_dispatch — interceptar mensajes antes del envío
  • Hooks pre_approval_request / post_approval_response — personalizar flujos de aprobación
  • duration_ms en post_tool_call — seguimiento de rendimiento por invocación

6. Integración Nativa de Spotify

Siete herramientas con PKCE OAuth y un asistente de configuración interactivo:

# Configuración interactiva
hermes spotify setup
# Te guía por OAuth, luego la skill empaquetada está lista
Herramienta Función
Reproducir/pausar Controlar reproducción en cualquier dispositivo
Buscar Encontrar canciones, álbumes, artistas, playlists
Cola Gestionar la cola de reproducción
Playlists Crear y gestionar playlists
Dispositivos Cambiar entre dispositivos disponibles

7. Plugin de Google Meet

Unirse a llamadas, transcribir conversaciones, responder por voz y hacer seguimiento tras reuniones — todo como plugin empaquetado:

# Unirse a una reunión
hermes meet join https://meet.google.com/xxx-xxxx-xxx
# Activa subtítulos, genera transcripción, puede responder por voz, envía seguimiento

8. ComfyUI v5 & TouchDesigner-MCP — Ahora Integrados por Defecto

ComfyUI v5 pasó de opcional a integrado, con CLI oficial + REST + instalación local con verificación de hardware.

TouchDesigner-MCP ahora viene empaquetado por defecto y significativamente expandido: shaders GLSL, configuración de post-FX, setups reactivos de audio, programación de nodos de geometría y 9 nuevos documentos de referencia.

9. Expansión del Ecosistema de Skills

Skill Descripción
Humanizer Elimina los “AI-ismos” del texto generado
claude-design Skill de artefactos HTML con desambiguación de otras herramientas de diseño
design-md Skill de especificación DESIGN.md de Google
airtable Integración con base de datos Airtable
pretext Demos creativas de navegador con @chenglou/pretext
spike + sketch Experimentos descartables + mockups HTML
# Instalar skills desde una URL directa
hermes skills install https://example.com/skill.tar.gz

# Recargar skills sin reiniciar
/reload-skills

# Listar skills con estado habilitado/deshabilitado
hermes skills list

10. hermes -z — Modo One-Shot

Ejecuta Hermes de forma no interactiva para scripting y automatización:

hermes -z "Resume este código"
hermes -z "Revisa este PR diff" --model gpt-5.5 --provider openrouter
HERMES_INFERENCE_MODEL=claude-sonnet-4 hermes -z "Explica este error"

Perfecto para pipelines CI/CD, git hooks y cualquier automatización que necesite una llamada de agente única.

11. Web Dashboard — Pestaña de Modelos

Nueva pestaña de Modelos con análisis detallados por modelo. Configura modelos principales y auxiliares directamente desde el navegador.

12. Rendimiento — Arranque 57% Más Rápido

El tiempo visible de arranque en frío del TUI se redujo a más de la mitad mediante: inicialización diferida del agente, imports perezosos, caché mtime de load_config(), get_tool_definitions() memoizada y patrones de comandos peligrosos precompilados.

13. Enrutamiento Nativo de Imágenes Multimodales

Las imágenes ahora se enrutan según la capacidad visual real del modelo, no los valores predeterminados del proveedor.

14. Paridad Multimedia del Gateway

Envío nativo de múltiples imágenes en Telegram, Discord, Slack, Mattermost, Email y Signal. Enrutamiento de audio centralizado con soporte FLAC.


Nuevas Herramientas y Comandos

Herramienta / Comando Descripción Uso
hermes curator Agente de mantenimiento de biblioteca de skills hermes curator status
hermes -z Modo one-shot no interactivo hermes -z "<prompt>"
hermes update --check Verificación previa a actualización hermes update --check
hermes fallback Gestionar cadena de proveedores de respaldo hermes fallback list
/busy Modo de entrada ocupado (steer/queue) /busy steer
/btw Alias para /background /btw <tarea>
/reload-skills Recargar skills sin reiniciar /reload-skills
/reload Recargar .env en caliente /reload
/mouse Alternar modo ratón (fix WSL2) /mouse

TUI — Mejora Importante

  • Renderizado LaTeX — expresiones matemáticas nativas
  • Estilos de indicador de ocupado plugables
  • Auto-reanudación opcional de la última sesión
  • Eliminación de sesiones desde /resume con tecla d
  • Desplazamiento línea a línea con rueda del ratón
  • Edición de cola — eliminar mensajes con ctrl-x, cancelar con esc
  • Detección automática ampliada de terminal claro
  • Paridad de modo voz con CLI
  • Menú de ayuda mini con ? en el campo de entrada
  • Desactivación proactiva de ratón en ConPTY + comando /mouse

TTS — Registro de Proveedores Plugable

tts:
  providers:
    piper:           # TTS local — sin necesidad de nube
      voice: en_US-lessac-medium
    openai:          # TTS en la nube
      voice: alloy

Piper se distribuye como proveedor TTS local nativo, resolviendo una solicitud comunitaria de larga data para voz sin conexión.


Mejoras

Agente Principal y Arquitectura

  • TTL de caché de prompt configurable (prompt_caching.cache_ttl, 5min por defecto, 1h opcional)
  • child_timeout_seconds de delegado aumentado a 600s
  • Volcado de diagnóstico cuando subagente expira con 0 llamadas API
  • Gateway invalida agente en caché al editar config de compresión/context_length
  • Pie de metadatos de runtime opcional en respuestas finales
  • Lista blanca /fast ampliada a todos los modelos OpenAI + Anthropic

Compresión

  • Reintentar resumen en modelo principal antes de rendirse
  • Notificar usuarios cuando el modelo auxiliar falla
  • /compress bloquea entrada durante compresión

Sesión y Memoria

  • Índice FTS5 de trigramas para búsqueda CJK con reparación + migración
  • tool_name + tool_calls indexados en FTS5
  • Auto-limpieza de checkpoints huérfanos al inicio
  • Proveedores de memoria notificados en rotación de session_id

Plataformas de Mensajería

Plataforma Mejora
Telegram Listas blancas de chat; renderizado de tablas markdown; multi-imagen nativo
Discord Toolsets opcionales + inyección de ID + división de herramientas
Slack Comandos slash nativos; config strict_mention; channel_skill_bindings
Signal Formateo markdown nativo; multi-imagen

Cron

  • Respeta configuración de hermes tools
  • workdir por tarea — ejecuciones cron conscientes del proyecto
  • Campo context_from — encadenar salidas de tareas cron
  • Supervisor CDP — detección de diálogos + respuesta + eval de iframes cross-origin
  • Auto-inicio de Chromium local para URLs LAN/localhost

Código

  • Backend Vercel Sandbox para execute_code / terminal
  • Colapsar task_ids de subagentes a contenedor compartido
  • Docker: ejecutar contenedor como usuario host

Observabilidad

  • Plugin empaquetado Langfuse
  • Plugin empaquetado hermes-achievements

Seguridad y Fiabilidad

  • Censura de secretos desactivada por defecto — evita corrupción de parches. Activar con redaction.enabled: true
  • [SYSTEM:[IMPORTANT: en marcadores inyectados — evita falsos positivos del filtro de contenido de Azure
  • Lista de bloqueo estricta para comandos irrecuperables
  • Helper canónico mask_secret — censura unificada de secretos
  • Limpieza programada de subidas paste.rs expiradas
  • Preservar enlaces simbólicos durante escrituras atómicas

Correcciones de Bugs Notables

360 PRs de tipo fix: en esta ventana. Destacados:

  • Fork de revisión hereda runtime del padre — provider/modelo/credenciales ahora se propagan correctamente
  • Razonamiento en streaming persiste en turnos del asistente
  • Aislamiento de razonamiento entre proveedores — sin fugas entre DeepSeek/Kimi
  • croniter promovido a dependencia principal
  • Recuperación de compresión — reintento en modelo principal antes de rendirse
  • Búsqueda FTS5 — tool_name + tool_calls indexados
  • Caché de visión usa HERMES_HOME en lugar de cwd
  • Referencias definitions de MCP reescritas a $defs — corrige errores 400
  • Compatibilidad con filtro de contenido Azure
  • Parámetro limit de Discord convertido a int antes de min()

Eliminado / Revertido

  • Tablero Kanban multi-perfil — aterrizó y fue revertido para rediseño
  • cua-driver de computer-use — PRs preparatorios aterrizaron y fueron revertidos
  • Hook integrado BOOT.md eliminado — reemplazado por tutorial de hooks
  • Comandos slash /provider + /plan eliminados
  • flush_memories eliminado completamente

Actualización

hermes update

Para nuevas instalaciones, consulta la guía de instalación.


Changelog completo en GitHub

← Hermes Agent Changelog