Hermes Agent v0.12.0 — La versión Curator
Resumen
v0.12.0 — The Curator Release. Publicado el 30 de abril de 2026. 1,096 commits · 550 PRs fusionados · 1,270 archivos modificados · 217,776 inserciones · 213 contribuidores de la comunidad.
The Curator Release responde a una pregunta que todo usuario de agentes de larga duración acaba enfrentando: ¿quién mantiene el conocimiento del agente? La respuesta es ahora el propio agente. Un Curator autónomo en segundo plano evalúa, consolida y limpia tu biblioteca de skills en un ciclo de 7 días — sin intervención humana. El bucle de auto-mejora (el motor central que decide qué guardar después de cada turno) fue reescrito sustancialmente, pasando de un juicio libre a una evaluación basada en rúbricas. Cuatro nuevos proveedores de inferencia aterrizaron, las plataformas de mensajería llegaron a 19 con el primer adaptador distribuido como plugin (Microsoft Teams), ComfyUI v5 y TouchDesigner-MCP pasaron de opcionales a integrados por defecto, Spotify y Google Meet recibieron integraciones nativas, y el arranque en frío del TUI se redujo a más de la mitad.
Funcionalidades Principales
1. Curator Autónomo — El Agente Se Mantiene Solo
Después de meses de uso intensivo, tu biblioteca de skills inevitablemente acumula duplicados, borradores obsoletos y skills de un solo uso. El Curator es un agente en segundo plano que soluciona esto de forma autónoma.
Cómo funciona:
- Se ejecuta en el ticker cron del gateway con un ciclo de 7 días por defecto
- Evalúa cada skill de la biblioteca por uso y relevancia
- Consolida skills solapadas en entradas unificadas
- Limpia skills muertas que no se han usado
- Clasifica skills archivadas como “consolidadas” o “limpiadas” usando modelo + heurística
- Escribe informes por ejecución en
logs/curator/run.jsonyREPORT.md
# Verificar estado del Curator — clasifica skills por uso
hermes curator status
# Salida: skills más/menos usadas, consolidaciones recientes, informes por ejecución
Protecciones integradas:
- Skills empaquetadas y del hub están bloqueadas con defensa en profundidad
- Skills fijadas están protegidas contra modificaciones
skill_managerechaza escrituras en skills fijadas- Skills de directorios externos se respetan tal cual
Gestión unificada:
# hermes.config.yaml
auxiliary:
curator:
provider: openrouter
model: deepseek-v4-flash # modelo auxiliar económico ideal
enabled: true
curator:
cycle_days: 7
max_prunes_per_run: 20
min_skill_age_days: 3 # proteger skills muy recientes
Selecciona el modelo del Curator bajo auxiliary.curator en hermes model y adminístralo desde el dashboard. Úsalo con un modelo auxiliar económico como DeepSeek V4 Flash — un ciclo de 7 días en una biblioteca de 500 skills típicamente cuesta menos que una sola sesión de programación.
2. Bucle de Auto-Mejora — La Reescritura por Rúbricas
El bucle de auto-mejora es el motor de aprendizaje central de Hermes: después de cada turno de conversación, un fork de revisión en segundo plano decide qué memorias y skills guardar o actualizar. v0.12 reescribió este sistema de arriba a abajo.
Qué cambió:
- Evaluación basada en rúbricas en lugar de preguntas libres tipo “¿deberíamos actualizar esto?” — evita que el modelo dude ante mejoras obvias
- Sesgo de actualización activa — prefiere actualizar la skill que el agente acaba de cargar en lugar de crear duplicados
- Maneja sub-archivos — directorios
references/ytemplates/dentro de skills se rastrean y actualizan correctamente - Herencia correcta del runtime — provider, modelo y credenciales ahora se propagan del padre al fork de revisión
- Herramientas limitadas — el fork de revisión solo puede usar herramientas de memoria + skills; sin shell, sin web, sin descontrol
- Cierre limpio — los proveedores de memoria salen limpiamente tras la revisión
- Contexto limpio — mensajes de herramientas de turnos anteriores se excluyen del resumen de revisión
Estos cambios hacen que el bucle de auto-mejora sea más predecible, más preciso y significativamente más seguro.
3. LM Studio — Proveedor de Primera Clase
LM Studio pasó de ser un alias de endpoint personalizado a un proveedor nativo completo:
# Autenticación dedicada, flujo de configuración de primera clase
hermes setup --provider lmstudio
# Listado de modelos en vivo desde la instancia de LM Studio
hermes model --provider lmstudio
Ahora con autenticación dedicada, verificaciones de salud hermes doctor, soporte de transporte reasoning y listado de modelos en vivo.
4. Cuatro Nuevos Proveedores de Inferencia
| Proveedor | Detalles |
|---|---|
| GMI Cloud | Proveedor de primera clase con API-key, mismo nivel que Arcee/Kilocode/Xiaomi |
| Azure AI Foundry | Detección automática, integración completa para despliegues empresariales |
| MiniMax OAuth | Flujo PKCE en navegador con integración OAuth completa |
| Tencent Tokenhub | Nuevo proveedor para el ecosistema de modelos de Tencent |
Además, nuevos modelos en el catálogo: gpt-5.5 / gpt-5.5-pro, deepseek-v4-pro / deepseek-v4-flash, qwen3.6-plus, y un manifiesto remoto de catálogo de modelos para que nuevos modelos aparezcan sin necesidad de un release de Hermes.
5. Gateway Plugable + Microsoft Teams (19ª Plataforma)
El gateway ahora es un host de plugins — los adaptadores de mensajería pueden distribuirse como plugins fuera del código base. Microsoft Teams es la primera plataforma en hacerlo así.
| # | Plataforma | Tipo |
|---|---|---|
| 18 | Tencent Yuanbao (元宝) | Adaptador nativo con entrega de texto + multimedia |
| 19 | Microsoft Teams | Primer adaptador distribuido como plugin |
Arquitectura de plugins del Gateway:
- Hook
pre_gateway_dispatch— interceptar mensajes antes del envío - Hooks
pre_approval_request/post_approval_response— personalizar flujos de aprobación duration_msenpost_tool_call— seguimiento de rendimiento por invocación
6. Integración Nativa de Spotify
Siete herramientas con PKCE OAuth y un asistente de configuración interactivo:
# Configuración interactiva
hermes spotify setup
# Te guía por OAuth, luego la skill empaquetada está lista
| Herramienta | Función |
|---|---|
| Reproducir/pausar | Controlar reproducción en cualquier dispositivo |
| Buscar | Encontrar canciones, álbumes, artistas, playlists |
| Cola | Gestionar la cola de reproducción |
| Playlists | Crear y gestionar playlists |
| Dispositivos | Cambiar entre dispositivos disponibles |
7. Plugin de Google Meet
Unirse a llamadas, transcribir conversaciones, responder por voz y hacer seguimiento tras reuniones — todo como plugin empaquetado:
# Unirse a una reunión
hermes meet join https://meet.google.com/xxx-xxxx-xxx
# Activa subtítulos, genera transcripción, puede responder por voz, envía seguimiento
8. ComfyUI v5 & TouchDesigner-MCP — Ahora Integrados por Defecto
ComfyUI v5 pasó de opcional a integrado, con CLI oficial + REST + instalación local con verificación de hardware.
TouchDesigner-MCP ahora viene empaquetado por defecto y significativamente expandido: shaders GLSL, configuración de post-FX, setups reactivos de audio, programación de nodos de geometría y 9 nuevos documentos de referencia.
9. Expansión del Ecosistema de Skills
| Skill | Descripción |
|---|---|
| Humanizer | Elimina los “AI-ismos” del texto generado |
| claude-design | Skill de artefactos HTML con desambiguación de otras herramientas de diseño |
| design-md | Skill de especificación DESIGN.md de Google |
| airtable | Integración con base de datos Airtable |
| pretext | Demos creativas de navegador con @chenglou/pretext |
| spike + sketch | Experimentos descartables + mockups HTML |
# Instalar skills desde una URL directa
hermes skills install https://example.com/skill.tar.gz
# Recargar skills sin reiniciar
/reload-skills
# Listar skills con estado habilitado/deshabilitado
hermes skills list
10. hermes -z — Modo One-Shot
Ejecuta Hermes de forma no interactiva para scripting y automatización:
hermes -z "Resume este código"
hermes -z "Revisa este PR diff" --model gpt-5.5 --provider openrouter
HERMES_INFERENCE_MODEL=claude-sonnet-4 hermes -z "Explica este error"
Perfecto para pipelines CI/CD, git hooks y cualquier automatización que necesite una llamada de agente única.
11. Web Dashboard — Pestaña de Modelos
Nueva pestaña de Modelos con análisis detallados por modelo. Configura modelos principales y auxiliares directamente desde el navegador.
12. Rendimiento — Arranque 57% Más Rápido
El tiempo visible de arranque en frío del TUI se redujo a más de la mitad mediante: inicialización diferida del agente, imports perezosos, caché mtime de load_config(), get_tool_definitions() memoizada y patrones de comandos peligrosos precompilados.
13. Enrutamiento Nativo de Imágenes Multimodales
Las imágenes ahora se enrutan según la capacidad visual real del modelo, no los valores predeterminados del proveedor.
14. Paridad Multimedia del Gateway
Envío nativo de múltiples imágenes en Telegram, Discord, Slack, Mattermost, Email y Signal. Enrutamiento de audio centralizado con soporte FLAC.
Nuevas Herramientas y Comandos
| Herramienta / Comando | Descripción | Uso |
|---|---|---|
hermes curator |
Agente de mantenimiento de biblioteca de skills | hermes curator status |
hermes -z |
Modo one-shot no interactivo | hermes -z "<prompt>" |
hermes update --check |
Verificación previa a actualización | hermes update --check |
hermes fallback |
Gestionar cadena de proveedores de respaldo | hermes fallback list |
/busy |
Modo de entrada ocupado (steer/queue) | /busy steer |
/btw |
Alias para /background |
/btw <tarea> |
/reload-skills |
Recargar skills sin reiniciar | /reload-skills |
/reload |
Recargar .env en caliente |
/reload |
/mouse |
Alternar modo ratón (fix WSL2) | /mouse |
TUI — Mejora Importante
- Renderizado LaTeX — expresiones matemáticas nativas
- Estilos de indicador de ocupado plugables
- Auto-reanudación opcional de la última sesión
- Eliminación de sesiones desde
/resumecon teclad - Desplazamiento línea a línea con rueda del ratón
- Edición de cola — eliminar mensajes con ctrl-x, cancelar con esc
- Detección automática ampliada de terminal claro
- Paridad de modo voz con CLI
- Menú de ayuda mini con
?en el campo de entrada - Desactivación proactiva de ratón en ConPTY + comando
/mouse
TTS — Registro de Proveedores Plugable
tts:
providers:
piper: # TTS local — sin necesidad de nube
voice: en_US-lessac-medium
openai: # TTS en la nube
voice: alloy
Piper se distribuye como proveedor TTS local nativo, resolviendo una solicitud comunitaria de larga data para voz sin conexión.
Mejoras
Agente Principal y Arquitectura
- TTL de caché de prompt configurable (
prompt_caching.cache_ttl, 5min por defecto, 1h opcional) child_timeout_secondsde delegado aumentado a 600s- Volcado de diagnóstico cuando subagente expira con 0 llamadas API
- Gateway invalida agente en caché al editar config de compresión/context_length
- Pie de metadatos de runtime opcional en respuestas finales
- Lista blanca
/fastampliada a todos los modelos OpenAI + Anthropic
Compresión
- Reintentar resumen en modelo principal antes de rendirse
- Notificar usuarios cuando el modelo auxiliar falla
/compressbloquea entrada durante compresión
Sesión y Memoria
- Índice FTS5 de trigramas para búsqueda CJK con reparación + migración
tool_name+tool_callsindexados en FTS5- Auto-limpieza de checkpoints huérfanos al inicio
- Proveedores de memoria notificados en rotación de session_id
Plataformas de Mensajería
| Plataforma | Mejora |
|---|---|
| Telegram | Listas blancas de chat; renderizado de tablas markdown; multi-imagen nativo |
| Discord | Toolsets opcionales + inyección de ID + división de herramientas |
| Slack | Comandos slash nativos; config strict_mention; channel_skill_bindings |
| Signal | Formateo markdown nativo; multi-imagen |
Cron
- Respeta configuración de
hermes tools workdirpor tarea — ejecuciones cron conscientes del proyecto- Campo
context_from— encadenar salidas de tareas cron
Navegador
- Supervisor CDP — detección de diálogos + respuesta + eval de iframes cross-origin
- Auto-inicio de Chromium local para URLs LAN/localhost
Código
- Backend Vercel Sandbox para
execute_code/ terminal - Colapsar task_ids de subagentes a contenedor compartido
- Docker: ejecutar contenedor como usuario host
Observabilidad
- Plugin empaquetado Langfuse
- Plugin empaquetado hermes-achievements
Seguridad y Fiabilidad
- Censura de secretos desactivada por defecto — evita corrupción de parches. Activar con
redaction.enabled: true [SYSTEM:→[IMPORTANT:en marcadores inyectados — evita falsos positivos del filtro de contenido de Azure- Lista de bloqueo estricta para comandos irrecuperables
- Helper canónico
mask_secret— censura unificada de secretos - Limpieza programada de subidas paste.rs expiradas
- Preservar enlaces simbólicos durante escrituras atómicas
Correcciones de Bugs Notables
360 PRs de tipo fix: en esta ventana. Destacados:
- Fork de revisión hereda runtime del padre — provider/modelo/credenciales ahora se propagan correctamente
- Razonamiento en streaming persiste en turnos del asistente
- Aislamiento de razonamiento entre proveedores — sin fugas entre DeepSeek/Kimi
croniterpromovido a dependencia principal- Recuperación de compresión — reintento en modelo principal antes de rendirse
- Búsqueda FTS5 — tool_name + tool_calls indexados
- Caché de visión usa HERMES_HOME en lugar de cwd
- Referencias
definitionsde MCP reescritas a$defs— corrige errores 400 - Compatibilidad con filtro de contenido Azure
- Parámetro
limitde Discord convertido a int antes demin()
Eliminado / Revertido
- Tablero Kanban multi-perfil — aterrizó y fue revertido para rediseño
- cua-driver de computer-use — PRs preparatorios aterrizaron y fueron revertidos
- Hook integrado BOOT.md eliminado — reemplazado por tutorial de hooks
- Comandos slash
/provider+/planeliminados flush_memorieseliminado completamente
Actualización
hermes update
Para nuevas instalaciones, consulta la guía de instalación.
← Hermes Agent Changelog