Hermes Agent v0.19.0 — The Quicksilver Release (Lanzamiento Mercurio)
Resumen General
v0.19.0 — The Quicksilver Release. Publicado el 20 de julio de 2026. ~2,245 commits · ~1,065 PRs fusionados · ~2,465 archivos modificados · ~300,000 inserciones · ~36,000 eliminaciones · ~3,300 issues cerrados · más de 450 colaboradores de la comunidad.
Hermes es el dios mensajero, y en esta ventana lo hicimos moverse como tal. The Quicksilver Release se construye sobre una sola convicción: un agente autónomo que se siente lento es un agente que no usarás. El time-to-first-token del primer turno se redujo ~80% en todas las plataformas — cold start de ~4.3s a ~0.9s. Los modelos de razonamiento transmiten su pensamiento en vivo por defecto. La aplicación de escritorio recibió más de 20 PRs de rendimiento específicos (markdown en streaming 14× más rápido, diffs virtualizados, cambio de sesión instantáneo). El TUI renderiza markdown de forma incremental.
Alrededor de esa columna vertebral de velocidad se encuentra un lanzamiento repleto de capacidades: facturación desde terminal (/subscription y /topup), integración con gestores de contraseñas (Bitwarden y 1Password), aprobaciones inteligentes (comandos revisados por LLM por defecto), ventanas de observación de subagentes en vivo, un libro mayor de entrega duradera que sobrevive a fallos del gateway, y enrutamiento de mensajes basado en perfiles para despliegues multi-tenant. Nuevos proveedores (Fireworks AI, DeepInfra) y los últimos modelos de frontera (GPT-5.6, grok-4.5, kimi-k3, Claude Sonnet 5) completan el catálogo.
Este lanzamiento también incluye todo el contenido de los parches de infraestructura v0.18.1 y v0.18.2 — esas ventanas están completamente documentadas aquí.
Puntos Destacados
1. Hermes Se Volvió Dramáticamente Más Rápido — Primer Token en una Fracción del Tiempo
La fase de cold start “Initializing agent…” solía consumir ~4.3 segundos antes de que tu primer turno llegara siquiera al modelo. Ahora es ~0.9s — una reducción de ~80% que aplica al CLI, gateway, TUI, escritorio y cron por igual.
Qué cambió bajo el capó:
- La detección de capacidades de Discord se movió fuera de la ruta crítica con una caché en disco de 24 horas con clave por token, más actualización en segundo plano
- Sondeo de Ollama omitido para proveedores que no son Ollama
- Trabajo bloqueante de inicialización del agente eliminado de la ruta de cold start
- Caché de construcción de prompts y resolución de zona horaria con caché mtime
La segunda ronda de latencia percibida atacó lo que ves mientras esperas:
display.show_reasoningahora está ACTIVADO por defecto — los modelos de razonamiento transmiten su pensamiento en vivo en lugar de mostrar un spinner durante más de 30 segundos- El cuadro de respuesta se pinta por token en lugar de por línea, con force-flush consciente del ancho
- Los lotes de herramientas mixtas ahora se segmentan para recuperar la concurrencia perdida
- La re-serialización base64 por llamada se eliminó de las estimaciones de tamaño de solicitud
Si alguna vez sentiste que Hermes tomaba un respiro profundo antes de responder, ese respiro ya no existe.
2. Ola de Velocidad en la App de Escritorio — Más de 20 PRs de Rendimiento Específicos
@OutThisLife lideró una revisión de rendimiento enfocada que hace que la app de escritorio se sienta nativa bajo carga, incluso con transcripciones masivas y agentes ocupados.
| Área | Mejora |
|---|---|
| Streaming de markdown | 14× menos CPU mediante lexeo incremental por bloques |
| Renderizado de diffs | Diffs virtualizados en el panel de revisión — sin más congelamiento por Shiki completo en archivos enormes |
| Cambio de sesión | Cambio instantáneo incluso con conversaciones enormes, cascada de layout-thrash eliminada |
| Inicio | Reducción de serialización + amplificación REST por turno eliminada; backends de perfil se precalientan al pasar el cursor |
| Paneles ocultos al arranque | Se montan en tiempo inactivo en lugar de en la ruta crítica de cold start |
| Re-renderizados por token | La barra lateral y las filas de herramientas ya no se re-renderizan durante el streaming; eliminado el JSON.stringify ansioso de argumentos/resultados de herramientas |
| Perfilado | Sistema de benchmarks de rendimiento sistematizado que reemplaza 12 scripts únicos |
El efecto neto: la experiencia de escritorio de Hermes más rápida y fluida de la historia.
3. Gestiona Tu Plan Nous Desde la Terminal — /subscription y /topup
Cambiar tu suscripción solía significar ir al sitio web de facturación. Ahora vive directamente en la terminal:
# Abre el flujo completo de suscripción en TUI o CLI clásico
/subscription
# Lo que ves:
# - Plan actual y asignación restante
# - Vista previa de upgrade: "Pay $46.30 & upgrade now"
# - Fecha efectiva de downgrade: "Downgrade takes effect on Aug 1"
# - Banners de cambio programado con opción de deshacer
# Recarga tu cuenta
/topup
La app de escritorio recibió una pestaña de configuración de facturación equivalente. Tu billetera nunca tiene que abandonar el teclado.
4. Aprobaciones Inteligentes — Comandos Revisados por LLM por Defecto
Cuando Hermes quiere ejecutar un comando marcado, un revisor LLM ahora lo evalúa de forma independiente en lugar de pedirte que apruebes cada uno. Cada veredicto cubre solo ese comando exacto — un comando posterior que coincida con el mismo patrón recibe su propia revisión nueva.
El flujo de decisión:
- Seguro → aprobado automáticamente, sin interrupción
- Peligroso → denegado automáticamente, con razón registrada
- Incierto → escalado al usuario para decisión manual
Combinado con reglas de denegación definidas por el usuario (que bloquean comandos incluso en modo yolo) y /deny <razón> (que le dice al agente por qué lo rechazaste para que corrija el rumbo), la fatiga de aprobación diaria se reduce drásticamente sin renunciar al control.
# Denegar con una razón — el agente aprende de tu rechazo
/deny that would delete the production database
# Definir reglas de denegación en la configuración que bloquean incluso en modo yolo
deny_rules:
- pattern: "rm -rf /"
reason: "Never delete root"
- pattern: "DROP (DATABASE|TABLE)"
reason: "Database operations require manual review"
5. Integración con Gestores de Contraseñas — Fuentes de Secretos Bitwarden y 1Password
Las claves de API ya no necesitan vivir en un archivo .env en texto plano. Una nueva interfaz SecretSource conectable permite a Hermes obtener secretos de Bitwarden y 1Password (referencias op://) en tiempo de carga.
# hermes.config.yaml
secret_sources:
- provider: bitwarden
vault: "dev-creds"
priority: 1
- provider: onepassword
vault: "Production"
priority: 2
# Referencias op:// resueltas en tiempo de carga:
# op://Production/OpenAI/credential → OPENAI_API_KEY
Decisiones clave de diseño:
- Múltiples bóvedas habilitadas simultáneamente con precedencia determinista
- Advertencias de conflicto cuando dos fuentes proporcionan la misma variable
- Seguimiento de procedencia por variable — siempre sabes de dónde vino un secreto
- Se consolidaron once PRs de la comunidad en competencia en una sola interfaz orquestada
- Futuros proveedores de bóvedas (HashiCorp Vault, AWS Secrets Manager, etc.) se integran como plugins
6. Observa a Tus Subagentes Trabajar — Transcripciones en Vivo + Delegación Duradera en Segundo Plano
Los subagentes delegados ya no son trabajadores invisibles que desaparecen detrás de un spinner.
# delegate_task ahora devuelve archivos de transcripción en vivo
/delegate_task "Research competitors A, B, C in parallel"
# Observa cualquier subagente en vivo desde otra terminal
tail -f /tmp/hermes-delegate-abc123.log
# Cada llamada de herramienta, resultado y respuesta transmitida — un registro legible por hijo
Delegación duradera en segundo plano significa que si el proceso se reinicia a mitad de ejecución, los resultados se restauran y entregan a través de un libro mayor con verificación de propiedad en lugar de desaparecer. Despliega una flota, observa a cualquier trabajador en vivo y nunca pierdas los resultados.
7. Libro Mayor de Obligación de Entrega — Respuestas a Prueba de Fallos
Si el gateway moría entre generar tu respuesta y confirmar que la plataforma realmente la entregó, esa respuesta solía desaparecer silenciosamente — y tú habías pagado por el turno. Ya no.
Las respuestas finales ahora se registran en un libro mayor duradero en state.db alrededor del envío a la plataforma y se reentregan en el siguiente arranque. Esto cierra una ventana P1 de pérdida silenciosa para Telegram, Discord, Slack y cualquier otro canal de mensajería. Una respuesta terminada ya no puede perderse.
8. Un Gateway, Múltiples Perfiles — Enrutamiento de Mensajes Basado en Perfiles
Un solo gateway multiplexado que comparte un token de bot ahora puede enrutar gremios, canales o hilos específicos a diferentes perfiles — cada uno con configuración, habilidades, memoria y secretos completamente aislados.
# Apunta tu servidor de Discord del trabajo al perfil 'work'
# y tu servidor de hobby al perfil 'personal' — desde un solo bot
gateway:
multiplex_profiles:
- profile: work
discord:
guilds: ["123456789"]
channels: ["987654321"]
- profile: personal
discord:
guilds: ["111111111"]
Una segunda ola de hardening de multiplexación significa que un perfil mal configurado ya no puede tumbar todo el gateway.
9. Nuevos Proveedores y Modelos de Frontera
| Adición | Detalles |
|---|---|
| Fireworks AI | Proveedor de primera clase con estimación de costos, promovido al #2 en los selectores de proveedores |
| DeepInfra | Integración reforzada con cableado completo del catálogo |
| Upstage Solar | Nuevo proveedor mediante rescate comunitario |
| GPT-5.6 | Variantes Sol/Terra/Luna + Pro, cableado de extremo a extremo en cada ruta |
| grok-4.5 | Entrada de catálogo GA con lista blanca de razonamiento |
| kimi-k3 | Despliegue completo en Nous Portal, OpenRouter y endpoints de Kimi Coding; kimi-k2.x retirado |
| Claude Sonnet 5 | Catálogo curado, precios de introducción, metadatos en cada ruta |
| Claude Fable 5 | Curado junto a Sonnet 5 |
| LM Studio | Carga de modelos JIT para configuraciones locales |
| Ola de catálogo Bedrock | Sondeo real de ventana de contexto desde endpoint en vivo; filas de contexto de 1M para Claude + Fable de generación actual |
Ahora puedes ocultar proveedores que no uses con enabled: false por proveedor o excluded_providers para eliminar entradas no deseadas de los selectores /model.
10. Esfuerzo de Razonamiento — Niveles max y ultra
El razonamiento ahora es un dial, no un interruptor global:
# CLI: control de razonamiento con alcance de sesión
/reasoning # selector interactivo: off → low → medium → high → max → ultra
# Anulaciones por modelo en la configuración
reasoning:
models:
"gpt-5.6-sol": ultra
"claude-sonnet-5": max
# Esfuerzo por slot en presets MoA — los asesores piensan a fondo, el sintetizador se mantiene rápido
moa:
presets:
deep-council:
references:
- model: gpt-5.6-sol
reasoning_effort: max
- model: claude-sonnet-5
reasoning_effort: max
aggregator:
model: gpt-5.6-luna
reasoning_effort: medium
Los niveles superiores de GPT-5.6 y Codex son totalmente compatibles con limitación sensata en proveedores con escalas más pequeñas. Control de esfuerzo por modelo, por tarea y por slot MoA en todo el sistema.
Rendimiento — La Columna Vertebral de Velocidad
Latencia del Primer Turno (Todas las Plataformas)
- ~80% de reducción en TTFT: cold submit→dispatch ~4.3s → ~0.9s en CLI, gateway, TUI, escritorio y cron
- Streaming de razonamiento ACTIVADO por defecto: observa al modelo pensar en lugar de mirar un spinner
- Pintado de respuesta por token con force-flush consciente del ancho
- Caché de construcción de prompts y resolución de zona horaria con caché mtime
- Lotes de herramientas mixtas segmentados para recuperar concurrencia perdida
Ola de Velocidad en Escritorio
- 14× menos CPU en el splitter mediante lexeo incremental por bloques para streaming de markdown
- Diffs virtualizados en el panel de revisión — sin más congelamiento por Shiki completo
- Cambio de sesión instantáneo en transcripciones grandes, cascada de layout-thrash eliminada
- Optimización de inicio: reducción de serialización, amplificación REST por turno eliminada
- Backends de perfil se precalientan al pasar el cursor; paneles ocultos se montan en tiempo inactivo
- Eliminación de re-renderizado por token: barra lateral + filas de herramientas dejan de re-renderizarse durante el streaming
- Sistema de benchmarks de rendimiento sistematizado
En Todas Partes
- TUI renderiza markdown transmitido incrementalmente por bloque
- Descubrimiento de habilidades cacheado por firma de escaneo; construcción de manifiesto instantáneo ~5× más rápida
- Preparación de mensajes copy-on-write en lugar de deepcopy completo
- Clúster de caché de sondeo de metadatos de modelos para cambio de modelo más rápido
- Gateway: system prompts estables en bytes mantienen viva la caché de prompts entre turnos
hermes updateomite npm install cuando los manifiestos de Node no han cambiado
Funcionalidades Principales
Gateway, Flota y Relay
Libro mayor de obligación de entrega duradera — respuestas finales registradas en state.db y reentregadas en el siguiente arranque si el gateway falla antes de la confirmación de la plataforma.
Enrutamiento basado en perfiles — un token de bot, múltiples perfiles. Enruta gremios/canales específicos de Discord, chats de Telegram o espacios de trabajo de Slack a diferentes perfiles con configuración, habilidades, memoria y secretos aislados.
Turn lease por sesión — previene el procesamiento duplicado del mismo mensaje. Embudo de alcance de conversación y límites unificados de reinicio de sesión.
Madurez del relay — aprovisionamiento genérico de credenciales de cliente OIDC (sin NAS), perfiles enrutados transportados desde la fuente de conexión, contexto de canal consumido desde el conector, forense de autenticación Nous con nous_session_valid en /api/status para auto-reparación en hosted.
Plataformas de Mensajería
| Plataforma | Actualizaciones Clave |
|---|---|
| Telegram, Discord, Matrix | Selectores de opciones en línea para /reasoning y /fast — botones nativos de un toque |
| Encuestas nativas Baileys (clarify se renderiza como encuesta), ubicaciones, metadatos entrantes enriquecidos, flujo de emparejamiento por dashboard | |
| Discord | Recuperación de mensajes perdidos durante la reconexión; hilos auto-creados renombrados a títulos de sesión; timeout configurable de vista interactiva; menciones opcionales del propietario en avisos de aprobación de ejecución |
| Slack | Línea de estado por herramienta en vivo durante la ejecución del agente |
| Telegram | Lista blanca de respuesta libre por tema |
| Google Chat | Avisos de clarificación renderizados como tarjetas |
| Voz | Opción stt.echo_transcripts; subtítulos MEDIA en envíos independientes |
App de Escritorio
- Arquitectura de shell dirigida por contribuciones sobre un modelo de árbol de layout — paneles, zonas y layouts como datos
- Página de capacidades: Skills/Tools/MCP + Hub en un solo lugar con navegación overlay responsive
- Modo de conexión Hermes Cloud con cambio suave de gateway y ajustes de gateway pulidos
- Tooltips de atajos de teclado + pestaña de configuración de atajos + diálogo unificado de worktree
- Sistema de color de sesión + proyecto — hereda del proyecto, anulación por sesión, compartido en barra lateral/pestañas
- Panel declarativo de proveedor de memoria + modal de configuración completa
- Proveedores TTS/STT definidos por configuración con parámetros TTS de xAI
- Configuración de escala de UI, zoom con Ctrl/Cmd+rueda, toggle de fondo de chat
- Conversión completa a TypeScript del árbol de escritorio
CLI y TUI
/model --once— anulación de modelo por un turno que revierte automáticamente- Invocaciones apiladas de slash-skills —
/skill-a /skill-b do XYZcarga ambas habilidades en orden - Flag de resolución de problemas
--safe-mode; simulación de desinstalación; fallos TLS fallan rápido con sugerencias de solución - Alias
/compact+ flags de vista previa - Hermes Console REPL con seguimiento de rendimiento
- TUI: soporte de actualización del selector de modelos; bundles de habilidades personalizadas despachados como turnos de agente
Sistema de Herramientas, Habilidades y MCP
- MCP: convención de nombres
mcp__server__tool; notificaciones de registro del servidor en agent.log; OAuth hosted completado en Dashboard + Escritorio;redirect_uri/redirect_hostconfigurables para configuraciones con proxy/WAF - Habilidades:
security/unbroker(eliminación autónoma de data brokers);blender-mcpreelaborado alrededor de entrada de catálogo; habilidad complementariaunreal-mcp; expansión de patrones humanizadores - Navegador: capturas de pantalla completas almacenadas en truncamiento; lista de denegación de eval opcional
- Kanban: diálogo modal de creación de tareas + directorio de proyecto de tablero editable; desplazamiento del tablero con arrastrar para mover; conjunto de herramientas de adjuntos + CLI con fetch de URL protegido contra SSRF
- Cron: historial de auditoría de ejecución duradera; condición de carrera de eliminación de tareas obsoletas de un solo disparo corregida; TTL de reclamación de ejecución derivado de
HERMES_CRON_TIMEOUT
Sesiones y Exportación de Datos
# Exportar sesiones en múltiples formatos
hermes sessions export --format markdown
hermes sessions export --format html
hermes sessions export --format quarto
hermes sessions export --format prompt-only
hermes sessions export --format hf-trace # Listo para Hugging Face
# Con redacción de secretos
hermes sessions export --redact
# Filtrar por antigüedad, espacio de trabajo, plataforma
hermes sessions export --older-than 30d --workspace my-project
Tu historial de conversaciones ahora es un conjunto de datos real, no una caja negra.
Secretos y Configuración
- Interfaz
SecretSourceconectable con proveedores Bitwarden y 1Password - Comandos
hermes config get/unsetpara gestión de configuración - Advertencias de claves de configuración raíz desconocidas + reporte de claves obsoletas en doctor
- Uso de modelos auxiliares registrado por tarea en la contabilidad de sesión
- Etiquetas de uso de Nous Portal con alcance de conversación en llamadas aux/MoA/delegate
Mejoras en MoA
reference_max_tokenspara limitar la salida del asesor y reducir latencia- Cadencia de despliegue por preset —
user_turnejecuta asesores una vez por turno de usuario - Presets obsoletos mostrados sin reintentos; guardados de presets medio llenos rechazados en el límite de la API
- El agregador resuelve el razonamiento como un modelo en funciones
Seguridad y Fiabilidad
Endurecimiento de la Superficie de Credenciales
- Credenciales de Vertex aisladas del entorno de subprocesos y a través de ámbitos de secretos de perfil
- Seis PRs de endurecimiento P1 rescatados en una sola pasada — guardias de navegador, anclaje MEDIA, bloqueo de .env, transporte ACP de delegado
- Lecturas de archivos locales de medios/visión/generación de imágenes enrutadas a través de un guardia de lectura de credenciales compartido
- Barrido de límite de cuerpo de webhook en cada servidor aiohttp
- Redacción de token de bot en errores de transporte de Telegram
- Prefijos de token de Fireworks añadidos al redactor
- CI endurecido contra interpolación de referencias no confiables
Redacción y Valores Predeterminados Seguros
- Falsos positivos de búsqueda de variables de entorno corregidos para campos
KEY=valuey JSON/YAML - Tokens de bot eliminados de errores de conexión/envío de Telegram
- Entorno de subprocesos de
computer_usesaneado en los cinco sitios de spawn del driver cua
Fiabilidad del Gateway y Agente
tool_call_iddeduplicado en los saneadores pre-API- La revisión en segundo plano hereda el reasoning_config del padre para paridad de caché de Anthropic
- Clientes locales por solicitud de Anthropic para que el watchdog de inactividad/interrupción nunca corrompa SQLite
- Error 429 de inicio de sesión OAuth corregido — UA no debe ser
claude-code/
Seguridad del Dashboard
- Guardia de credenciales de archivos gestionados ampliado más allá de
.env+ brecha de árbol de directorios cerrada - TOCTOU de token OAuth cerrado con escrituras atómicas
0o600 - Dashboards obsoletos no pueden recrear perfiles eliminados
Revertido en Esta Ventana
- Firewall de egreso de inyección de credenciales iron-proxy — revertido, no se publica
- Habilidad de orquestación de flujo de trabajo dinámico — incorporada, luego revertida
- Punto de extensión de acciones del proveedor de memoria — incorporado, luego revertido
- Nota: la escalación de aprobación
pre_tool_calldel plugin fue revertida a mitad de ventana pero reincorporada y se publica en este lanzamiento
Actualización
hermes update
Para nuevas instalaciones:
# macOS / Linux / WSL2
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash
# Windows (PowerShell)
iex (irm https://hermes-agent.nousresearch.com/install.ps1)
← Hermes Agent Changelog