v0.19.0

Hermes Agent v0.19.0 — The Quicksilver Release (Lanzamiento Mercurio)


Resumen General

v0.19.0 — The Quicksilver Release. Publicado el 20 de julio de 2026. ~2,245 commits · ~1,065 PRs fusionados · ~2,465 archivos modificados · ~300,000 inserciones · ~36,000 eliminaciones · ~3,300 issues cerrados · más de 450 colaboradores de la comunidad.

Hermes es el dios mensajero, y en esta ventana lo hicimos moverse como tal. The Quicksilver Release se construye sobre una sola convicción: un agente autónomo que se siente lento es un agente que no usarás. El time-to-first-token del primer turno se redujo ~80% en todas las plataformas — cold start de ~4.3s a ~0.9s. Los modelos de razonamiento transmiten su pensamiento en vivo por defecto. La aplicación de escritorio recibió más de 20 PRs de rendimiento específicos (markdown en streaming 14× más rápido, diffs virtualizados, cambio de sesión instantáneo). El TUI renderiza markdown de forma incremental.

Alrededor de esa columna vertebral de velocidad se encuentra un lanzamiento repleto de capacidades: facturación desde terminal (/subscription y /topup), integración con gestores de contraseñas (Bitwarden y 1Password), aprobaciones inteligentes (comandos revisados por LLM por defecto), ventanas de observación de subagentes en vivo, un libro mayor de entrega duradera que sobrevive a fallos del gateway, y enrutamiento de mensajes basado en perfiles para despliegues multi-tenant. Nuevos proveedores (Fireworks AI, DeepInfra) y los últimos modelos de frontera (GPT-5.6, grok-4.5, kimi-k3, Claude Sonnet 5) completan el catálogo.

Este lanzamiento también incluye todo el contenido de los parches de infraestructura v0.18.1 y v0.18.2 — esas ventanas están completamente documentadas aquí.


Puntos Destacados

1. Hermes Se Volvió Dramáticamente Más Rápido — Primer Token en una Fracción del Tiempo

La fase de cold start “Initializing agent…” solía consumir ~4.3 segundos antes de que tu primer turno llegara siquiera al modelo. Ahora es ~0.9s — una reducción de ~80% que aplica al CLI, gateway, TUI, escritorio y cron por igual.

Qué cambió bajo el capó:

  • La detección de capacidades de Discord se movió fuera de la ruta crítica con una caché en disco de 24 horas con clave por token, más actualización en segundo plano
  • Sondeo de Ollama omitido para proveedores que no son Ollama
  • Trabajo bloqueante de inicialización del agente eliminado de la ruta de cold start
  • Caché de construcción de prompts y resolución de zona horaria con caché mtime

La segunda ronda de latencia percibida atacó lo que ves mientras esperas:

  • display.show_reasoning ahora está ACTIVADO por defecto — los modelos de razonamiento transmiten su pensamiento en vivo en lugar de mostrar un spinner durante más de 30 segundos
  • El cuadro de respuesta se pinta por token en lugar de por línea, con force-flush consciente del ancho
  • Los lotes de herramientas mixtas ahora se segmentan para recuperar la concurrencia perdida
  • La re-serialización base64 por llamada se eliminó de las estimaciones de tamaño de solicitud

Si alguna vez sentiste que Hermes tomaba un respiro profundo antes de responder, ese respiro ya no existe.

2. Ola de Velocidad en la App de Escritorio — Más de 20 PRs de Rendimiento Específicos

@OutThisLife lideró una revisión de rendimiento enfocada que hace que la app de escritorio se sienta nativa bajo carga, incluso con transcripciones masivas y agentes ocupados.

Área Mejora
Streaming de markdown 14× menos CPU mediante lexeo incremental por bloques
Renderizado de diffs Diffs virtualizados en el panel de revisión — sin más congelamiento por Shiki completo en archivos enormes
Cambio de sesión Cambio instantáneo incluso con conversaciones enormes, cascada de layout-thrash eliminada
Inicio Reducción de serialización + amplificación REST por turno eliminada; backends de perfil se precalientan al pasar el cursor
Paneles ocultos al arranque Se montan en tiempo inactivo en lugar de en la ruta crítica de cold start
Re-renderizados por token La barra lateral y las filas de herramientas ya no se re-renderizan durante el streaming; eliminado el JSON.stringify ansioso de argumentos/resultados de herramientas
Perfilado Sistema de benchmarks de rendimiento sistematizado que reemplaza 12 scripts únicos

El efecto neto: la experiencia de escritorio de Hermes más rápida y fluida de la historia.

3. Gestiona Tu Plan Nous Desde la Terminal — /subscription y /topup

Cambiar tu suscripción solía significar ir al sitio web de facturación. Ahora vive directamente en la terminal:

# Abre el flujo completo de suscripción en TUI o CLI clásico
/subscription

# Lo que ves:
# - Plan actual y asignación restante
# - Vista previa de upgrade: "Pay $46.30 & upgrade now"
# - Fecha efectiva de downgrade: "Downgrade takes effect on Aug 1"
# - Banners de cambio programado con opción de deshacer

# Recarga tu cuenta
/topup

La app de escritorio recibió una pestaña de configuración de facturación equivalente. Tu billetera nunca tiene que abandonar el teclado.

4. Aprobaciones Inteligentes — Comandos Revisados por LLM por Defecto

Cuando Hermes quiere ejecutar un comando marcado, un revisor LLM ahora lo evalúa de forma independiente en lugar de pedirte que apruebes cada uno. Cada veredicto cubre solo ese comando exacto — un comando posterior que coincida con el mismo patrón recibe su propia revisión nueva.

El flujo de decisión:

  • Seguro → aprobado automáticamente, sin interrupción
  • Peligroso → denegado automáticamente, con razón registrada
  • Incierto → escalado al usuario para decisión manual

Combinado con reglas de denegación definidas por el usuario (que bloquean comandos incluso en modo yolo) y /deny <razón> (que le dice al agente por qué lo rechazaste para que corrija el rumbo), la fatiga de aprobación diaria se reduce drásticamente sin renunciar al control.

# Denegar con una razón — el agente aprende de tu rechazo
/deny that would delete the production database

# Definir reglas de denegación en la configuración que bloquean incluso en modo yolo
deny_rules:
  - pattern: "rm -rf /"
    reason: "Never delete root"
  - pattern: "DROP (DATABASE|TABLE)"
    reason: "Database operations require manual review"

5. Integración con Gestores de Contraseñas — Fuentes de Secretos Bitwarden y 1Password

Las claves de API ya no necesitan vivir en un archivo .env en texto plano. Una nueva interfaz SecretSource conectable permite a Hermes obtener secretos de Bitwarden y 1Password (referencias op://) en tiempo de carga.

# hermes.config.yaml
secret_sources:
  - provider: bitwarden
    vault: "dev-creds"
    priority: 1

  - provider: onepassword
    vault: "Production"
    priority: 2
    # Referencias op:// resueltas en tiempo de carga:
    # op://Production/OpenAI/credential → OPENAI_API_KEY

Decisiones clave de diseño:

  • Múltiples bóvedas habilitadas simultáneamente con precedencia determinista
  • Advertencias de conflicto cuando dos fuentes proporcionan la misma variable
  • Seguimiento de procedencia por variable — siempre sabes de dónde vino un secreto
  • Se consolidaron once PRs de la comunidad en competencia en una sola interfaz orquestada
  • Futuros proveedores de bóvedas (HashiCorp Vault, AWS Secrets Manager, etc.) se integran como plugins

6. Observa a Tus Subagentes Trabajar — Transcripciones en Vivo + Delegación Duradera en Segundo Plano

Los subagentes delegados ya no son trabajadores invisibles que desaparecen detrás de un spinner.

# delegate_task ahora devuelve archivos de transcripción en vivo
/delegate_task "Research competitors A, B, C in parallel"

# Observa cualquier subagente en vivo desde otra terminal
tail -f /tmp/hermes-delegate-abc123.log
# Cada llamada de herramienta, resultado y respuesta transmitida — un registro legible por hijo

Delegación duradera en segundo plano significa que si el proceso se reinicia a mitad de ejecución, los resultados se restauran y entregan a través de un libro mayor con verificación de propiedad en lugar de desaparecer. Despliega una flota, observa a cualquier trabajador en vivo y nunca pierdas los resultados.

7. Libro Mayor de Obligación de Entrega — Respuestas a Prueba de Fallos

Si el gateway moría entre generar tu respuesta y confirmar que la plataforma realmente la entregó, esa respuesta solía desaparecer silenciosamente — y tú habías pagado por el turno. Ya no.

Las respuestas finales ahora se registran en un libro mayor duradero en state.db alrededor del envío a la plataforma y se reentregan en el siguiente arranque. Esto cierra una ventana P1 de pérdida silenciosa para Telegram, Discord, Slack y cualquier otro canal de mensajería. Una respuesta terminada ya no puede perderse.

8. Un Gateway, Múltiples Perfiles — Enrutamiento de Mensajes Basado en Perfiles

Un solo gateway multiplexado que comparte un token de bot ahora puede enrutar gremios, canales o hilos específicos a diferentes perfiles — cada uno con configuración, habilidades, memoria y secretos completamente aislados.

# Apunta tu servidor de Discord del trabajo al perfil 'work'
# y tu servidor de hobby al perfil 'personal' — desde un solo bot
gateway:
  multiplex_profiles:
    - profile: work
      discord:
        guilds: ["123456789"]
        channels: ["987654321"]
    - profile: personal
      discord:
        guilds: ["111111111"]

Una segunda ola de hardening de multiplexación significa que un perfil mal configurado ya no puede tumbar todo el gateway.

9. Nuevos Proveedores y Modelos de Frontera

Adición Detalles
Fireworks AI Proveedor de primera clase con estimación de costos, promovido al #2 en los selectores de proveedores
DeepInfra Integración reforzada con cableado completo del catálogo
Upstage Solar Nuevo proveedor mediante rescate comunitario
GPT-5.6 Variantes Sol/Terra/Luna + Pro, cableado de extremo a extremo en cada ruta
grok-4.5 Entrada de catálogo GA con lista blanca de razonamiento
kimi-k3 Despliegue completo en Nous Portal, OpenRouter y endpoints de Kimi Coding; kimi-k2.x retirado
Claude Sonnet 5 Catálogo curado, precios de introducción, metadatos en cada ruta
Claude Fable 5 Curado junto a Sonnet 5
LM Studio Carga de modelos JIT para configuraciones locales
Ola de catálogo Bedrock Sondeo real de ventana de contexto desde endpoint en vivo; filas de contexto de 1M para Claude + Fable de generación actual

Ahora puedes ocultar proveedores que no uses con enabled: false por proveedor o excluded_providers para eliminar entradas no deseadas de los selectores /model.

10. Esfuerzo de Razonamiento — Niveles max y ultra

El razonamiento ahora es un dial, no un interruptor global:

# CLI: control de razonamiento con alcance de sesión
/reasoning  # selector interactivo: off → low → medium → high → max → ultra

# Anulaciones por modelo en la configuración
reasoning:
  models:
    "gpt-5.6-sol": ultra
    "claude-sonnet-5": max

# Esfuerzo por slot en presets MoA — los asesores piensan a fondo, el sintetizador se mantiene rápido
moa:
  presets:
    deep-council:
      references:
        - model: gpt-5.6-sol
          reasoning_effort: max
        - model: claude-sonnet-5
          reasoning_effort: max
      aggregator:
        model: gpt-5.6-luna
        reasoning_effort: medium

Los niveles superiores de GPT-5.6 y Codex son totalmente compatibles con limitación sensata en proveedores con escalas más pequeñas. Control de esfuerzo por modelo, por tarea y por slot MoA en todo el sistema.


Rendimiento — La Columna Vertebral de Velocidad

Latencia del Primer Turno (Todas las Plataformas)

  • ~80% de reducción en TTFT: cold submit→dispatch ~4.3s → ~0.9s en CLI, gateway, TUI, escritorio y cron
  • Streaming de razonamiento ACTIVADO por defecto: observa al modelo pensar en lugar de mirar un spinner
  • Pintado de respuesta por token con force-flush consciente del ancho
  • Caché de construcción de prompts y resolución de zona horaria con caché mtime
  • Lotes de herramientas mixtas segmentados para recuperar concurrencia perdida

Ola de Velocidad en Escritorio

  • 14× menos CPU en el splitter mediante lexeo incremental por bloques para streaming de markdown
  • Diffs virtualizados en el panel de revisión — sin más congelamiento por Shiki completo
  • Cambio de sesión instantáneo en transcripciones grandes, cascada de layout-thrash eliminada
  • Optimización de inicio: reducción de serialización, amplificación REST por turno eliminada
  • Backends de perfil se precalientan al pasar el cursor; paneles ocultos se montan en tiempo inactivo
  • Eliminación de re-renderizado por token: barra lateral + filas de herramientas dejan de re-renderizarse durante el streaming
  • Sistema de benchmarks de rendimiento sistematizado

En Todas Partes

  • TUI renderiza markdown transmitido incrementalmente por bloque
  • Descubrimiento de habilidades cacheado por firma de escaneo; construcción de manifiesto instantáneo ~5× más rápida
  • Preparación de mensajes copy-on-write en lugar de deepcopy completo
  • Clúster de caché de sondeo de metadatos de modelos para cambio de modelo más rápido
  • Gateway: system prompts estables en bytes mantienen viva la caché de prompts entre turnos
  • hermes update omite npm install cuando los manifiestos de Node no han cambiado

Funcionalidades Principales

Gateway, Flota y Relay

Libro mayor de obligación de entrega duradera — respuestas finales registradas en state.db y reentregadas en el siguiente arranque si el gateway falla antes de la confirmación de la plataforma.

Enrutamiento basado en perfiles — un token de bot, múltiples perfiles. Enruta gremios/canales específicos de Discord, chats de Telegram o espacios de trabajo de Slack a diferentes perfiles con configuración, habilidades, memoria y secretos aislados.

Turn lease por sesión — previene el procesamiento duplicado del mismo mensaje. Embudo de alcance de conversación y límites unificados de reinicio de sesión.

Madurez del relay — aprovisionamiento genérico de credenciales de cliente OIDC (sin NAS), perfiles enrutados transportados desde la fuente de conexión, contexto de canal consumido desde el conector, forense de autenticación Nous con nous_session_valid en /api/status para auto-reparación en hosted.

Plataformas de Mensajería

Plataforma Actualizaciones Clave
Telegram, Discord, Matrix Selectores de opciones en línea para /reasoning y /fast — botones nativos de un toque
WhatsApp Encuestas nativas Baileys (clarify se renderiza como encuesta), ubicaciones, metadatos entrantes enriquecidos, flujo de emparejamiento por dashboard
Discord Recuperación de mensajes perdidos durante la reconexión; hilos auto-creados renombrados a títulos de sesión; timeout configurable de vista interactiva; menciones opcionales del propietario en avisos de aprobación de ejecución
Slack Línea de estado por herramienta en vivo durante la ejecución del agente
Telegram Lista blanca de respuesta libre por tema
Google Chat Avisos de clarificación renderizados como tarjetas
Voz Opción stt.echo_transcripts; subtítulos MEDIA en envíos independientes

App de Escritorio

  • Arquitectura de shell dirigida por contribuciones sobre un modelo de árbol de layout — paneles, zonas y layouts como datos
  • Página de capacidades: Skills/Tools/MCP + Hub en un solo lugar con navegación overlay responsive
  • Modo de conexión Hermes Cloud con cambio suave de gateway y ajustes de gateway pulidos
  • Tooltips de atajos de teclado + pestaña de configuración de atajos + diálogo unificado de worktree
  • Sistema de color de sesión + proyecto — hereda del proyecto, anulación por sesión, compartido en barra lateral/pestañas
  • Panel declarativo de proveedor de memoria + modal de configuración completa
  • Proveedores TTS/STT definidos por configuración con parámetros TTS de xAI
  • Configuración de escala de UI, zoom con Ctrl/Cmd+rueda, toggle de fondo de chat
  • Conversión completa a TypeScript del árbol de escritorio

CLI y TUI

  • /model --once — anulación de modelo por un turno que revierte automáticamente
  • Invocaciones apiladas de slash-skills/skill-a /skill-b do XYZ carga ambas habilidades en orden
  • Flag de resolución de problemas --safe-mode; simulación de desinstalación; fallos TLS fallan rápido con sugerencias de solución
  • Alias /compact + flags de vista previa
  • Hermes Console REPL con seguimiento de rendimiento
  • TUI: soporte de actualización del selector de modelos; bundles de habilidades personalizadas despachados como turnos de agente

Sistema de Herramientas, Habilidades y MCP

  • MCP: convención de nombres mcp__server__tool; notificaciones de registro del servidor en agent.log; OAuth hosted completado en Dashboard + Escritorio; redirect_uri/redirect_host configurables para configuraciones con proxy/WAF
  • Habilidades: security/unbroker (eliminación autónoma de data brokers); blender-mcp reelaborado alrededor de entrada de catálogo; habilidad complementaria unreal-mcp; expansión de patrones humanizadores
  • Navegador: capturas de pantalla completas almacenadas en truncamiento; lista de denegación de eval opcional
  • Kanban: diálogo modal de creación de tareas + directorio de proyecto de tablero editable; desplazamiento del tablero con arrastrar para mover; conjunto de herramientas de adjuntos + CLI con fetch de URL protegido contra SSRF
  • Cron: historial de auditoría de ejecución duradera; condición de carrera de eliminación de tareas obsoletas de un solo disparo corregida; TTL de reclamación de ejecución derivado de HERMES_CRON_TIMEOUT

Sesiones y Exportación de Datos

# Exportar sesiones en múltiples formatos
hermes sessions export --format markdown
hermes sessions export --format html
hermes sessions export --format quarto
hermes sessions export --format prompt-only
hermes sessions export --format hf-trace  # Listo para Hugging Face

# Con redacción de secretos
hermes sessions export --redact

# Filtrar por antigüedad, espacio de trabajo, plataforma
hermes sessions export --older-than 30d --workspace my-project

Tu historial de conversaciones ahora es un conjunto de datos real, no una caja negra.

Secretos y Configuración

  • Interfaz SecretSource conectable con proveedores Bitwarden y 1Password
  • Comandos hermes config get / unset para gestión de configuración
  • Advertencias de claves de configuración raíz desconocidas + reporte de claves obsoletas en doctor
  • Uso de modelos auxiliares registrado por tarea en la contabilidad de sesión
  • Etiquetas de uso de Nous Portal con alcance de conversación en llamadas aux/MoA/delegate

Mejoras en MoA

  • reference_max_tokens para limitar la salida del asesor y reducir latencia
  • Cadencia de despliegue por preset — user_turn ejecuta asesores una vez por turno de usuario
  • Presets obsoletos mostrados sin reintentos; guardados de presets medio llenos rechazados en el límite de la API
  • El agregador resuelve el razonamiento como un modelo en funciones

Seguridad y Fiabilidad

Endurecimiento de la Superficie de Credenciales

  • Credenciales de Vertex aisladas del entorno de subprocesos y a través de ámbitos de secretos de perfil
  • Seis PRs de endurecimiento P1 rescatados en una sola pasada — guardias de navegador, anclaje MEDIA, bloqueo de .env, transporte ACP de delegado
  • Lecturas de archivos locales de medios/visión/generación de imágenes enrutadas a través de un guardia de lectura de credenciales compartido
  • Barrido de límite de cuerpo de webhook en cada servidor aiohttp
  • Redacción de token de bot en errores de transporte de Telegram
  • Prefijos de token de Fireworks añadidos al redactor
  • CI endurecido contra interpolación de referencias no confiables

Redacción y Valores Predeterminados Seguros

  • Falsos positivos de búsqueda de variables de entorno corregidos para campos KEY=value y JSON/YAML
  • Tokens de bot eliminados de errores de conexión/envío de Telegram
  • Entorno de subprocesos de computer_use saneado en los cinco sitios de spawn del driver cua

Fiabilidad del Gateway y Agente

  • tool_call_id deduplicado en los saneadores pre-API
  • La revisión en segundo plano hereda el reasoning_config del padre para paridad de caché de Anthropic
  • Clientes locales por solicitud de Anthropic para que el watchdog de inactividad/interrupción nunca corrompa SQLite
  • Error 429 de inicio de sesión OAuth corregido — UA no debe ser claude-code/

Seguridad del Dashboard

  • Guardia de credenciales de archivos gestionados ampliado más allá de .env + brecha de árbol de directorios cerrada
  • TOCTOU de token OAuth cerrado con escrituras atómicas 0o600
  • Dashboards obsoletos no pueden recrear perfiles eliminados

Revertido en Esta Ventana

  • Firewall de egreso de inyección de credenciales iron-proxy — revertido, no se publica
  • Habilidad de orquestación de flujo de trabajo dinámico — incorporada, luego revertida
  • Punto de extensión de acciones del proveedor de memoria — incorporado, luego revertido
  • Nota: la escalación de aprobación pre_tool_call del plugin fue revertida a mitad de ventana pero reincorporada y se publica en este lanzamiento

Actualización

hermes update

Para nuevas instalaciones:

# macOS / Linux / WSL2
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash

# Windows (PowerShell)
iex (irm https://hermes-agent.nousresearch.com/install.ps1)

Changelog completo en GitHub

← Hermes Agent Changelog