Hermes v0.19.0 Quicksilver: 80% más rápido y 11 funciones que debes conocer

Hermes Agent v0.19.0, apodado Quicksilver, se publicó el 20 de julio de 2026. Es uno de los lanzamientos más grandes de Nous Research hasta la fecha: desde v0.18.0, la comunidad acumuló aproximadamente 2.245 commits, 1.065 PR fusionados, 3.300 issues cerrados y contribuciones de más de 450 personas. Las notas de publicación de v0.19.0 en este sitio lo resumen así: “Hermes es el mensajero de los dioses, y en esta ventana lo hicimos moverse como tal.”
Este artículo no es un copia-pega del changelog. Separaré la actualización en las 11 funciones que más importan para desarrolladores comunes, por qué importan, cómo usarlas y qué impacto práctico tienen. Si buscas la lista técnica completa, consulta las notas de publicación de v0.19.0.
1. La latencia del primer token cae ~80% en todas partes
El número destacado: el tiempo hasta el primer token (TTFT) bajó de ~4.3s a ~0.9s, un recorte de ~80%. Y aplica a CLI, gateway, TUI, escritorio y cron.
¿Cómo se logró? El equipo eliminó varios cuellos de botella de la ruta de inicio en frío:
- La detección de capacidades de Discord se movió fuera de la ruta crítica con caché en disco de 24 horas + actualización en segundo plano
- La sonda Ollama se omite para proveedores conocidos que no son Ollama
- Se eliminó el trabajo bloqueante de inicialización del agente
- Se añadieron caché de construcción de prompts y resolución de zona horaria con mtime cacheado
No es una sola optimización; son docenas de pequeños recortes que juntos eliminan la espera de “Initializing agent…”. Si Hermes antes sentía que tomaba una respiración profunda antes de responder, esa respiración desapareció.
2. Los modelos de razonamiento muestran su pensamiento en vivo
display.show_reasoning ahora está ACTIVADO por defecto. Con modelos de razonamiento como Claude 3.7 Sonnet o la familia o3/o4, ya no miras un spinner durante 30 segundos. Ves al modelo pensar paso a paso. El cuadro de respuesta también se pinta por token en lugar de por línea, lo que hace que toda la interacción se sienta más fluida.
3. El escritorio recibe una oleada de 20+ PRs de rendimiento
Hermes Desktop se sometió a un sprint enfocado en velocidad y fluidez:
- El renderizado de Markdown en streaming usa 14× menos CPU gracias al análisis léxico incremental por bloques
- Los diffs enormes se virtualizan, así que el panel de revisión ya no se congela con Shiki completo
- El cambio de sesión es instantáneo incluso con transcripciones grandes; se eliminó la cascada de layout-thrash
- Se redujo la serialización de inicio y la amplificación REST por turno
- Los backends de perfil se precalientan al detectar intención de hover; los paneles ocultos se montan en tiempo de inactividad
- La barra lateral y las filas de herramientas ya no se re-renderizan en cada token durante el streaming
El resultado es una experiencia de escritorio que se siente nativa bajo carga, incluso con agentes ocupados y conversaciones grandes.
4. Gestiona tu plan de Nous desde la terminal: /subscription y /topup
Cambiar de suscripción antes requería visitar la web de facturación. Ahora vive en la TUI o CLI clásica:
/subscription
/topup
/subscription muestra tu plan actual, el saldo restante, el costo exacto de actualización (por ejemplo, “Pay $46.30 & upgrade now”), la fecha efectiva de la baja, y permite aplicar o deshacer cambios. La app de escritorio también recibió una pestaña de facturación. Para usuarios avanzados, esto es una gran mejora de calidad de vida.
5. Aprobaciones inteligentes: deja que un LLM juzgue comandos marcados
Hermes ya pedía aprobación antes de ejecutar comandos marcados. En v0.19.0, las aprobaciones inteligentes son el valor por defecto. Un revisor LLM independiente clasifica el comando como seguro, peligroso o incierto. Los seguros se aprueban automáticamente; los peligrosos se rechazan; los inciertos se escalan a ti. Cada comando se revisa individualmente, así que una coincidencia posterior no pasa gratis.
Junto con las reglas de denegación definidas por el usuario que bloquean comandos incluso en modo yolo, y /deny <reason> que le dice al modelo por qué rechazaste, esto reduce la fatiga de aprobaciones sin perder control.
approvals:
deny:
- "rm -rf *"
- "DROP DATABASE *"
- "DROP TABLE *"
6. Conecta tu gestor de contraseñas: Bitwarden y 1Password
Las claves API ya no tienen que vivir en un .env en texto plano. Una nueva interfaz SecretSource permite que Hermes obtenga secretos de Bitwarden y 1Password (referencias op://) en tiempo de carga.
secret_sources:
- provider: bitwarden
vault: "dev-creds"
priority: 1
- provider: onepassword
vault: "Production"
priority: 2
Varios vaults pueden estar activos simultáneamente con prioridad determinística, advertencias de conflicto y trazabilidad por variable. Futuros proveedores solo necesitan implementar la misma interfaz.
7. Observa a tus subagentes en vivo, con delegación duradera en segundo plano
Los delegate_task ahora devuelven archivos de transcripción en vivo que puedes seguir con tail -f desde que los subagentes se lanzan. Cada llamada a herramienta, resultado y respuesta en streaming es visible por hijo. Más importante: las delegaciones en segundo plano ahora son duraderas: si el proceso principal se reinicia a mitad de ejecución, los resultados se restauran y entregan a través de un ledger verificado por propiedad, en lugar de desaparecer.
Esto hace práctico lanzar una flota de subagentes y consultar su progreso cuando quieras, sin tener que vigilar la terminal.
8. Las respuestas finales ya no se pierden por un fallo del gateway
Esta es una mejora de fiabilidad sólida. Si el gateway moría entre generar tu respuesta y confirmar la entrega a la plataforma, la respuesta solía perderse en silencio, aunque ya habías pagado los tokens. Las respuestas finales ahora se registran en un ledger de obligación de entrega duradero en state.db y se reenvían al siguiente arranque.
Para Telegram, Discord, Slack y otros canales de gateway, esto mueve la entrega de “mejor esfuerzo” a “al menos una vez exitosa”.
9. Un gateway, muchos perfiles: enrutamiento basado en perfiles
Un solo gateway que comparte un token de bot ahora puede enrutar servidores, canales o hilos específicos a diferentes perfiles. Cada perfil tiene configuración, skills, memoria y secretos completamente aislados.
Por ejemplo:
- Tu servidor de Discord del trabajo → perfil de trabajo
- Tu servidor personal → perfil personal
- Todo a través del mismo token de bot
Una segunda oleada de endurecimiento del multiplex significa que un perfil mal configurado ya no puede derribar todo el gateway.
10. Nuevos proveedores y los últimos modelos frontera
El soporte de modelos añadido incluye:
- Familia GPT-5.6 (Sol / Terra / Luna y variantes Pro)
- grok-4.5 (GA)
- moonshotai/kimi-k3 (1M de contexto en endpoints Kimi Coding)
- claude-fable-5 / claude-sonnet-5
- tencent/hy3 GA
- GLM-5.2, Upstage Solar y más
Las adiciones de proveedores incluyen:
- Fireworks AI como proveedor de primera clase con estimación de costos y posición #2 en el selector de modelos
- Integración endurecida de DeepInfra
- Modo de carga JIT de LM Studio
- Mejoras en el catálogo de Bedrock: sonda de contexto en vivo, filas de 1M de contexto, paridad de prefijos geográficos
Si cambias frecuentemente entre modelos de vanguardia, este lanzamiento te pone al día.
11. El esfuerzo de razonamiento es ahora una perilla: max, ultra y overrides por modelo
reasoning_effort gana niveles max y ultra, seleccionables en todas las superficies y rutas. También puedes:
- Fijar overrides de reasoning_effort por modelo en la configuración
- Establecer esfuerzo por slot en presets MoA
- Establecer esfuerzo por tarea para modelos auxiliares
La profundidad de pensamiento se convierte en una perilla que puedes girar, no en un interruptor global.
Otras mejoras destacadas
- Exportación de sesiones:
hermes sessions exportgenera Markdown, Quarto, HTML, solo prompts y trazas listas para Hugging Face, con filtros por edad/espacio de trabajo y un paso opcional--redact - Página de Capabilities del escritorio: Skills, Tools, MCP y Hub en un solo lugar, con prueba/activación y filtrado de logs
- Web Dashboard: importación segura de sesiones, emparejamiento de WhatsApp, gestión de toolsets de Discord, terminal keep-alive y más
- Endurecimiento de seguridad: ámbito de credenciales de Vertex, seis PRs P1 de endurecimiento de browser/MEDIA/.env, límites de tamaño de body de webhook, protección de CI contra referencias no confiables
- Utilidades CLI:
/model --oncepara override de modelo por un turno, invocaciones de skills apiladas (/skill-a /skill-b) y--safe-modepara diagnóstico
Cómo actualizar
Si ya tienes Hermes instalado:
hermes update
# o
npm update -g @nousresearch/hermes-agent
Después de actualizar, ejecuta una verificación rápida:
hermes config doctor
hermes plugins list
hermes mcp list
Resumen
El cambio definitorio de Hermes v0.19.0 Quicksilver es que se volvió más rápido y permanece fiable. Una mejora de ~80% en el primer token, 14× más rápido en renderizado de Markdown en streaming, y entrega de gateway a prueba de fallos no son funciones llamativas; son la base que decide si un agente autónomo de IA se convierte en parte de tu flujo diario.
Sobre esa base, v0.19.0 añade capacidades de nivel empresarial: facturación desde terminal, integración con gestores de contraseñas, aprobaciones inteligentes, monitoreo de subagentes, un ledger de entrega y enrutamiento multi-perfil. Si ya ejecutas Hermes en producción o como gateway de equipo, este lanzamiento es una actualización fuerte.
Si aún no lo has probado, empieza con /subscription y un hermes update, luego deja que la nueva velocidad maneje tu siguiente tarea.