v0.14.0

Hermes Agent v0.14.0 — The Foundation Release (Versión Fundacional)


Resumen

v0.14.0 — The Foundation Release. Publicado el 16 de mayo de 2026. 808 commits · 633 PRs fusionados · 1.393 archivos modificados · 165.061 inserciones · 545 issues cerrados (12 P0, 50 P1) · 215 colaboradores de la comunidad.

Hermes Agent v0.14.0 no se trata de funciones llamativas — se trata de hacer que toda la experiencia se sienta sólida. El tema es simple: Hermes se instala y ejecuta en cualquier lugar, incluye lo que realmente quieres usar y deja de incluir lo que no. pip install hermes-agent funciona desde PyPI por primera vez. Los backends pesados se instalan de forma diferida en el primer uso. El arranque en frío ahorra ~19 segundos. Las llamadas CDP del navegador son 180 veces más rápidas. Y la base para todo lo demás — proveedores, plataformas de mensajería, herramientas, plugins, skills — recibe una actualización seria.

Denominado “The Foundation Release” por el equipo, v0.14.0 responde a la pregunta: ¿puede un framework de agentes pasar de “proyecto interesante” a “algo de lo que dependes cada día”?


Funcionalidades Principales

1. Instalación desde PyPI y Ola de Aligeramiento

Hermes Agent ahora es un paquete PyPI real. Un solo comando y ya estás funcionando:

pip install hermes-agent
hermes

El wheel incluye el bundle Ink TUI y el lanzador de shell listos para usar — sin clonar repositorios, sin instaladores de shell. Actualizar es pip install --upgrade hermes-agent.

Más importante aún, la instalación base es drásticamente más ligera. Los backends pesados (adaptadores de Slack, Matrix, Feishu, DingTalk, SDKs de generación de imágenes, proveedores de voz/TTS, Camofox, Codex app-server) ahora se instalan automáticamente la primera vez que los usas. Los extras [all] eliminan todo lo cubierto por lazy-deps, y el instalador retrocede por niveles cuando un wheel no se adapta a tu plataforma. Un verificador de seguridad de la cadena de suministro escanea cada instalación en busca de versiones inseguras.

Lo que esto significa en la práctica: instalaciones más rápidas, menor uso de disco, menos vulnerabilidades transitivas y una barrera de entrada drásticamente más baja para nuevos usuarios. Los días de “lo probaré después, la instalación es muy pesada” se acabaron.

PRs relacionados: #24220, #24515, #25014, #25038, #25766, #21818, #26593, #26148.

2. xAI Grok vía SuperGrok OAuth — Ventana de Contexto de 1M

Si pagas por SuperGrok, ahora puedes usar Grok dentro de Hermes iniciando sesión con tu cuenta xAI — sin API key, sin facturación separada. La conexión también eleva grok-4.3 a una ventana de contexto de 1M tokens, para que puedas pasar codebases completos o corpus de investigación en un solo prompt.

# Después de iniciar sesión vía OAuth, selecciona Grok del selector de modelos
hermes model  # selecciona xAI > grok-4.3

Incluye manejo adecuado de errores de derechos y una página de documentación para túnel SSH cuando necesites completar el flujo OAuth desde una caja remota.

PRs relacionados: #26534, #26664, #26644, #26592.

3. Proxy Local Compatible con OpenAI para Proveedores OAuth

La función estrella para flujos multi-herramienta: hermes proxy inicia un endpoint local que habla la API de OpenAI pero está respaldado por el proveedor OAuth en el que hayas iniciado sesión — Claude Pro, ChatGPT Pro, SuperGrok.

# Iniciar el proxy
hermes proxy --provider anthropic --port 8080

# Ahora cualquier herramienta compatible con OpenAI funciona
export OPENAI_BASE_URL=http://localhost:8080/v1

Cualquier herramienta que espere un endpoint compatible con OpenAI (Codex CLI, Aider, Cline, Continue, tus scripts personalizados) ahora puede usar tu suscripción existente. Una suscripción, todas las herramientas. Esto es importante para desarrolladores que alternan entre asistentes de código — ya no más malabares con API keys por herramienta, ya no más facturación separada. Hermes se convierte en la capa de enrutamiento unificada entre tus suscripciones y tu flujo de trabajo.

Mantén el puerto local — no lo expongas a internet público.

PR relacionado: #25969.

4. x_search — Búsqueda Nativa en X (Twitter)

El agente ahora puede buscar en X directamente sin instalar un skill ni configurar una integración personalizada. Busca en la timeline, encuentra hilos, localiza publicaciones específicas — directamente desde el chat.

# En conversación con el agente
"Busca en X qué dice la gente sobre el nuevo lanzamiento de Claude"

La autenticación funciona con tu login OAuth de X o con una API key, lo que tengas. Esto pasa de “truco comunitario” a herramienta nativa de primera clase.

PR relacionado: #26763.

5. Microsoft Teams — Extremo a Extremo

El stack completo de Microsoft Graph llega junto: auth + base de cliente, un webhook listener que recibe eventos de Teams, un runtime de pipeline plugin, y entrega saliente. Configura el bot una vez y luego chatea con tu agente desde cualquier canal de Teams, DM o grupo.

Esto completa la integración de Teams que estaba parcialmente disponible desde v0.12.0 — las piezas fundamentales están todas listas para uso en producción.

PRs relacionados: #21922, #21969, #22007, #22024.

6. Rendimiento: ~19s Más Rápido en Arranque, Navegador 180x Más Rápido

Dos grandes líneas de rendimiento en este lanzamiento:

Optimización de arranque en frío (~19 segundos ahorrados):

  • Importaciones de adaptadores pesados diferidas al primer uso (Feishu, QQ, Yuanbao, Google Chat, Teams, fal_client)
  • Catálogos de modelos servidos desde caché de disco primero, omitiendo red cuando están frescos
  • Verificaciones de conectividad del doctor ejecutadas en paralelo con IMDS deshabilitado
  • El modo de consulta única chat -q omite completamente el banner de bienvenida
  • Pantalla All-Platforms de hermes tools: 14s → menos de 1.5s

CDP del navegador: 180x más rápido:

Todas las evaluaciones browser_console ahora comparten una conexión WebSocket persistente a Chrome en lugar de crear una nueva sesión DevTools en cada llamada. Las interacciones de página que solían tardar segundos responden en milisegundos.

PRs relacionados: #22138, #22120, #22681, #22790, #22808, #22831, #22859, #22904, #22766, #25341, #23226.

7. Caché de Prompt de Claude de 1 Hora entre Sesiones

Cuando usas Claude a través de Anthropic, OpenRouter o Nous Portal, el prefijo del prompt (system prompt, skills, memory) ahora se cachea durante una hora entre sesiones. Inicia una sesión /new y la primera respuesta llega más rápido y más barata porque la caché sigue caliente de tu última sesión. La revisión de memoria en segundo plano también aprovecha la caché.

Si usas Hermes con Claude a diario, el ahorro de tokens se acumula rápido — cada sesión /new reutiliza el costoso prefijo del system prompt en lugar de pagar el precio completo.

PRs relacionados: #23828, #25434, #24778.

8. LINE + SimpleX Chat — 22 Plataformas de Mensajería

Dos nuevas plataformas de mensajería se unen a la familia:

  • LINE — fundamental para Japón, Corea y Taiwán, conectado a la API de Mensajería de LINE.
  • SimpleX Chat — mensajero descentralizado centrado en la privacidad, sin IDs de usuario, ahora una plataforma de primera clase.

Esto eleva a Hermes a 22 plataformas de mensajería en total. Dondequiera que tú y tu equipo conversen, el agente puede estar allí.

PRs relacionados: #23197, #26232.

9. /handoff — Transferencia de Sesión en Vivo

Cambiar de modelos o personalidades a mitad de conversación solía significar perder el contexto o empezar de nuevo. Ahora /handoff migra tu sesión activa completa — mensajes, llamadas de herramientas, contexto — a un modelo, persona o perfil de destino, en vivo, sin perder nada.

# Pasar de un modelo rápido a uno de razonamiento profundo
/handoff deep-reasoning

# Cambiar perfiles para diferentes partes de una tarea
/handoff production-profile

Un flujo de trabajo favorito: haz el trabajo pesado con un modelo rápido, luego /handoff a un modelo de razonamiento cuando te atores. Sin nueva ventana, sin contexto perdido.

PR relacionado: #23395.

10. Botones Nativos para clarify en Telegram y Discord

Cuando el agente usa la herramienta clarify para hacerte una pregunta de opción múltiple, ahora muestra botones nativos reales en Telegram y Discord en lugar de pedirte que escribas el número de la opción. Toca el botón y el agente recibe tu respuesta. Especialmente útil en móvil donde teclear números de opción es incómodo.

PRs relacionados: #24199, #25485.

11. Relleno de Historial de Canal en Discord

Cuando Hermes se une a un canal o hilo de Discord por primera vez, ahora lee el historial de mensajes recientes para saber qué se ha discutido antes de responder. Se acabó el “¿de qué estamos hablando?” — el agente entra con el mismo contexto que todos los demás ya tienen en pantalla.

Activado por defecto. PR relacionado: #25984.

12. Diagnósticos Semánticos LSP en Cada Escritura

Cuando el agente usa write_file o patch, Hermes ahora ejecuta un servidor de lenguaje real contra el archivo editado y muestra cualquier error nuevo al agente antes del siguiente turno. Errores de tipo, símbolos no definidos, imports faltantes — detectados inmediatamente.

Esta es una mejora significativa respecto al linting de nivel sintáctico de v0.13.0, porque es análisis semántico real de un servidor de lenguaje. El agente detecta sus propios errores antes de que se acumulen.

PRs relacionados: #24168, #25978.

13. Verificador de Mutaciones de Archivo por Turno

Después de cada turno en el que se escribieron o editaron archivos, el agente recibe un breve resumen de exactamente qué cambió en el disco — rutas de archivo, conteo de líneas, el delta real. El agente detecta sus propios errores cuando una escritura no se aplicó o fue sobrescrita silenciosamente, en lugar de decirte confiadamente “agregué la función” cuando el archivo nunca se guardó.

PR relacionado: #24498.

14. vision_analyze Devuelve Píxeles Reales

Cuando apuntas al agente a una imagen con vision_analyze y el modelo activo realmente puede ver (GPT-5, Claude, Gemini, Grok-vision), Hermes ahora pasa los píxeles crudos directamente al modelo en lugar de convertirlos primero a una descripción de texto. Obtienes el verdadero razonamiento visual del modelo en lugar de un resumen de texto degradado.

PR relacionado: #22955.

15. video_generate Unificado con Backends Enchufables

Una herramienta, cualquier modelo de video. Hermes ya viene con los backends obvios, pero puedes agregar un nuevo proveedor de video como plugin sin tocar el núcleo. Cuando un nuevo modelo de video aparezca el próximo mes, puede ser un plugin de un solo archivo en lugar de un fork.

PR relacionado: #25126.

16. computer_use CUA-Driver — Funciona con Modelos No-Anthropic

Computer-use (el agente controlando tu ratón y teclado para manejar aplicaciones GUI) solía estar limitado al SDK de Anthropic. El nuevo backend cua-driver funciona también con proveedores no-Anthropic, tiene operaciones seguras de foco y se actualiza con hermes update. Ahora cualquier modelo con capacidad visual puede controlar tu escritorio.

PRs relacionados: #21967, #24063.

17. URLs Clickeables en Cualquier Terminal

Los enlaces en la salida del agente ahora son hipervínculos OSC8 reales con resaltado al pasar el cursor en cualquier terminal que los soporte (iTerm2, Kitty, Ghostty, Windows Terminal moderno, etc.). Haz clic para abrir en tu navegador — se acabó copiar, pegar y recortar URLs largas de la transcripción.

PRs relacionados: #25071, #24013.

18. Soporte Nativo para Windows (Beta Temprana)

Hermes ahora se ejecuta de forma nativa en cmd.exe y PowerShell sin WSL. Un instalador completo de PowerShell maneja la instalación automática de MinGit, detección de stubs de Python de Microsoft Store y el manejo de Ctrl+C en primer plano. Más de 40 correcciones específicas para Windows han aterrizado para que el bucle básico funcione de extremo a extremo en una máquina Windows limpia. Todavía etiquetado como “beta temprana” — quedan asperezas — pero el camino principal funciona.

PR relacionado: #21561.


Nuevos Proveedores y Mejoras de Modelos

Funcionalidad Descripción
xAI Grok OAuth Integración de suscripción SuperGrok con inicio de sesión OAuth
NovitaAI Nuevo proveedor para hosting de modelos open-source (Llama, Qwen, DeepSeek, etc.)
OpenRouter Pareto Code Router Control min_coding_score — enruta al modelo más barato que cumple tu nivel de calidad
Codex App-Server Runtime Runtime opcional que impulsa Codex CLI de OpenAI por debajo, con reutilización de sesiones, retiro automático de sesiones bloqueadas y clasificación de refresco OAuth
Qwen Cloud Alibaba Cloud renombrado a Qwen Cloud (configuración retrocompatible)
NVIDIA NIM Soporte de encabezado de origen de facturación

Nuevos Skills Opcionales

Nueve nuevos skills opcionales se unen al ecosistema:

Skill Descripción
Hyperliquid Trading de perpetuos y spot vía SDK y API REST
Yahoo Finance Datos de mercado en vivo, fundamentales, históricos
api-testing Recetas de depuración REST y GraphQL
Unified EVM Multi-Chain Un skill que cubre Ethereum + L2s + Base
darwinian-evolver Ajuste evolutivo de prompts y skills
osint-investigation Recetas OSINT para personas, dominios y organizaciones
pinggy-tunnel Exponer servicios locales a internet público
watchers Sondeo de RSS / HTTP JSON / GitHub vía cron en modo no_agent
Notion Revisión completa para la Developer Platform de mayo 2026

Además, huggingface/skills ahora es un tap confiable por defecto en el Skills Hub — los skills comunitarios alojados allí se pueden instalar directamente desde hermes skills sin configuración adicional.

PRs relacionados: #23582, #23583, #23590, #25299, #26760, #26729, #26765, #21881, #26612, #26219.


Mejoras de Plugins y Extensiones

ctx.llm — conéctate al pipeline de modelos del agente. Los autores de plugins ahora pueden hacer llamadas LLM a través del proveedor activo y sus credenciales — sin necesidad de cableado manual de cliente. Los plugins obtienen el mismo enrutamiento de modelos y plomería de auth que usa el agente principal.

tool_override — reemplaza herramientas nativas. Un plugin puede reemplazar limpiamente una herramienta nativa con su propia implementación. Esto cierra una solicitud comunitaria de larga data (#11049).

Perfiles compartibles vía git. Distribuye perfiles completos de Hermes (config, skills, memory) a través de repositorios git — ideal para estandarización en equipos.

Zed ACP Registry. Hermes ahora está listado en el registro de Agent Client Protocol de Zed. Instalación con un clic vía uvx, sin dependencia de npm.

PRs relacionados: #23194, #26759, #20831, #26079, #26120, #26234.


Nuevas Herramientas y Comandos Integrados

Herramienta / Comando Descripción Uso
x_search Buscar en la timeline, hilos y publicaciones de X (Twitter) Pide al agente que busque en X directamente
hermes proxy Proxy local compatible con OpenAI respaldado por proveedores OAuth hermes proxy --provider anthropic --port 8080
/handoff Transferencia de sesión en vivo a otro modelo/persona/perfil /handoff deep-reasoning
/subgoal Agregar criterios de éxito a un /goal en ejecución /subgoal agregar pruebas unitarias para el nuevo módulo
/sessions Explorar y reanudar sesiones anteriores en el TUI /sessions
Brave Search Proveedor de búsqueda web con nivel gratuito Configurar en ajustes de web-search
DDGS Scraper de DuckDuckGo — gratuito, sin API key necesaria Configurar en ajustes de web-search

Mejoras

Plataformas de Mensajería

  • Telegram: streaming nativo de borradores (sendMessageDraft, Bot API 9.5+), modo notificación, modo mención de invitado, división de ediciones sobredimensionadas en lugar de truncamiento silencioso
  • Discord: thread_require_mention para hilos multi-bot
  • Slack: !cmd como prefijo alternativo para comandos slash en hilos
  • WhatsApp: exponer metadatos de respuestas citadas desde Baileys
  • Feishu: tarjetas de actualización de prompt nativas
  • Google Chat: reparar importaciones de configuración de prompt, respetar sender_type declarado por relay
  • Gateway: sigue funcionando cuando plataformas individuales fallan, circuit breaker por plataforma con comando /platform

TUI y CLI

  • Comando slash /sessions para explorar y reanudar sesiones anteriores
  • Turnos segmentados con separadores visuales
  • Soporte para conectarse a un gateway existente
  • Enlaces Markdown resueltos a títulos de página legibles
  • Renderizado de tablas Markdown consciente del ancho con alternativa vertical
  • Advertencia de modo YOLO en banner y barra de estado
  • Confirmación para comandos slash destructivos

Kanban (Multi-Agente)

  • specify — LLM auxiliar desarrolla tareas de clasificación
  • Herramientas de tablero orquestador: kanban_list + kanban_unblock
  • Diagnóstico stranded_in_ready para tareas no reclamadas
  • Entrega de notificaciones desduplicada mediante reclamación atómica + retroceso en fallo

Google Workspace

  • Operaciones de escritura en Drive + crear/agregar en Docs/Sheets

i18n

  • Todos los comandos del gateway + panel web localizados, 8 nuevas localizaciones añadidas (16 en total)

Rendimiento

  • Arranque en frío: ~19s ahorrados mediante importaciones diferidas, catálogos de modelos en caché de disco, verificaciones del doctor en paralelo y chat -q omitiendo el banner de bienvenida
  • Navegador: browser_console 180x más rápido mediante WebSocket CDP persistente
  • Telegram: cadencia ajustada + vía rápida adaptativa para respuestas cortas
  • Caché de prompt: caché de prefijo Claude de 1 hora entre sesiones en Anthropic, OpenRouter y Nous Portal
  • TUI: renderizado de tablas consciente del ancho, desplazamiento de transcripción durante prompts

Seguridad y Fiabilidad

Refuerzo de Seguridad

  • Fuerza bruta de sudo bloqueada: intentos de sudo -S clasificados como PELIGROSOS; invocaciones sudo con stdin o askpass despojado capturadas
  • Tres elusiones de comandos peligrosos cerradas (inspirado en el trabajo de detección de comandos de Claude Code)
  • Desinfección de errores de herramientas: archivos maliciosos o servicios remotos no pueden inyectar instrucciones a través de la salida de error
  • Rutas de captura SSRF cubiertas en skills-hub
  • Autenticación de dashboard requerida para rutas de API de plugins
  • Verificador de seguridad de cadena de suministro escanea cada instalación
  • Desinfección de autor de comentarios Kanban — sin anulación de autor controlada por el llamante
  • Redacción de salida de comandos rápidos y desinfección de entorno
  • Reducción de shell=True innecesario en llamadas a subprocesos

Correcciones de Errores Notables

  • SQLite: retroceder a journal_mode=DELETE en NFS/SMB/FUSE (corrige /resume en montajes de red)
  • Codex-runtime: retirar sesiones bloqueadas + watchdog post-herramienta + clasificación de refresco OAuth
  • Daytona: migrar búsqueda de sandbox legado a list() basado en cursor
  • MCP: dejar de reintentar fallos de autenticación inicial, prevenir bucles infinitos
  • ACP: recursos de adjuntos de archivo en línea
  • Perfiles + banner: excluir infraestructura de --clone-all, corregir resolución de repositorio de verificación de actualización obsoleta

Actualización

hermes update

Si actualizas desde una versión anterior a v0.14.0, haz una copia de seguridad de tu directorio ~/.hermes primero. Después de la actualización, ejecuta hermes doctor para verificar que todo esté saludable.

Para nuevas instalaciones:

pip install hermes-agent
hermes setup

Changelog completo en GitHub

← Hermes Agent Changelog