Hermes Agent v0.3.0 — Streaming, Plugins y Multi-Proveedor
Resumen
v0.3.0 — Streaming, Plugins y Multi-Proveedor. Publicado el 17 de marzo de 2026, solo 5 días después del primer lanzamiento público v0.2.0. Esta fue la versión que transformó Hermes Agent de un agente open-source prometedor a una plataforma de operaciones autónomas de grado producción.
Si v0.2.0 mostró al mundo lo que Hermes podía hacer, v0.3.0 lo hizo sentir como un producto pulido. La entrega de tokens en streaming eliminó el problema de “mirar una pantalla en blanco”. La arquitectura de plugins abrió la puerta a contribuciones de la comunidad sin tocar el código central. Y la reconstrucción del sistema de proveedores significó que podías cambiar entre OpenAI, Anthropic, los más de 200 modelos de OpenRouter o cualquier endpoint personalizado con un solo comando.
La respuesta de la comunidad fue inmediata y masiva: para cuando este lanzamiento se publicó, Hermes Agent ya estaba siendo llamado “el sistema operativo para operaciones autónomas” por la comunidad Zero-Human Companies.
Estadísticas clave: ~50+ correcciones de errores · 14 funciones principales · 10+ nuevas skills · 4 revisiones de plataformas de mensajería
Funciones Principales
1. Infraestructura de Streaming Unificada
El cambio más visible para el usuario en v0.3.0: las respuestas ahora se transmiten token por token en CLI y todas las plataformas del gateway.
Qué cambia:
- Cada proveedor ahora transmite a través de una infraestructura unificada
- CLI, Telegram, Discord, Slack y todas las plataformas del gateway reciben tokens a medida que se generan
- Las llamadas de herramientas de larga duración transmiten el progreso en tiempo real
Esto cambió fundamentalmente el modelo de interacción. Los usuarios ahora pueden interrumpir a mitad de la generación, redirigir al agente o hacer preguntas aclaratorias sin esperar un bloque de respuesta completo.
# El streaming ahora es predeterminado — sin configuración necesaria
hermes
> Escribe un script en Python que procese un archivo de log de 10GB
# Los tokens se transmiten a medida que se generan. Puedes:
# - Ver exactamente lo que el agente está pensando en tiempo real
# - Interrumpir con Ctrl+C si va en la dirección equivocada
# - Redirigir a mitad de generación: "mejor usa Rust"
2. Arquitectura de Plugins de Primera Clase
El sistema de plugins fue la clave para el crecimiento de la comunidad. Coloca archivos Python en ~/.hermes/plugins/ y Hermes los detecta automáticamente — herramientas personalizadas, comandos slash, hooks de ciclo de vida, todo sin hacer fork del repositorio.
# ~/.hermes/plugins/mi_herramienta.py
from hermes.plugin import Plugin, tool
class MiPlugin(Plugin):
"""Un plugin que añade una herramienta de clima personalizada."""
@tool
def obtener_clima(self, ciudad: str) -> dict:
"""Obtener el clima actual de una ciudad."""
import requests
resp = requests.get(f"https://api.clima.ejemplo/{ciudad}")
return resp.json()
@tool
def analizar_sentimiento(self, texto: str) -> dict:
"""Analizar el sentimiento de un texto."""
return {"sentimiento": "positivo", "puntuacion": 0.85}
Hooks del ciclo de vida del plugin:
on_load— se ejecuta cuando el plugin se carga por primera vezon_unload— limpieza antes de la eliminaciónon_tool_call— interceptar y modificar cualquier llamada de herramientaon_response— post-procesar respuestas del agente
El directorio de plugins se observa automáticamente en busca de cambios — añade, elimina o modifica archivos de plugins mientras Hermes se está ejecutando y los cambios surten efecto inmediatamente.
3. Proveedor Nativo de Anthropic
Antes de v0.3.0, usar modelos Claude significaba enrutar a través de OpenRouter. El proveedor nativo de Anthropic lo cambió todo.
Lo que desbloquea:
- Llamadas directas a la API de Anthropic — menor latencia, sin intermediario OpenRouter
- Auto-descubrimiento de credenciales de Claude Code — si has usado Claude Code, Hermes encuentra tus credenciales automáticamente
- Flujos OAuth PKCE — autenticación segura y estándar con renovación de token
- Caché de prompts nativa — la caché de prompts de Anthropic reduce los costos de conversaciones largas hasta en un 90%
# Ejecutar configuración con proveedor Anthropic
hermes setup --provider anthropic
# O cambiar a él a mitad de sesión
/hermes model claude-sonnet-4-20250514
# Hermes auto-detecta las credenciales de Claude Code si están disponibles
# No se necesita clave API si has usado Claude Code en esta máquina
# hermes.config.yaml
providers:
- name: anthropic
provider: anthropic
model: claude-sonnet-4-20250514
prompt_caching: true
4. Aprobaciones Inteligentes + Comando /stop
Inspirado en el enfoque de Codex para la seguridad de comandos, el sistema de aprobación inteligente aprende qué comandos son seguros y recuerda tus preferencias.
> Ejecutar: pip install pandas numpy scikit-learn
# Primera vez: "¿Aprobar este comando pip install? [s/n/siempre]"
# Elige 's' (siempre) → nunca más se pregunta por pip install
> Ejecutar: rm -rf /tmp/build-cache
# "¿Aprobar esta eliminación? [s/n/siempre]" — categoría diferente, pregunta de nuevo
El comando /stop te da un freno de emergencia:
# El agente va por un camino equivocado — detener inmediatamente
/stop
5. Modo de Voz
El modo de voz llegó en v0.3.0 en tres superficies:
CLI: Pulsar para Hablar
# Mantén presionado Espacio para hablar, suelta para enviar
hermes --voice
# O alternar el modo de voz a mitad de sesión
/voice
Plataformas de Mensajería: Notas de Voz
- Envía notas de voz en Telegram o Discord — Hermes transcribe y responde
- Las transcripciones usan faster-whisper para procesamiento local gratuito
Canales de Voz de Discord
- Hermes puede unirse a canales de voz de Discord
- Escucha menciones y responde verbalmente
# hermes.config.yaml — configuración de voz
voice:
stt:
enabled: true
engine: faster-whisper # local, gratuito, sin clave API
tts:
enabled: true
engine: openai
6. Ejecución Concurrente de Herramientas
Múltiples llamadas de herramientas independientes ahora se ejecutan en paralelo a través de ThreadPoolExecutor.
Antes de v0.3.0:
> Busca docs sobre async en Python, async en Rust y goroutines de Go
# Ejecución secuencial — Total: ~9 segundos
Después de v0.3.0:
> Busca docs sobre async en Python, async en Rust y goroutines de Go
# Ejecución paralela — Total: ~3 segundos
7. Integración de Memoria Honcho
Honcho (por @erosika) trajo modelado dialéctico del usuario a Hermes — el agente construye un modelo de teoría de la mente sobre ti con el tiempo.
# hermes.config.yaml
memory:
honcho:
enabled: true
recall_mode: recent # recent | relevant | all
max_memories_per_turn: 5
8. Redacción de PII
Cuando privacy.redact_pii está habilitado, la información personal identificable se elimina automáticamente antes de enviar el contexto a los proveedores LLM.
# hermes.config.yaml
privacy:
redact_pii: true
La redacción ocurre localmente antes de que cualquier dato salga de tu máquina.
9. /browser connect vía CDP
Conecta las herramientas del navegador a una instancia de Chrome en vivo a través del Protocolo de Chrome DevTools.
# Inicia Chrome con depuración remota habilitada
chrome --remote-debugging-port=9222
# En Hermes, conéctate a él
/browser connect --port 9222
10. Proveedor Vercel AI Gateway
Enruta Hermes a través del AI Gateway de Vercel para acceder a su catálogo de modelos e infraestructura.
providers:
- name: vercel
provider: vercel-ai-gateway
api_key: ${VERCEL_AI_GATEWAY_KEY}
11. Enrutador de Proveedores Centralizado
El sistema de proveedores fue completamente reconstruido alrededor de una única API call_llm.
# Cambiar modelos sin problemas
/hermes model gpt-5 # → OpenAI
/hermes model claude-sonnet-4 # → Anthropic (auto-detectado)
/hermes model grok-3 # → xAI
# La coincidencia de prefijos también funciona
/mod gpt-5 # se resuelve a /model gpt-5
12. Servidor ACP — Integración con IDEs
VS Code, Zed y JetBrains ahora pueden conectarse a Hermes como backend de agente a través del Agent Communication Protocol.
# Iniciar Hermes en modo servidor ACP
hermes serve --acp
13. Modo Shell Persistente
Por @alt-glitch. Los backends de terminal local y SSH mantienen el estado del shell entre llamadas de herramientas.
Antes:
> cd /mi-proyecto
> ls
# (nuevo shell, cd no persistió)
# Muestra el directorio home
Después:
> cd /mi-proyecto
> ls
# (mismo shell, estado persiste)
# Muestra el contenido de /mi-proyecto ✓
> export DATABASE_URL=postgres://localhost/mydb
> python manage.py migrate
# DATABASE_URL está configurada ✓
14. Destilación Agentic On-Policy (OPD)
Nuevo entorno de entrenamiento RL para destilar políticas de agentes, expandiendo el ecosistema de entrenamiento Atropos.
Mejoras de CLI y Experiencia de Usuario
| Función | Descripción |
|---|---|
| Barra de Estado Persistente | Modelo, proveedor y conteo de tokens siempre visibles |
| Autocompletado de Rutas | Tab-completa rutas de archivos en el prompt |
Comando /plan |
Genera planes de implementación desde especificaciones |
| Coincidencia de Prefijos | /mod → /model, /sta → /status |
| Precarga de Skills | Skills cargadas al inicio, listas antes del primer prompt |
Configuración
- Migración desde OpenClaw — migración fluida desde OpenClaw durante la primera instalación
- Configuración headless — flujo completo funciona en servidores solo SSH
- Recarga de
.env— cambios de entorno detectados sin reiniciar
Actualizaciones de Plataforma
Núcleo del Gateway
| Función | Impacto |
|---|---|
| Modo Servicio del Sistema | Ejecutar como servicio systemd a nivel de sistema |
| Recarga en Caliente de Razonamiento | Cambiar configuración de razonamiento sin reiniciar |
| Aislamiento de Sesión por Usuario | Los chats grupales ya no comparten estado entre usuarios |
| Detección Automática de SSL | Funciona en NixOS y sistemas no estándar |
Telegram
- Búfer de grupos de medios previene interrupciones por ráfagas de fotos
- Reintento en fallos TLS transitorios
Discord
- Comando
/threadcon configuraciónauto_thread - Creación automática de hilos al @mencionar
Slack
- Revisión completa del manejo de hilos
- Corrección de longitud máxima de mensaje (3900 → 39000)
- Seguimiento de UID IMAP y verificación TLS SMTP
- Opción
skip_attachmentsvía config.yaml
Nuevas Skills
| Skill | Descripción |
|---|---|
| Linear | Integración de gestión de proyectos |
| X/Twitter | Redes sociales vía x-cli |
| Telephony | Twilio SMS y llamadas AI |
| 1Password | Gestión de contraseñas (por @arceus77-7) |
| NeuroSkill BCI | Integración de interfaz cerebro-computadora |
| Blender MCP | Modelado 3D |
| OSS Security Forensics | Kit de análisis de seguridad |
| Parallel CLI | Skill de investigación |
| OpenCode | Skill CLI |
| ASCII Video | Refactorizado (por @SHL0MS) |
Mejoras de MCP
- Carga selectiva de herramientas — filtra qué herramientas MCP están disponibles
- Auto-recarga — las herramientas MCP se recargan cuando cambia la configuración, sin reiniciar
- Correcciones de conexión npx — resueltos fallos de conexión stdio
Sistema Cron
- Herramienta única
cronjobreemplaza múltiples comandos - Los trabajos persisten en SQLite — sobreviven a reinicios
- Sobrescrituras de tiempo de ejecución por trabajo (provider, model, base_url)
- Escrituras atómicas previenen pérdida de datos en fallos
Seguridad
- Escaneo pre-ejecución Tirith — análisis estático de comandos antes de la ejecución
- Eliminación de variables de entorno del proveedor — todas las variables de entorno del proveedor/gateway eliminadas de los entornos de subprocesos
- Montaje explícito de Docker cwd — los montajes de directorios del host ahora son explícitos, nunca automáticos
- Detección de fork bomb — patrones regex mejorados
Correcciones de Errores Clave
| Problema | Corrección |
|---|---|
/status mostraba 0 tokens |
Ahora informa estado en vivo y conteo de tokens |
| Endpoints de modelos personalizados rotos | Restaurada la resolución de endpoints guardados en configuración |
| Herramientas MCP invisibles hasta reiniciar | Auto-recarga al cambiar configuración |
Subprocesos de terminal heredando OPENAI_BASE_URL |
Variables de entorno eliminadas de todos los subprocesos |
| Degradación de rendimiento del Gateway | Corregida la acumulación de manejadores de log |
| Trabajos cron no persistentes | Ahora almacenados en SQLite |
| Instalación colgada en SSH headless | Flujo headless de extremo a extremo |
| Cambio de modelo sin efecto | Corregida la resolución de proveedor al cambiar |
Lo Que Dijo la Comunidad
“Hermes no es un copiloto de código atado a un IDE. No es un envoltorio de chatbot alrededor de una sola API. Es un agente autónomo persistente, multiplataforma y multi-modelo que crece con su despliegue.” — ZHC Institute, Field Notes sobre v0.3.0
Cambios Rompedores
- Formato de configuración de proveedor actualizado — las configuraciones personalizadas de v0.2.0 pueden necesitar reestructuración
- Las configuraciones heredadas de OpenClaw deben pasar por el flujo de migración (
hermes claw migrate)
Actualizar
hermes update
Migrando desde OpenClaw:
hermes claw migrate
Para nuevas instalaciones, visita la guía de instalación.
← Hermes Agent Changelog