v0.3.0

Hermes Agent v0.3.0 — Streaming, Plugins y Multi-Proveedor


Resumen

v0.3.0 — Streaming, Plugins y Multi-Proveedor. Publicado el 17 de marzo de 2026, solo 5 días después del primer lanzamiento público v0.2.0. Esta fue la versión que transformó Hermes Agent de un agente open-source prometedor a una plataforma de operaciones autónomas de grado producción.

Si v0.2.0 mostró al mundo lo que Hermes podía hacer, v0.3.0 lo hizo sentir como un producto pulido. La entrega de tokens en streaming eliminó el problema de “mirar una pantalla en blanco”. La arquitectura de plugins abrió la puerta a contribuciones de la comunidad sin tocar el código central. Y la reconstrucción del sistema de proveedores significó que podías cambiar entre OpenAI, Anthropic, los más de 200 modelos de OpenRouter o cualquier endpoint personalizado con un solo comando.

La respuesta de la comunidad fue inmediata y masiva: para cuando este lanzamiento se publicó, Hermes Agent ya estaba siendo llamado “el sistema operativo para operaciones autónomas” por la comunidad Zero-Human Companies.

Estadísticas clave: ~50+ correcciones de errores · 14 funciones principales · 10+ nuevas skills · 4 revisiones de plataformas de mensajería


Funciones Principales

1. Infraestructura de Streaming Unificada

El cambio más visible para el usuario en v0.3.0: las respuestas ahora se transmiten token por token en CLI y todas las plataformas del gateway.

Qué cambia:

  • Cada proveedor ahora transmite a través de una infraestructura unificada
  • CLI, Telegram, Discord, Slack y todas las plataformas del gateway reciben tokens a medida que se generan
  • Las llamadas de herramientas de larga duración transmiten el progreso en tiempo real

Esto cambió fundamentalmente el modelo de interacción. Los usuarios ahora pueden interrumpir a mitad de la generación, redirigir al agente o hacer preguntas aclaratorias sin esperar un bloque de respuesta completo.

# El streaming ahora es predeterminado — sin configuración necesaria
hermes
> Escribe un script en Python que procese un archivo de log de 10GB

# Los tokens se transmiten a medida que se generan. Puedes:
# - Ver exactamente lo que el agente está pensando en tiempo real
# - Interrumpir con Ctrl+C si va en la dirección equivocada
# - Redirigir a mitad de generación: "mejor usa Rust"

2. Arquitectura de Plugins de Primera Clase

El sistema de plugins fue la clave para el crecimiento de la comunidad. Coloca archivos Python en ~/.hermes/plugins/ y Hermes los detecta automáticamente — herramientas personalizadas, comandos slash, hooks de ciclo de vida, todo sin hacer fork del repositorio.

# ~/.hermes/plugins/mi_herramienta.py
from hermes.plugin import Plugin, tool

class MiPlugin(Plugin):
    """Un plugin que añade una herramienta de clima personalizada."""

    @tool
    def obtener_clima(self, ciudad: str) -> dict:
        """Obtener el clima actual de una ciudad."""
        import requests
        resp = requests.get(f"https://api.clima.ejemplo/{ciudad}")
        return resp.json()

    @tool
    def analizar_sentimiento(self, texto: str) -> dict:
        """Analizar el sentimiento de un texto."""
        return {"sentimiento": "positivo", "puntuacion": 0.85}

Hooks del ciclo de vida del plugin:

  • on_load — se ejecuta cuando el plugin se carga por primera vez
  • on_unload — limpieza antes de la eliminación
  • on_tool_call — interceptar y modificar cualquier llamada de herramienta
  • on_response — post-procesar respuestas del agente

El directorio de plugins se observa automáticamente en busca de cambios — añade, elimina o modifica archivos de plugins mientras Hermes se está ejecutando y los cambios surten efecto inmediatamente.

3. Proveedor Nativo de Anthropic

Antes de v0.3.0, usar modelos Claude significaba enrutar a través de OpenRouter. El proveedor nativo de Anthropic lo cambió todo.

Lo que desbloquea:

  • Llamadas directas a la API de Anthropic — menor latencia, sin intermediario OpenRouter
  • Auto-descubrimiento de credenciales de Claude Code — si has usado Claude Code, Hermes encuentra tus credenciales automáticamente
  • Flujos OAuth PKCE — autenticación segura y estándar con renovación de token
  • Caché de prompts nativa — la caché de prompts de Anthropic reduce los costos de conversaciones largas hasta en un 90%
# Ejecutar configuración con proveedor Anthropic
hermes setup --provider anthropic

# O cambiar a él a mitad de sesión
/hermes model claude-sonnet-4-20250514

# Hermes auto-detecta las credenciales de Claude Code si están disponibles
# No se necesita clave API si has usado Claude Code en esta máquina
# hermes.config.yaml
providers:
  - name: anthropic
    provider: anthropic
    model: claude-sonnet-4-20250514
    prompt_caching: true

4. Aprobaciones Inteligentes + Comando /stop

Inspirado en el enfoque de Codex para la seguridad de comandos, el sistema de aprobación inteligente aprende qué comandos son seguros y recuerda tus preferencias.

> Ejecutar: pip install pandas numpy scikit-learn
# Primera vez: "¿Aprobar este comando pip install? [s/n/siempre]"
# Elige 's' (siempre) → nunca más se pregunta por pip install

> Ejecutar: rm -rf /tmp/build-cache
# "¿Aprobar esta eliminación? [s/n/siempre]" — categoría diferente, pregunta de nuevo

El comando /stop te da un freno de emergencia:

# El agente va por un camino equivocado — detener inmediatamente
/stop

5. Modo de Voz

El modo de voz llegó en v0.3.0 en tres superficies:

CLI: Pulsar para Hablar

# Mantén presionado Espacio para hablar, suelta para enviar
hermes --voice

# O alternar el modo de voz a mitad de sesión
/voice

Plataformas de Mensajería: Notas de Voz

  • Envía notas de voz en Telegram o Discord — Hermes transcribe y responde
  • Las transcripciones usan faster-whisper para procesamiento local gratuito

Canales de Voz de Discord

  • Hermes puede unirse a canales de voz de Discord
  • Escucha menciones y responde verbalmente
# hermes.config.yaml — configuración de voz
voice:
  stt:
    enabled: true
    engine: faster-whisper  # local, gratuito, sin clave API
  tts:
    enabled: true
    engine: openai

6. Ejecución Concurrente de Herramientas

Múltiples llamadas de herramientas independientes ahora se ejecutan en paralelo a través de ThreadPoolExecutor.

Antes de v0.3.0:

> Busca docs sobre async en Python, async en Rust y goroutines de Go
# Ejecución secuencial — Total: ~9 segundos

Después de v0.3.0:

> Busca docs sobre async en Python, async en Rust y goroutines de Go
# Ejecución paralela — Total: ~3 segundos

7. Integración de Memoria Honcho

Honcho (por @erosika) trajo modelado dialéctico del usuario a Hermes — el agente construye un modelo de teoría de la mente sobre ti con el tiempo.

# hermes.config.yaml
memory:
  honcho:
    enabled: true
    recall_mode: recent  # recent | relevant | all
    max_memories_per_turn: 5

8. Redacción de PII

Cuando privacy.redact_pii está habilitado, la información personal identificable se elimina automáticamente antes de enviar el contexto a los proveedores LLM.

# hermes.config.yaml
privacy:
  redact_pii: true

La redacción ocurre localmente antes de que cualquier dato salga de tu máquina.

9. /browser connect vía CDP

Conecta las herramientas del navegador a una instancia de Chrome en vivo a través del Protocolo de Chrome DevTools.

# Inicia Chrome con depuración remota habilitada
chrome --remote-debugging-port=9222

# En Hermes, conéctate a él
/browser connect --port 9222

10. Proveedor Vercel AI Gateway

Enruta Hermes a través del AI Gateway de Vercel para acceder a su catálogo de modelos e infraestructura.

providers:
  - name: vercel
    provider: vercel-ai-gateway
    api_key: ${VERCEL_AI_GATEWAY_KEY}

11. Enrutador de Proveedores Centralizado

El sistema de proveedores fue completamente reconstruido alrededor de una única API call_llm.

# Cambiar modelos sin problemas
/hermes model gpt-5          # → OpenAI
/hermes model claude-sonnet-4 # → Anthropic (auto-detectado)
/hermes model grok-3          # → xAI

# La coincidencia de prefijos también funciona
/mod gpt-5    # se resuelve a /model gpt-5

12. Servidor ACP — Integración con IDEs

VS Code, Zed y JetBrains ahora pueden conectarse a Hermes como backend de agente a través del Agent Communication Protocol.

# Iniciar Hermes en modo servidor ACP
hermes serve --acp

13. Modo Shell Persistente

Por @alt-glitch. Los backends de terminal local y SSH mantienen el estado del shell entre llamadas de herramientas.

Antes:

> cd /mi-proyecto
> ls
# (nuevo shell, cd no persistió)
# Muestra el directorio home

Después:

> cd /mi-proyecto
> ls
# (mismo shell, estado persiste)
# Muestra el contenido de /mi-proyecto ✓
> export DATABASE_URL=postgres://localhost/mydb
> python manage.py migrate
# DATABASE_URL está configurada ✓

14. Destilación Agentic On-Policy (OPD)

Nuevo entorno de entrenamiento RL para destilar políticas de agentes, expandiendo el ecosistema de entrenamiento Atropos.


Mejoras de CLI y Experiencia de Usuario

Función Descripción
Barra de Estado Persistente Modelo, proveedor y conteo de tokens siempre visibles
Autocompletado de Rutas Tab-completa rutas de archivos en el prompt
Comando /plan Genera planes de implementación desde especificaciones
Coincidencia de Prefijos /mod/model, /sta/status
Precarga de Skills Skills cargadas al inicio, listas antes del primer prompt

Configuración

  • Migración desde OpenClaw — migración fluida desde OpenClaw durante la primera instalación
  • Configuración headless — flujo completo funciona en servidores solo SSH
  • Recarga de .env — cambios de entorno detectados sin reiniciar

Actualizaciones de Plataforma

Núcleo del Gateway

Función Impacto
Modo Servicio del Sistema Ejecutar como servicio systemd a nivel de sistema
Recarga en Caliente de Razonamiento Cambiar configuración de razonamiento sin reiniciar
Aislamiento de Sesión por Usuario Los chats grupales ya no comparten estado entre usuarios
Detección Automática de SSL Funciona en NixOS y sistemas no estándar

Telegram

  • Búfer de grupos de medios previene interrupciones por ráfagas de fotos
  • Reintento en fallos TLS transitorios

Discord

  • Comando /thread con configuración auto_thread
  • Creación automática de hilos al @mencionar

Slack

  • Revisión completa del manejo de hilos
  • Corrección de longitud máxima de mensaje (3900 → 39000)

Email

  • Seguimiento de UID IMAP y verificación TLS SMTP
  • Opción skip_attachments vía config.yaml

Nuevas Skills

Skill Descripción
Linear Integración de gestión de proyectos
X/Twitter Redes sociales vía x-cli
Telephony Twilio SMS y llamadas AI
1Password Gestión de contraseñas (por @arceus77-7)
NeuroSkill BCI Integración de interfaz cerebro-computadora
Blender MCP Modelado 3D
OSS Security Forensics Kit de análisis de seguridad
Parallel CLI Skill de investigación
OpenCode Skill CLI
ASCII Video Refactorizado (por @SHL0MS)

Mejoras de MCP

  • Carga selectiva de herramientas — filtra qué herramientas MCP están disponibles
  • Auto-recarga — las herramientas MCP se recargan cuando cambia la configuración, sin reiniciar
  • Correcciones de conexión npx — resueltos fallos de conexión stdio

Sistema Cron

  • Herramienta única cronjob reemplaza múltiples comandos
  • Los trabajos persisten en SQLite — sobreviven a reinicios
  • Sobrescrituras de tiempo de ejecución por trabajo (provider, model, base_url)
  • Escrituras atómicas previenen pérdida de datos en fallos

Seguridad

  • Escaneo pre-ejecución Tirith — análisis estático de comandos antes de la ejecución
  • Eliminación de variables de entorno del proveedor — todas las variables de entorno del proveedor/gateway eliminadas de los entornos de subprocesos
  • Montaje explícito de Docker cwd — los montajes de directorios del host ahora son explícitos, nunca automáticos
  • Detección de fork bomb — patrones regex mejorados

Correcciones de Errores Clave

Problema Corrección
/status mostraba 0 tokens Ahora informa estado en vivo y conteo de tokens
Endpoints de modelos personalizados rotos Restaurada la resolución de endpoints guardados en configuración
Herramientas MCP invisibles hasta reiniciar Auto-recarga al cambiar configuración
Subprocesos de terminal heredando OPENAI_BASE_URL Variables de entorno eliminadas de todos los subprocesos
Degradación de rendimiento del Gateway Corregida la acumulación de manejadores de log
Trabajos cron no persistentes Ahora almacenados en SQLite
Instalación colgada en SSH headless Flujo headless de extremo a extremo
Cambio de modelo sin efecto Corregida la resolución de proveedor al cambiar

Lo Que Dijo la Comunidad

“Hermes no es un copiloto de código atado a un IDE. No es un envoltorio de chatbot alrededor de una sola API. Es un agente autónomo persistente, multiplataforma y multi-modelo que crece con su despliegue.” — ZHC Institute, Field Notes sobre v0.3.0


Cambios Rompedores

  • Formato de configuración de proveedor actualizado — las configuraciones personalizadas de v0.2.0 pueden necesitar reestructuración
  • Las configuraciones heredadas de OpenClaw deben pasar por el flujo de migración (hermes claw migrate)

Actualizar

hermes update

Migrando desde OpenClaw:

hermes claw migrate

Para nuevas instalaciones, visita la guía de instalación.


Changelog completo en GitHub

← Hermes Agent Changelog