Hermes Agent v0.2.0 — El Primer Lanzamiento Público
Visión General
v0.2.0 — El Primer Lanzamiento Público. 12 de marzo de 2026. 216 pull requests fusionados · 63 colaboradores · 119 issues resueltos · de casi cero tests a 3,289.
Este es el momento en que Hermes Agent fue presentado al mundo. En poco más de dos semanas tras la base interna v0.1.0, el proyecto explotó desde un pequeño prototipo de investigación hasta convertirse en una plataforma de agentes de IA completa e impulsada por la comunidad. Lo que hace notable a este lanzamiento no es solo la lista de funcionalidades — es la velocidad. 63 personas de la comunidad open-source contribuyeron con código, tests, documentación y correcciones de seguridad, moldeando la arquitectura del proyecto desde el primer día.
v0.2.0 establece el ADN central que definiría a Hermes en todos los lanzamientos posteriores: skills que se auto-mejoran, un gateway de mensajería que llega a los usuarios donde estén, MCP para extensibilidad de herramientas, y un enfoque implacable en la seguridad desde el inicio.
Funcionalidades Principales
1. Gateway de Mensajería Multiplataforma
Hermes no es solo una herramienta CLI — vive donde tú vives. El sistema de gateway traslada la experiencia completa del agente a siete plataformas de mensajería, con gestión de sesiones unificada, adjuntos multimedia y configuración de herramientas por plataforma.
| Plataforma | Capacidades Clave |
|---|---|
| Telegram | Archivos adjuntos, procesamiento de documentos (PDF/Office), aislamiento de temas del foro, capturas de pantalla del navegador, compartir ubicación |
| Discord | Contexto del tema del canal, soporte para documentos/video, filtrado de mensajes de bots |
| Slack | Manejo de menciones de la app, compartir documentos/video, registro estructurado |
| Envío nativo de medios (imágenes/video/documentos), aislamiento de sesiones multiusuario, manejo de puertos multiplataforma | |
| Signal | Gateway completo vía signal-cli-rest-api, soporte para URLs de medios |
| Email (IMAP/SMTP) | Gateway de correo completo — enviar y recibir a través de cualquier proveedor de email |
| Home Assistant | Herramientas REST + integración WebSocket, descubrimiento de servicios |
El núcleo del gateway también introdujo funcionalidades multiplataforma: visibilidad de llamadas a herramientas de subagentes, notificaciones configurables de procesos en segundo plano, edit_message() con alternativas de respaldo por plataforma, y comandos slash como /compress, /usage y /update.
2. Cliente MCP (Model Context Protocol)
El soporte nativo de MCP fue una de las decisiones arquitectónicas más tempranas en Hermes — y una visionaria. Antes de que MCP se convirtiera en el estándar de la industria que es hoy, Hermes ya contaba con un cliente listo para producción.
# Los servidores MCP se configuran en config.yaml
# Hermes descubre herramientas, recursos y prompts automáticamente
hermes tools # Explorar y habilitar herramientas MCP en la UI curses
/reload-mcp # Recarga en caliente de servidores MCP sin reiniciar
Capacidades clave:
- Transportes stdio y HTTP — conectar con servidores MCP locales y remotos
- Soporte de sampling — los servidores MCP pueden iniciar solicitudes LLM de vuelta a través de Hermes
- Descubrimiento de recursos y prompts — exponer automáticamente las capacidades del servidor
- Reconexión automática — recuperarse de caídas del servidor sin perder estado
- Refuerzo de seguridad — las herramientas de servidores MCP están sujetas a las mismas políticas de aprobación
3. Ecosistema de Skills — 70+ Skills, Agente que se Auto-Mejora
El sistema de skills — el diferenciador característico de Hermes — ya era completo en el lanzamiento. Más de 70 skills incluidas y opcionales en más de 15 categorías, con un Skills Hub para descubrimiento comunitario.
Cómo funcionan las skills:
Las skills son documentos Markdown almacenados en ~/.hermes/skills/. Cuando Hermes encuentra una tarea relevante, carga la skill correspondiente en el contexto como guía procedimental. Tras completar una tarea, un “fork de revisión” en segundo plano evalúa si la skill fue útil — y escribe o actualiza skills automáticamente.
# Explorar el hub de skills
hermes skills browse
# Las skills pueden habilitarse/deshabilitarse por plataforma
# Activación condicional basada en disponibilidad de herramientas
# Los prerrequisitos aseguran que las skills con dependencias no satisfechas permanezcan ocultas
Nuevas skills incluidas en v0.2.0:
- ASCII Art — pyfiglet (571 fuentes), cowsay, imagen a ASCII
- ASCII Video — Pipeline completo de producción para video en terminal
- Búsqueda DuckDuckGo — Búsqueda web con privacidad, con Firecrawl como alternativa
- Blockchain Solana — Saldos de billetera, cotización en USD, nombres de tokens
- AgentMail — Bandejas de email propiedad del agente
- Polymarket — Datos del mercado de predicciones (solo lectura)
- Migración OpenClaw — Herramienta oficial de migración de OpenClaw a Hermes
- Inteligencia de Dominios — Reconocimiento pasivo: subdominios, SSL, WHOIS, DNS
- Superpowers — Skills de desarrollo de software
- Hermes-Atropos — Desarrollo de entornos RL
- Además: búsqueda arXiv, OCR/documentos, diagramas Excalidraw, transcripciones de YouTube, búsqueda de GIFs y más de 40 skills de MLOps
(#743 — @teyrebaz33, #785 — @teyrebaz33)
4. Enrutador de Providers Centralizado
Antes de v0.2.0, la lógica de providers estaba dispersa entre visión, resumen, compresión y guardado de trayectorias — cada uno llamando a LLMs a través de su propia ruta de código. El enrutador de providers centralizado unifica todo esto detrás de una única API call_llm() / async_call_llm().
# Todos los consumidores auxiliares ahora pasan por una sola ruta de código:
# resolve_provider_client() → call_llm()
# Resolución automática de credenciales, manejo de errores y lógica de reintento
Providers soportados en el lanzamiento:
- Nous Portal — integración nativa OAuth
- OpenAI Codex — API Responses con soporte para suscripción ChatGPT
- OpenRouter — más de 200 modelos con preferencias de enrutamiento
- Kimi Code API — modelo especializado en codificación de Moonshot
- MiniMax — IDs de modelo actualizados
- z.ai/GLM — modelo bilingüe de Tsinghua
- Azure OpenAI — soporte para despliegues empresariales
- Firecrawl autoalojado — web scraping en tu propia infraestructura
(#1003)
5. Servidor ACP — Integración con Editores
Los editores VS Code, Zed y JetBrains ahora pueden conectarse a Hermes mediante el estándar Agent Communication Protocol (ACP). Esto significa que el mismo agente que funciona en tu terminal y apps de mensajería puede asistirte directamente dentro de tu editor.
(#949)
6. Motor de Skins/Temas para CLI
Un sistema de personalización visual basado en datos con 7 skins integradas (default, ares, mono, slate, poseidon, sisyphus, charizard) más soporte para skins YAML personalizadas. Banners, spinners, colores y marca son configurables — sin necesidad de modificar código.
# ~/.hermes/skins/my-skin.yaml
banner: "custom"
spinner: "dots"
colors:
accent: "#00E5A0"
background: "#0A0A0F"
7. Aislamiento con Git Worktree
hermes -w lanza sesiones de agente aisladas en git worktrees, permitiendo trabajo paralelo seguro sobre el mismo repositorio. Cada worktree obtiene su propio directorio de trabajo, rama y sesión de agente — sin pisarte a ti mismo al ejecutar múltiples agentes.
# Lanzar Hermes en un git worktree para trabajo paralelo aislado
hermes -w
(#654)
8. Checkpoints del Sistema de Archivos y Rollback
Se crean instantáneas automáticas antes de operaciones destructivas sobre archivos. El comando /rollback restaura los archivos a su estado anterior — una red de seguridad que te permite experimentar sin miedo.
# El agente crea instantáneas automáticamente antes de operaciones destructivas
# /rollback en la CLI para restaurar
# Funciona en todos los backends de terminal (local, Docker, SSH, Modal)
(#824)
Agente Central y Arquitectura
Mejoras en el Bucle del Agente
El bucle del agente recibió un refuerzo sustancial para manejar casos límite del mundo real:
- Modelo de respaldo simple — si el provider principal falla, Hermes cambia transparentemente a una alternativa configurada (#740)
- Presupuesto de iteraciones compartido — el agente padre y la delegación a subagentes comparten un presupuesto unificado, evitando bucles descontrolados de subagentes
- Manejo de error 413 payload-too-large — en lugar de abortar, Hermes comprime el contexto y reintenta (#153)
- Middleware de reparación de llamadas a herramientas — minúsculas automáticas y manejador de herramientas inválidas corrigen llamadas mal formadas del modelo
- Configuración del esfuerzo de razonamiento — controla cuánto piensa el modelo antes de actuar (comando
/reasoning) - Detección de bucles tras compresión — evita que el agente relea/busque archivos después de la compresión de contexto (#705)
Sesión y Memoria
- Sesiones con nombre — asigna títulos únicos a las sesiones, explora con filtros de búsqueda, reanuda por nombre (#720)
- Modelado de usuario Honcho — perfil de usuario entre sesiones nativo de IA que mejora con el tiempo (#38)
- Volcado proactivo de memoria — persistencia asíncrona de memoria al expirar la sesión
- Detección inteligente de longitud de contexto — detecta los límites de contexto del modelo con caché persistente
CLI y Experiencia de Usuario
CLI Interactiva
La experiencia de terminal recibió un importante pulido:
- Comando
/personality— personalidad del agente personalizada o desactivarla completamente (#773) - Comandos rápidos definidos por el usuario — evita el bucle del agente para acciones rápidas predeterminadas (#746)
/verbose— alternar salida de depuración en tiempo de ejecución (#94)/insights— analíticas de uso, estimación de costes y patrones de actividad (#552)/background— gestionar procesos en segundo plano desde la CLI- Campana al finalizar — timbre del terminal cuando el agente completa una tarea (#738)
- Historial con flechas arriba/abajo — navegar por comandos anteriores
- Pegado de imágenes del portapapeles — Alt+V / Ctrl+V para pegar imágenes
--quiet/-Q— modo programático de consulta única con salida mínima--fuck-it-ship-it— omite todos los avisos de aprobación para flujos de trabajo completamente automatizados (#724)
Configuración e Instalación
- Asistente de configuración modular con subcomandos por sección y UX orientada a herramientas
- Sistema de migración de configuración — actualización sin fricción entre versiones de formato de configuración (v7 en el lanzamiento)
hermes tools— habilitar/deshabilitar herramientas por plataforma con UI curseshermes doctor— verificaciones de salud en todos los providers configuradoshermes update— con reinicio automático del servicio gateway- Escrituras atómicas para .env — evita la pérdida de claves API en caso de caída (#954)
Seguridad
Hermes Agent se tomó la seguridad en serio desde el primer día. v0.2.0 incluyó una extensa capa de refuerzo de seguridad:
Prevención de Vulnerabilidades
| Categoría | Descripción |
|---|---|
| Path Traversal | Corregido en skill_view — evitaba la lectura de archivos arbitrarios (#220) |
| Shell Injection | Prevención en tuberías de contraseña sudo (#65), patrones tee/sustitución de procesos (#280) |
| Ataques de Symlink | Correcciones de verificación de límites en skills_guard (#386), omisión de lista de denegación de escritura en macOS (#61) |
| Prompt Injection | Prevención de omisión con múltiples palabras (#192), corrección de omisión del escáner cron (#63) |
| Comandos Peligrosos | Detección de omisión multilínea (#233), flag --force correctamente bloqueado (#388) |
Protección de Datos
- Escrituras atómicas en sesiones, trabajos cron, configuración .env, checkpoints de procesos, ejecutor por lotes y archivos de skills — evitando pérdida de datos ante caídas
- Refuerzo de permisos de archivo — 0600/0700 en archivos sensibles, .env restringido solo al propietario
- Saneamiento de consultas FTS5 — previene inyección SQL a través de consultas de búsqueda de texto completo
- Redacción de secretos — patrones ampliables para eliminar secretos de logs y transcripciones
- Lista blanca permanente en memoria — evita que datos sensibles se filtren al disco (#600)
Testing — De Cero a 3,289
Cuando comenzó el desarrollo de v0.2.0, el proyecto tenía una cobertura de tests casi nula. La comunidad respondió con un esfuerzo masivo de testing:
- 3,289 tests en los módulos de agente, gateway, herramientas, cron y CLI
- Suite de tests paralelizada con pytest-xdist (#802)
- Cuatro lotes de tests unitarios cubriendo módulos centrales, rutas críticas de seguridad y el bucle AIAgent
- 43 tests de formato de Telegram para precisión en el renderizado de cursiva/negrita/código
- 42 tests de herramientas de visión con anotaciones de tipo completas
- Tests de regresión del compresor para el manejo de límites de llamadas a herramientas
Esta base de testing resultaría crítica a medida que el proyecto continuara su rápida iteración — con 3,289 tests detectando regresiones antes de que llegaran a los usuarios.
Entornos RL y de Evaluación
Hermes Agent siempre fue diseñado como una plataforma para generar datos de entrenamiento agentivo. v0.2.0 incluyó:
- WebResearchEnv — entorno RL de investigación web multi-paso (#434)
- YC-Bench — entorno de benchmark para agentes de horizonte largo
- OpenThoughts-TBLite — entorno de evaluación y scripts
- Soporte local vLLM — ejecutar evaluaciones contra modelos alojados localmente
- Hermes-Atropos — skill incluida para desarrollo de entornos RL (#815)
Compatibilidad con Windows
El soporte para Windows fue una prioridad de primer nivel desde el principio:
- Funciones de proceso exclusivas de POSIX protegidas para compatibilidad con Windows
- Soporte nativo vía Git Bash + alternativa de actualización basada en ZIP
pywinptypara soporte PTY en Windows (#457)- Codificación UTF-8 explícita en toda la E/S de archivos de configuración/datos (#458)
- Manejo de rutas con letra de unidad para salida de búsqueda basada en regex (#533)
Actualización
hermes update
Para nuevas instalaciones:
# Linux / macOS / WSL2
curl -fsSL https://raw.githubusercontent.com/NousResearch/hermes-agent/main/scripts/install.sh | bash
Registro completo de cambios en GitHub
← Hermes Agent Changelog