Hermes Agent v0.3.0 — Streaming, Plugins et Multi-Fournisseur
Aperçu
v0.3.0 — Streaming, Plugins et Multi-Fournisseur. Publié le 17 mars 2026, seulement 5 jours après la première version publique v0.2.0. Cette version a transformé Hermes Agent d’un agent open-source prometteur en une plateforme d’opérations autonomes de qualité production.
Si v0.2.0 a montré au monde ce que Hermes pouvait faire, v0.3.0 lui a donné l’allure d’un produit abouti. La diffusion de tokens en streaming a éliminé le problème de « fixer un écran vide ». L’architecture de plugins a ouvert la porte aux contributions de la communauté sans toucher au code central. Et la refonte du système de fournisseurs signifiait que vous pouviez basculer entre OpenAI, Anthropic, les plus de 200 modèles d’OpenRouter ou n’importe quel endpoint personnalisé avec une seule commande.
La réponse de la communauté a été immédiate et massive : au moment de cette publication, Hermes Agent était déjà appelé « le système d’exploitation pour les opérations autonomes » par la communauté Zero-Human Companies.
Statistiques clés : ~50+ corrections de bugs · 14 fonctionnalités majeures · 10+ nouvelles skills · 4 refontes de plateformes de messagerie
Fonctionnalités Majeures
1. Infrastructure de Streaming Unifiée
Le changement le plus visible pour l’utilisateur dans v0.3.0 : les réponses sont désormais diffusées token par token dans le CLI et sur toutes les plateformes de la passerelle.
Ce qui change :
- Chaque fournisseur diffuse désormais via une infrastructure unifiée
- Le CLI, Telegram, Discord, Slack et toutes les plateformes de la passerelle reçoivent les tokens au fur et à mesure de leur génération
- Les appels d’outils de longue durée diffusent la progression en temps réel
Cela a fondamentalement changé le modèle d’interaction. Les utilisateurs pouvaient désormais interrompre en cours de génération, rediriger l’agent ou poser des questions de clarification sans attendre un bloc de réponse complet.
# Le streaming est maintenant activé par défaut — aucune configuration nécessaire
hermes
> Écris un script Python qui traite un fichier de log de 10 Go
# Les tokens sont diffusés au fur et à mesure de leur génération. Tu peux :
# - Voir exactement ce que l'agent pense en temps réel
# - Interrompre avec Ctrl+C s'il part dans la mauvaise direction
# - Rediriger en cours de route : « utilise plutôt Rust »
2. Architecture de Plugins de Première Classe
Le système de plugins a été la clé de la croissance de la communauté. Déposez des fichiers Python dans ~/.hermes/plugins/ et Hermes les détecte automatiquement — outils personnalisés, commandes slash, hooks de cycle de vie, le tout sans forker le dépôt.
# ~/.hermes/plugins/mon_plugin.py
from hermes.plugin import Plugin, tool
class MonPlugin(Plugin):
"""Un plugin qui ajoute un outil météo personnalisé."""
@tool
def obtenir_meteo(self, ville: str) -> dict:
"""Obtenir la météo actuelle d'une ville."""
import requests
resp = requests.get(f"https://api.meteo.exemple/{ville}")
return resp.json()
@tool
def analyser_sentiment(self, texte: str) -> dict:
"""Analyser le sentiment d'un texte."""
return {"sentiment": "positif", "score": 0.85}
Hooks de cycle de vie du plugin :
on_load— s’exécute lors du premier chargement du pluginon_unload— nettoyage avant suppressionon_tool_call— intercepter et modifier tout appel d’outilon_response— post-traiter les réponses de l’agent
3. Fournisseur Natif Anthropic
Avant v0.3.0, utiliser les modèles Claude signifiait passer par OpenRouter. Le fournisseur natif Anthropic a tout changé.
Ce qu’il débloque :
- Appels directs à l’API Anthropic — latence réduite, sans intermédiaire OpenRouter
- Détection automatique des identifiants Claude Code — si vous avez utilisé Claude Code, Hermes trouve vos identifiants automatiquement
- Flux OAuth PKCE — authentification sécurisée et conforme aux normes avec renouvellement de token
- Mise en cache native des prompts — la mise en cache d’Anthropic réduit les coûts des longues conversations jusqu’à 90 %
# Lancer la configuration avec le fournisseur Anthropic
hermes setup --provider anthropic
# Ou basculer vers celui-ci en cours de session
/hermes model claude-sonnet-4-20250514
# Hermes détecte automatiquement les identifiants Claude Code s'ils sont disponibles
# hermes.config.yaml
providers:
- name: anthropic
provider: anthropic
model: claude-sonnet-4-20250514
prompt_caching: true
4. Approbations Intelligentes + Commande /stop
Inspiré par l’approche de Codex pour la sécurité des commandes, le système d’approbation intelligent apprend quelles commandes sont sûres et mémorise vos préférences.
> Exécuter : pip install pandas numpy scikit-learn
# Première fois : « Approuver cette commande pip install ? [o/n/toujours] »
# Choisir 't' (toujours) → plus jamais demandé pour pip install
> Exécuter : rm -rf /tmp/build-cache
# « Approuver cette suppression ? » — catégorie différente, redemande
La commande /stop vous donne un frein d’urgence :
# L'agent part dans une mauvaise direction — arrêter immédiatement
/stop
5. Mode Vocal
Le mode vocal est arrivé dans v0.3.0 sur trois surfaces :
CLI : Appuyer pour Parler
# Maintenir Espace pour parler, relâcher pour envoyer
hermes --voice
# Ou basculer le mode vocal en cours de session
/voice
Plateformes de Messagerie : Notes Vocales
- Envoyez des notes vocales sur Telegram ou Discord — Hermes transcrit et répond
- Les transcriptions utilisent faster-whisper pour un traitement local gratuit
Canaux Vocaux Discord
- Hermes peut rejoindre les canaux vocaux Discord
- Écoute les mentions et répond verbalement
# hermes.config.yaml — configuration vocale
voice:
stt:
enabled: true
engine: faster-whisper # local, gratuit, pas de clé API nécessaire
tts:
enabled: true
engine: openai
6. Exécution Concurrente d’Outils
Plusieurs appels d’outils indépendants s’exécutent désormais en parallèle via ThreadPoolExecutor.
Avant v0.3.0 : Exécution séquentielle — ~9 secondes pour 3 recherches Après v0.3.0 : Exécution parallèle — ~3 secondes pour 3 recherches
7. Intégration de la Mémoire Honcho
Honcho (par @erosika) a apporté la modélisation dialectique de l’utilisateur à Hermes — l’agent construit un modèle de théorie de l’esprit à votre sujet au fil du temps.
# hermes.config.yaml
memory:
honcho:
enabled: true
recall_mode: recent # recent | relevant | all
max_memories_per_turn: 5
8. Anonymisation PII
Lorsque privacy.redact_pii est activé, les informations personnelles identifiables sont automatiquement supprimées avant l’envoi du contexte aux fournisseurs LLM.
privacy:
redact_pii: true
L’anonymisation a lieu localement avant que toute donnée ne quitte votre machine.
9. /browser connect via CDP
Attachez les outils du navigateur à une instance Chrome active via le protocole Chrome DevTools.
# Démarrer Chrome avec le débogage à distance activé
chrome --remote-debugging-port=9222
# Dans Hermes, s'y connecter
/browser connect --port 9222
10. Fournisseur Vercel AI Gateway
Acheminez Hermes via la passerelle AI de Vercel pour accéder à leur catalogue de modèles et à leur infrastructure.
providers:
- name: vercel
provider: vercel-ai-gateway
api_key: ${VERCEL_AI_GATEWAY_KEY}
11. Routeur de Fournisseurs Centralisé
Le système de fournisseurs a été entièrement reconstruit autour d’une seule API call_llm.
# Basculer entre les modèles en toute transparence
/hermes model gpt-5 # → OpenAI
/hermes model claude-sonnet-4 # → Anthropic (détecté automatiquement)
/hermes model grok-3 # → xAI
# La correspondance par préfixe fonctionne aussi
/mod gpt-5 # se résout en /model gpt-5
12. Serveur ACP — Intégration IDE
VS Code, Zed et JetBrains peuvent désormais se connecter à Hermes en tant que backend d’agent via le protocole Agent Communication.
# Démarrer Hermes en mode serveur ACP
hermes serve --acp
13. Mode Shell Persistant
Par @alt-glitch. Les backends de terminal locaux et SSH conservent l’état du shell entre les appels d’outils.
> cd /mon-projet
> ls
# (même shell, l'état persiste)
# Affiche le contenu de /mon-projet ✓
> export DATABASE_URL=postgres://localhost/mydb
> python manage.py migrate
# DATABASE_URL est défini ✓
14. Agentic On-Policy Distillation (OPD)
Nouvel environnement d’entraînement RL pour distiller les politiques d’agent, étendant l’écosystème d’entraînement Atropos.
Améliorations CLI & UX
| Fonctionnalité | Description |
|---|---|
| Barre d’État Persistante | Modèle, fournisseur et compteurs de tokens toujours visibles |
| Autocomplétion des Chemins | Tab-complétion des chemins de fichiers dans le prompt |
Commande /plan |
Générer des plans d’implémentation à partir de spécifications |
| Correspondance par Préfixe | /mod → /model, /sta → /status |
| Préchargement des Skills | Skills chargées au lancement, prêtes avant la première requête |
Configuration
- Migration depuis OpenClaw — migration transparente depuis OpenClaw lors de la première installation
- Configuration headless — le flux complet fonctionne sur les serveurs SSH uniquement
- Rechargement
.env— les changements d’environnement sont détectés sans redémarrage
Mises à Jour des Plateformes
Cœur de la Passerelle
| Fonctionnalité | Impact |
|---|---|
| Mode Service Système | Exécuter en tant que service systemd au niveau système |
| Rechargement à Chaud du Raisonnement | Modifier les paramètres de raisonnement sans redémarrer |
| Isolation de Session par Utilisateur | Les chats de groupe ne partagent plus l’état entre utilisateurs |
| Détection Automatique SSL | Fonctionne sur NixOS et les systèmes non standard |
Telegram
- Mise en mémoire tampon des groupes de médias empêche les interruptions par rafales de photos
- Nouvelle tentative en cas d’échecs TLS transitoires
Discord
- Commande
/threadavec configurationauto_thread - Création automatique de fil lors d’une @mention
Slack
- Refonte complète de la gestion des fils de discussion
- Correction de la longueur maximale des messages (3900 → 39000)
- Suivi des UID IMAP et vérification TLS SMTP
- Option
skip_attachmentsvia config.yaml
Nouvelles Skills
| Skill | Description |
|---|---|
| Linear | Intégration de gestion de projet |
| X/Twitter | Réseaux sociaux via x-cli |
| Telephony | Twilio SMS et appels IA |
| 1Password | Gestion des mots de passe (par @arceus77-7) |
| NeuroSkill BCI | Intégration d’interface cerveau-ordinateur |
| Blender MCP | Modélisation 3D |
| OSS Security Forensics | Kit d’analyse de sécurité |
| Parallel CLI | Skill de recherche |
| OpenCode | Skill CLI |
| ASCII Video | Refactorisé (par @SHL0MS) |
Améliorations MCP
- Chargement sélectif d’outils — filtrer les outils MCP disponibles
- Rechargement automatique — les outils MCP se rechargent lors des changements de configuration
- Corrections de connexion npx — résolution des échecs de connexion stdio
Système Cron
- Un seul outil
cronjobremplace plusieurs commandes - Les tâches persistent dans SQLite — survivent aux redémarrages
- Surcharges d’exécution par tâche (provider, model, base_url)
Sécurité
- Analyse pré-exécution Tirith — analyse statique des commandes avant exécution
- Suppression des variables d’environnement du fournisseur — toutes les variables d’env du fournisseur/passerelle supprimées des sous-processus
- Montage Docker cwd explicite — les montages de répertoires hôtes sont maintenant explicites, jamais automatiques
Corrections de Bugs Clés
| Problème | Correction |
|---|---|
/status affichait 0 token |
Affiche maintenant l’état en direct et le compteur de tokens |
| Endpoints de modèles personnalisés cassés | Résolution d’endpoint restaurée |
| Outils MCP invisibles jusqu’au redémarrage | Rechargement automatique au changement de config |
Sous-processus du terminal héritant OPENAI_BASE_URL |
Variables d’env supprimées de tous les sous-processus |
| Dégradation des performances de la passerelle | Accumulation des gestionnaires de logs corrigée |
| Tâches cron non persistantes | Maintenant stockées dans SQLite |
| Configuration bloquée en SSH headless | Flux headless complet |
| Changement de modèle sans effet | Résolution du fournisseur au changement corrigée |
Ce Que la Communauté a Dit
“Hermes n’est pas un copilote de code attaché à un IDE. Ce n’est pas un wrapper de chatbot autour d’une seule API. C’est un agent autonome persistant, multi-plateforme et multi-modèle qui grandit avec son déploiement.” — ZHC Institute, Field Notes sur v0.3.0
Changements Rupteurs
- Format de configuration du fournisseur mis à jour — les configurations personnalisées de v0.2.0 peuvent nécessiter une restructuration
- Les configurations OpenClaw héritées doivent passer par le flux de migration (
hermes claw migrate)
Mise à Niveau
hermes update
Migration depuis OpenClaw :
hermes claw migrate
Pour les nouvelles installations, consultez le guide d’installation.
← Hermes Agent Changelog