v0.3.0

Hermes Agent v0.3.0 — Streaming, Plugins et Multi-Fournisseur


Aperçu

v0.3.0 — Streaming, Plugins et Multi-Fournisseur. Publié le 17 mars 2026, seulement 5 jours après la première version publique v0.2.0. Cette version a transformé Hermes Agent d’un agent open-source prometteur en une plateforme d’opérations autonomes de qualité production.

Si v0.2.0 a montré au monde ce que Hermes pouvait faire, v0.3.0 lui a donné l’allure d’un produit abouti. La diffusion de tokens en streaming a éliminé le problème de « fixer un écran vide ». L’architecture de plugins a ouvert la porte aux contributions de la communauté sans toucher au code central. Et la refonte du système de fournisseurs signifiait que vous pouviez basculer entre OpenAI, Anthropic, les plus de 200 modèles d’OpenRouter ou n’importe quel endpoint personnalisé avec une seule commande.

La réponse de la communauté a été immédiate et massive : au moment de cette publication, Hermes Agent était déjà appelé « le système d’exploitation pour les opérations autonomes » par la communauté Zero-Human Companies.

Statistiques clés : ~50+ corrections de bugs · 14 fonctionnalités majeures · 10+ nouvelles skills · 4 refontes de plateformes de messagerie


Fonctionnalités Majeures

1. Infrastructure de Streaming Unifiée

Le changement le plus visible pour l’utilisateur dans v0.3.0 : les réponses sont désormais diffusées token par token dans le CLI et sur toutes les plateformes de la passerelle.

Ce qui change :

  • Chaque fournisseur diffuse désormais via une infrastructure unifiée
  • Le CLI, Telegram, Discord, Slack et toutes les plateformes de la passerelle reçoivent les tokens au fur et à mesure de leur génération
  • Les appels d’outils de longue durée diffusent la progression en temps réel

Cela a fondamentalement changé le modèle d’interaction. Les utilisateurs pouvaient désormais interrompre en cours de génération, rediriger l’agent ou poser des questions de clarification sans attendre un bloc de réponse complet.

# Le streaming est maintenant activé par défaut — aucune configuration nécessaire
hermes
> Écris un script Python qui traite un fichier de log de 10 Go

# Les tokens sont diffusés au fur et à mesure de leur génération. Tu peux :
# - Voir exactement ce que l'agent pense en temps réel
# - Interrompre avec Ctrl+C s'il part dans la mauvaise direction
# - Rediriger en cours de route : « utilise plutôt Rust »

2. Architecture de Plugins de Première Classe

Le système de plugins a été la clé de la croissance de la communauté. Déposez des fichiers Python dans ~/.hermes/plugins/ et Hermes les détecte automatiquement — outils personnalisés, commandes slash, hooks de cycle de vie, le tout sans forker le dépôt.

# ~/.hermes/plugins/mon_plugin.py
from hermes.plugin import Plugin, tool

class MonPlugin(Plugin):
    """Un plugin qui ajoute un outil météo personnalisé."""

    @tool
    def obtenir_meteo(self, ville: str) -> dict:
        """Obtenir la météo actuelle d'une ville."""
        import requests
        resp = requests.get(f"https://api.meteo.exemple/{ville}")
        return resp.json()

    @tool
    def analyser_sentiment(self, texte: str) -> dict:
        """Analyser le sentiment d'un texte."""
        return {"sentiment": "positif", "score": 0.85}

Hooks de cycle de vie du plugin :

  • on_load — s’exécute lors du premier chargement du plugin
  • on_unload — nettoyage avant suppression
  • on_tool_call — intercepter et modifier tout appel d’outil
  • on_response — post-traiter les réponses de l’agent

3. Fournisseur Natif Anthropic

Avant v0.3.0, utiliser les modèles Claude signifiait passer par OpenRouter. Le fournisseur natif Anthropic a tout changé.

Ce qu’il débloque :

  • Appels directs à l’API Anthropic — latence réduite, sans intermédiaire OpenRouter
  • Détection automatique des identifiants Claude Code — si vous avez utilisé Claude Code, Hermes trouve vos identifiants automatiquement
  • Flux OAuth PKCE — authentification sécurisée et conforme aux normes avec renouvellement de token
  • Mise en cache native des prompts — la mise en cache d’Anthropic réduit les coûts des longues conversations jusqu’à 90 %
# Lancer la configuration avec le fournisseur Anthropic
hermes setup --provider anthropic

# Ou basculer vers celui-ci en cours de session
/hermes model claude-sonnet-4-20250514

# Hermes détecte automatiquement les identifiants Claude Code s'ils sont disponibles
# hermes.config.yaml
providers:
  - name: anthropic
    provider: anthropic
    model: claude-sonnet-4-20250514
    prompt_caching: true

4. Approbations Intelligentes + Commande /stop

Inspiré par l’approche de Codex pour la sécurité des commandes, le système d’approbation intelligent apprend quelles commandes sont sûres et mémorise vos préférences.

> Exécuter : pip install pandas numpy scikit-learn
# Première fois : « Approuver cette commande pip install ? [o/n/toujours] »
# Choisir 't' (toujours) → plus jamais demandé pour pip install

> Exécuter : rm -rf /tmp/build-cache
# « Approuver cette suppression ? » — catégorie différente, redemande

La commande /stop vous donne un frein d’urgence :

# L'agent part dans une mauvaise direction — arrêter immédiatement
/stop

5. Mode Vocal

Le mode vocal est arrivé dans v0.3.0 sur trois surfaces :

CLI : Appuyer pour Parler

# Maintenir Espace pour parler, relâcher pour envoyer
hermes --voice

# Ou basculer le mode vocal en cours de session
/voice

Plateformes de Messagerie : Notes Vocales

  • Envoyez des notes vocales sur Telegram ou Discord — Hermes transcrit et répond
  • Les transcriptions utilisent faster-whisper pour un traitement local gratuit

Canaux Vocaux Discord

  • Hermes peut rejoindre les canaux vocaux Discord
  • Écoute les mentions et répond verbalement
# hermes.config.yaml — configuration vocale
voice:
  stt:
    enabled: true
    engine: faster-whisper  # local, gratuit, pas de clé API nécessaire
  tts:
    enabled: true
    engine: openai

6. Exécution Concurrente d’Outils

Plusieurs appels d’outils indépendants s’exécutent désormais en parallèle via ThreadPoolExecutor.

Avant v0.3.0 : Exécution séquentielle — ~9 secondes pour 3 recherches Après v0.3.0 : Exécution parallèle — ~3 secondes pour 3 recherches

7. Intégration de la Mémoire Honcho

Honcho (par @erosika) a apporté la modélisation dialectique de l’utilisateur à Hermes — l’agent construit un modèle de théorie de l’esprit à votre sujet au fil du temps.

# hermes.config.yaml
memory:
  honcho:
    enabled: true
    recall_mode: recent  # recent | relevant | all
    max_memories_per_turn: 5

8. Anonymisation PII

Lorsque privacy.redact_pii est activé, les informations personnelles identifiables sont automatiquement supprimées avant l’envoi du contexte aux fournisseurs LLM.

privacy:
  redact_pii: true

L’anonymisation a lieu localement avant que toute donnée ne quitte votre machine.

9. /browser connect via CDP

Attachez les outils du navigateur à une instance Chrome active via le protocole Chrome DevTools.

# Démarrer Chrome avec le débogage à distance activé
chrome --remote-debugging-port=9222

# Dans Hermes, s'y connecter
/browser connect --port 9222

10. Fournisseur Vercel AI Gateway

Acheminez Hermes via la passerelle AI de Vercel pour accéder à leur catalogue de modèles et à leur infrastructure.

providers:
  - name: vercel
    provider: vercel-ai-gateway
    api_key: ${VERCEL_AI_GATEWAY_KEY}

11. Routeur de Fournisseurs Centralisé

Le système de fournisseurs a été entièrement reconstruit autour d’une seule API call_llm.

# Basculer entre les modèles en toute transparence
/hermes model gpt-5          # → OpenAI
/hermes model claude-sonnet-4 # → Anthropic (détecté automatiquement)
/hermes model grok-3          # → xAI

# La correspondance par préfixe fonctionne aussi
/mod gpt-5    # se résout en /model gpt-5

12. Serveur ACP — Intégration IDE

VS Code, Zed et JetBrains peuvent désormais se connecter à Hermes en tant que backend d’agent via le protocole Agent Communication.

# Démarrer Hermes en mode serveur ACP
hermes serve --acp

13. Mode Shell Persistant

Par @alt-glitch. Les backends de terminal locaux et SSH conservent l’état du shell entre les appels d’outils.

> cd /mon-projet
> ls
# (même shell, l'état persiste)
# Affiche le contenu de /mon-projet ✓
> export DATABASE_URL=postgres://localhost/mydb
> python manage.py migrate
# DATABASE_URL est défini ✓

14. Agentic On-Policy Distillation (OPD)

Nouvel environnement d’entraînement RL pour distiller les politiques d’agent, étendant l’écosystème d’entraînement Atropos.


Améliorations CLI & UX

Fonctionnalité Description
Barre d’État Persistante Modèle, fournisseur et compteurs de tokens toujours visibles
Autocomplétion des Chemins Tab-complétion des chemins de fichiers dans le prompt
Commande /plan Générer des plans d’implémentation à partir de spécifications
Correspondance par Préfixe /mod/model, /sta/status
Préchargement des Skills Skills chargées au lancement, prêtes avant la première requête

Configuration

  • Migration depuis OpenClaw — migration transparente depuis OpenClaw lors de la première installation
  • Configuration headless — le flux complet fonctionne sur les serveurs SSH uniquement
  • Rechargement .env — les changements d’environnement sont détectés sans redémarrage

Mises à Jour des Plateformes

Cœur de la Passerelle

Fonctionnalité Impact
Mode Service Système Exécuter en tant que service systemd au niveau système
Rechargement à Chaud du Raisonnement Modifier les paramètres de raisonnement sans redémarrer
Isolation de Session par Utilisateur Les chats de groupe ne partagent plus l’état entre utilisateurs
Détection Automatique SSL Fonctionne sur NixOS et les systèmes non standard

Telegram

  • Mise en mémoire tampon des groupes de médias empêche les interruptions par rafales de photos
  • Nouvelle tentative en cas d’échecs TLS transitoires

Discord

  • Commande /thread avec configuration auto_thread
  • Création automatique de fil lors d’une @mention

Slack

  • Refonte complète de la gestion des fils de discussion
  • Correction de la longueur maximale des messages (3900 → 39000)

Email

  • Suivi des UID IMAP et vérification TLS SMTP
  • Option skip_attachments via config.yaml

Nouvelles Skills

Skill Description
Linear Intégration de gestion de projet
X/Twitter Réseaux sociaux via x-cli
Telephony Twilio SMS et appels IA
1Password Gestion des mots de passe (par @arceus77-7)
NeuroSkill BCI Intégration d’interface cerveau-ordinateur
Blender MCP Modélisation 3D
OSS Security Forensics Kit d’analyse de sécurité
Parallel CLI Skill de recherche
OpenCode Skill CLI
ASCII Video Refactorisé (par @SHL0MS)

Améliorations MCP

  • Chargement sélectif d’outils — filtrer les outils MCP disponibles
  • Rechargement automatique — les outils MCP se rechargent lors des changements de configuration
  • Corrections de connexion npx — résolution des échecs de connexion stdio

Système Cron

  • Un seul outil cronjob remplace plusieurs commandes
  • Les tâches persistent dans SQLite — survivent aux redémarrages
  • Surcharges d’exécution par tâche (provider, model, base_url)

Sécurité

  • Analyse pré-exécution Tirith — analyse statique des commandes avant exécution
  • Suppression des variables d’environnement du fournisseur — toutes les variables d’env du fournisseur/passerelle supprimées des sous-processus
  • Montage Docker cwd explicite — les montages de répertoires hôtes sont maintenant explicites, jamais automatiques

Corrections de Bugs Clés

Problème Correction
/status affichait 0 token Affiche maintenant l’état en direct et le compteur de tokens
Endpoints de modèles personnalisés cassés Résolution d’endpoint restaurée
Outils MCP invisibles jusqu’au redémarrage Rechargement automatique au changement de config
Sous-processus du terminal héritant OPENAI_BASE_URL Variables d’env supprimées de tous les sous-processus
Dégradation des performances de la passerelle Accumulation des gestionnaires de logs corrigée
Tâches cron non persistantes Maintenant stockées dans SQLite
Configuration bloquée en SSH headless Flux headless complet
Changement de modèle sans effet Résolution du fournisseur au changement corrigée

Ce Que la Communauté a Dit

“Hermes n’est pas un copilote de code attaché à un IDE. Ce n’est pas un wrapper de chatbot autour d’une seule API. C’est un agent autonome persistant, multi-plateforme et multi-modèle qui grandit avec son déploiement.” — ZHC Institute, Field Notes sur v0.3.0


Changements Rupteurs

  • Format de configuration du fournisseur mis à jour — les configurations personnalisées de v0.2.0 peuvent nécessiter une restructuration
  • Les configurations OpenClaw héritées doivent passer par le flux de migration (hermes claw migrate)

Mise à Niveau

hermes update

Migration depuis OpenClaw :

hermes claw migrate

Pour les nouvelles installations, consultez le guide d’installation.


Changelog complet sur GitHub

← Hermes Agent Changelog