Last updated on

Hermes v0.20.0 Herald : plongée dans la voix conversationnelle, les wake words, les citations sourcées et A2A


Hermes Agent v0.20.0 (nom de code Herald) est sorti le 3 août 2026. Dans la mythologie grecque, le héraut est le messager des dieux — et cette version permet enfin à Hermes de mériter son nom : voix conversationnelle en temps réel que vous pouvez interrompre en pleine phrase, wake words mains libres, voix sur toutes les plateformes, des recherches appuyées par des citations vérifiables, l’interopérabilité Agent-to-Agent (A2A) et des webhooks sortants signés qui poussent des événements vers vos propres systèmes. C’est l’une des plus grosses versions de l’histoire du projet : environ 3 650 commits, 1 400 PR fusionnées, 5 200 fichiers modifiés, ~1 200 issues fermées et 647 contributeurs depuis la v0.19.0.

Cet article ne répète pas les notes de version mot pour mot. Il décortique plutôt la mise à jour en fonctionnalités les plus importantes pour les développeurs, explique pourquoi elles comptent et montre comment les utiliser concrètement. Pour le changelog complet, consultez nos notes de version v0.19.0 (les notes de la v0.20.0 seront également publiées sur ce site).

1. Le titre : parlez à Hermes — une vraie conversation, pas un répondeur

Le mode vocal fonctionnait jusqu’ici comme un talkie-walkie : vous parlez, vous attendez que la réponse entière soit générée, puis vous écoutez un long fichier audio. La v0.20 change tout cela :

  • Parle en réfléchissant — Hermes synthétise la parole clause par clause pendant que la réponse est diffusée en streaming
  • Barge-in — vous pouvez commencer à parler en pleine phrase ; Hermes s’arrête, écoute, et le modèle est informé que vous l’avez interrompu, afin d’ajuster la suite
  • Détection de silence attentive à l’occupation — il ne parle jamais par-dessus vous

On dirait un appel téléphonique : dites « Hey Hermes, quel temps fait-il aujourd’hui ? » — puis, à mi-réponse, ajoutez « …et vérifie aussi demain. » Il corrige immédiatement sa trajectoire. Le résumé officiel : on passe de « l’échange de messages vocaux » à une vraie conversation.

Cela fonctionne en mode vocal CLI, sur le bureau et via tous les adaptateurs de passerelle compatibles audio.

2. Wake words : parlez à votre terminal depuis l’autre bout de la pièce

En complément de la voix conversationnelle, voici la détection de wake word sur l’appareil :

  • Phrases à vocabulaire ouvert — utilisez « hey Hermes » ou choisissez n’importe quelle phrase
  • Détection sur l’appareil — aucun audio ne quitte votre machine pendant l’attente
  • Routage vocal multi-profils — différents wake words peuvent atteindre différents profils
  • Dites « stop » sur n’importe quelle surface pour terminer la conversation vocale sans les mains

Vous pouvez être à l’autre bout de la pièce, dire « Hey Hermes » au Hermes Desktop affiché sur un second écran, et il se réveille et répond. Votre terminal devient quelque chose à qui l’on parle depuis l’autre bout de la pièce.

3. La voix partout : notes vocales en entrée, réponses TTS automatiques en sortie

Vous pouvez désormais envoyer une note vocale à Hermes sur WhatsApp, Feishu, DingTalk, LINE, QQ, Photon ou Weixin — elle est transcrite et traitée, avec des réponses TTS automatiques adaptées à la plateforme (de l’opus là où les plateformes veulent de l’opus, des sous-titres correctement attachés).

Le STT (reconnaissance vocale) est également entièrement configurable :

  • Sa propre catégorie dans hermes tools, des bascules dans l’interface graphique et des menus déroulants dans le tableau de bord
  • Une résolution unifiée de la langue — corrigeant la classe de bugs classique des « transcriptions qui reviennent dans la mauvaise langue »
  • Le support d’OpenAI gpt-transcribe

Et tous les fournisseurs TTS partagent un même prétraitement unifié du texte parlé qui nettoie le markdown, le code et les URLs de la parole avant qu’elle ne soit prononcée.

4. Une recherche digne de confiance : la compétence grounded-citations

La nouvelle compétence grounded-citations fait produire à Hermes des recherches où chaque affirmation est étayée par une source vérifiable :

  • Des citations confrontées au texte réel des pages — pas d’hallucinations issues de la mémoire
  • Les citations pointent vers la preuve exacte
  • Mode vérification des faits — appliquez la même mécanique à n’importe quel document ou affirmation ; il vous dit ce qui est vérifié, ce qui ne l’est pas et ce qui n’a pas pu être confirmé

La formulation officielle : c’est la différence entre « ça semble juste » et « source prouvée ». Si vous utilisez Hermes pour la recherche, c’est un incontournable.

5. Webhooks sortants : Hermes pousse des événements vers vos systèmes

Jusqu’ici, s’intégrer à Hermes signifiait interroger (polling) ou écouter sur une plateforme. Désormais, Hermes pousse des événements de cycle de vie signés (activité de session, fins de tour, événements d’outils) vers n’importe quel endpoint HTTP que vous enregistrez :

  • Signatures HMAC — les récepteurs peuvent vérifier l’authenticité
  • Branchez-le sur votre CI, votre domotique, vos tableaux de bord ou tout service qui parle HTTP
  • Aucune boucle de polling nécessaire

Nous avons écrit un guide pratique sur les notifications métier par webhook Hermes plus tôt — cette version complète le volet sortant de l’histoire.

6. L’application de bureau devient une plateforme : Artifacts, plugin SDK, saisie rapide

Hermes Desktop a cessé d’être un simple client de chat pour devenir un atelier de travail :

  • Artifacts — des cartes versionnées avec aperçu en direct sandboxé dans un visualiseur latéral droit ; les applications HTML générées s’exécutent en toute sécurité à côté du chat
  • Plugin SDK — Kanban est livré comme plugin fondateur du bureau ; ctx.download remet des fichiers aux utilisateurs ; placement des panneaux flottants
  • Fenêtre de saisie rapide — un raccourci global capture une pensée dans n’importe quelle session, depuis n’importe où dans votre OS
  • Fenêtres GUI multiples

Tout ce que vous avez créé avec Hermes sur toutes les plateformes (images issues des outils reliés à MCP, applications HTML, etc.) apparaît dans les Artifacts — et comme les aperçus sont sandboxés, les tests sont plus sûrs.

7. A2A v1.0 : les agents parlent enfin un protocole commun

Hermes embarque désormais un plugin implémentant le protocole Agent-to-Agent, ce qui lui permet de découvrir, de parler à et d’être piloté par d’autres agents compatibles A2A. Cela clôt l’issue #514 — l’une des plus anciennes demandes de fonctionnalité ouvertes du dépôt.

La valeur pratique : si vos workflows s’étendent sur des stacks d’agents hétérogènes, Hermes dispose maintenant d’un protocole filaire standard pour les relier. Laissez Hermes orchestrer vos autres agents — ou laissez un autre agent orchestrer Hermes. Les compétences et API branchées sur chaque agent deviennent pilotables comme un seul système.

8. Une vague de commandes CLI pour utilisateurs avancés : !, /init, /diff, /context, /focus

La v0.20 apporte une vague de commandes CLI pratiques :

Commande Ce qu’elle fait
!command Exécute une commande shell instantanément sans dépenser un tour de modèle
/init Analyse votre projet et génère (ou met à jour) un fichier AGENTS.md
/diff Affiche les modifications indexées / toutes / de session depuis n’importe quelle surface
/context Détaille exactement ce qui remplit votre fenêtre de contexte
/focus Vue à sortie réduite avec récupération des lignes masquées
Ctrl+S Met de côté un prompt à moitié écrit dans un panneau navigable

En plus, hermes import-agent migre votre configuration Claude Code ou Codex CLI vers Hermes en une seule commande.

9. Corrigez l’agent en cours de tour : des redirections, pas des redémarrages

Si Hermes part dans la mauvaise direction, vous n’avez plus besoin de faire /stop et de tout réexpliquer. Tapez une correction pendant qu’il travaille et le tour en cours est redirigé :

  • Le travail en cours est préservé
  • Le prompt d’origine est conservé
  • L’agent corrige sa trajectoire avec vos nouvelles instructions

Combiné à l’abandon du brouillon par double Échap et à une pile d’annulation dans le composeur, piloter l’agent devient une édition, pas un redémarrage.

10. Des outils qui se réparent eux-mêmes

Une vague d’améliorations d’auto-récupération fait que l’agent gaspille beaucoup moins de tours sur les frictions d’outils :

  • La sortie terminal tronquée est déversée dans un fichier que l’agent peut relire
  • patch détecte les modifications déjà appliquées et diagnostique les écarts d’espacement
  • write_file vérifie le contenu sur disque
  • Les recherches sans résultat sondent les quasi-correspondances et se rétablissent
  • La limite d’itérations d’appel d’outils par défaut passe de 90 à 500 — les longues exécutions autonomes ne butent plus sur un mur artificiel

11. Une compression qui respecte votre conversation

La compression de contexte a été profondément remaniée :

  • Élagage proactif des résultats d’outils pour les modèles à grande fenêtre
  • Micro-compaction par tour qui amortit le coût au lieu d’une seule pause géante
  • Queue garantie de N messages utilisateur (compression.min_tail_user_messages) — la conversation récente survit toujours
  • Délais d’attente sensibles à la progression qui cessent de pénaliser les modèles de résumé lents
  • Défense anti-compétence fantôme — une compétence élaguée ne peut plus hanter silencieusement une session
  • Les seuils sont configurables par modèle et en tokens absolus (compression.threshold_tokens)

Les longues sessions restent cohérentes et cessent de caler.

12. Les Smart Approvals passent à la vitesse supérieure

Les Smart Approvals ont gagné plusieurs améliorations :

  • hermes approvals suggest — extrait de votre historique d’approbations des propositions d’allowlist
  • Politique d’approbation intelligente personnalisable
  • Disjoncteur anti-refus consécutifs — stoppe net une boucle défaillante
  • Les approbations d’appairage du bureau sont désormais correctes vis-à-vis du profil, avec une interface dédiée pour y répondre
  • Un nouveau portail d’approbation pour les commandes de redirection de démon docker/podman

Moins de clics sur « approuver », sans céder le moindre contrôle. Pour le guide complet de configuration, voir notre guide de configuration des Smart Approvals (les vraies clés de configuration sont approvals.mode / approvals.deny — ne faites pas confiance aux tutoriels obsolètes).

13. Plus rapide partout, encore

Les performances continuent de s’accumuler :

  • Le cold start de hermes -w est passé d’environ 14 s à ~1,8 s
  • Les no-ops de hermes update sont 2 à 6 s plus rapides
  • Les SDK lourds sont chargés paresseusement hors du chemin d’import
  • Les lectures de configuration ne font plus de copie profonde — 54× plus rapide sur le portail de télémétrie
  • Les schémas d’outils sont mis en cache sur l’Anthropic natif sans perte d’historique
  • Le bureau a livré sa deuxième vague 60fps — coût de streaming indépendant de la longueur de la transcription, glissement à 60fps avec cinq onglets en streaming, CPU au repos quasi nul

Une précision : le souvent cité « premier token 4,3 s → 0,9 s » était l’optimisation de la v0.19.0. La v0.20 s’appuie dessus avec des gains de cold start, de cache et de rendu du bureau.

14. De nouveaux endroits où s’exécuter et être joint

  • Buzz débarque comme plateforme de passerelle intégrée (messagerie Nostr de Block, transport WebSocket natif, authentification NIP-42)
  • Le fournisseur Vercel AI Gateway et le backend terminal Vercel Sandbox reviennent, modernisés
  • Le bureau gagne un mode de connexion backend distant SSH
  • Relay a achevé quatre phases de parité — médias, invites interactives, cycle de vie des fils, indicateurs de frappe
  • Synchronisation des compétences HSP personnelles et d’organisation

15. Sécurité & fiabilité

  • Le pare-feu de sortie Iron-proxy contre l’injection d’identifiants est revenu
  • Récupérations SSRF-safe épinglées DNS + allowlist du CDN Slack
  • Masquage strict aux frontières de compression ; ReDoS éliminé dans les motifs de masquage des clés de configuration
  • Vague de durcissement Windows — classe de bugs de décodage des sous-processus en mode texte fermée dans tout le dépôt, flashs de console masqués
  • Quatre correctifs d’intégrité de l’état de session + optimisation de la disposition FTS (incluant l’indexation de bigrammes CJK)

Comment mettre à jour

# Existing installs
hermes update

# Fresh install
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash

Remarque : cette version nécessite Node 26 (géré par les installateurs, les voies d’auto-réparation et de mise à niveau), et les canaux brew + pip/PyPI wheel sont retirés — les canaux pris en charge sont l’installateur shell, Docker et Nix.

Résumé

Le fil conducteur de la version Herald, c’est le messager : il vous parle (voix), porte la parole aux autres agents (A2A), annonce les événements à vos systèmes (webhooks) et montre ses preuves (citations). Combinée à la poussée du bureau comme plateforme, aux commandes CLI avancées, à une compression plus intelligente et à des approbations qui ont grandi, la v0.20 fait passer Hermes de « outil » à « collègue qui parle, collabore et cite ses sources ».

Vous n’avez pas encore essayé la voix ? Mettez à jour et dites quelque chose à Hermes — puis interrompez-le en pleine phrase. La sensation est réellement différente. Nouveau sur Hermes ? Commencez par le guide d’installation, ou redécouvrez la plongée dans la v0.19.0 Quicksilver pour l’histoire des gains de vitesse derrière cette version.