Hermes v0.20.0 Herald im Detail: Konversationssprache, Wake Words, belegte Zitate und A2A

Hermes Agent v0.20.0 (Codename Herald) erschien am 3. August 2026. In der griechischen Mythologie ist der Herold der Bote der Götter — und mit diesem Release lebt Hermes den Namen endlich aus: Echtzeit-Konversationssprache, die du mitten im Satz unterbrechen kannst, freihändige Wake Words, Sprache auf jeder Plattform, Recherche mit überprüfbaren Zitaten, Agent-to-Agent (A2A)-Interoperabilität und signierte ausgehende Webhooks, die Ereignisse an deine eigenen Systeme pushen. Es ist eines der größten Releases in der Projektgeschichte: rund 3.650 Commits, 1.400 gemergte PRs, 5.200 geänderte Dateien, ~1.200 geschlossene Issues und 647 Mitwirkende seit v0.19.0.
Dieser Artikel wiederholt die Release Notes nicht wortwörtlich. Stattdessen zerlegt er das Update in die Features, die für Entwickler am wichtigsten sind, erklärt, warum sie wichtig sind, und zeigt, wie man sie tatsächlich nutzt. Das vollständige Changelog findest du in den v0.19.0 Release Notes (die v0.20.0-Notes werden ebenfalls auf dieser Seite veröffentlicht).
1. Die Überschrift: Sprich mit Hermes — ein echtes Gespräch, keine Voicemail
Der Sprachmodus funktionierte bisher wie ein Walkie-Talkie: Du sprichst, wartest, bis die gesamte Antwort generiert ist, und hörst dir dann eine lange Audiodatei an. v0.20 ändert das komplett:
- Spricht, während es denkt — Hermes synthetisiert die Sprache Absatz für Absatz, während die Antwort streamt
- Barge-in — Du kannst mitten im Satz anfangen zu sprechen; Hermes stoppt, hört zu, und das Modell erfährt, dass du unterbrochen hast, und passt an, was als Nächstes kommt
- Rücksichtsvolle Stille-Erkennung — es redet nie über dich hinweg
Es fühlt sich an wie ein Telefonat: Sag „Hey Hermes, wie ist das Wetter heute?“ — und wenn es auf halbem Wege ist, ergänze „…und schau auch morgen nach.” Es korrigiert sofort den Kurs. Die offizielle Zusammenfassung: vom „Voicemail-Austausch“ zum echten Gespräch.
Das funktioniert im CLI-Sprachmodus, auf dem Desktop und über jeden audiofähigen Gateway-Adapter.
2. Wake Words: Sprich mit deinem Terminal quer durch den Raum
Gepaart mit der Konversationssprache gibt es On-Device-Wake-Word-Erkennung:
- Frei wählbare Phrasen — nutze „hey Hermes“ oder einen beliebigen eigenen Ausdruck
- Erkennung auf dem Gerät — solange es wartet, verlässt kein Audio deine Maschine
- Multi-Profil-Sprach-Routing — verschiedene Wake Words können verschiedene Profile erreichen
- Sag auf jeder Oberfläche „stop“, um den Sprach-Chat freihändig zu beenden
Du kannst auf der anderen Seite des Raums stehen, „Hey Hermes“ zum Hermes Desktop auf einem zweiten Monitor sagen, und es wacht auf und antwortet. Dein Terminal ist jetzt etwas, mit dem du quer durch den Raum sprechen kannst.
3. Sprache überall: Sprachnotizen rein, automatische TTS-Antworten raus
Du kannst jetzt eine Sprachnotiz an Hermes auf WhatsApp, Feishu, DingTalk, LINE, QQ, Photon oder Weixin senden — sie wird transkribiert und beantwortet, mit plattformbewussten Auto-TTS-Antworten (opus, wo Plattformen opus wollen, Captions korrekt angehängt).
Auch STT (Speech-to-Text) ist voll konfigurierbar:
- Eine eigene
hermes tools-Kategorie, GUI-Schalter und Dashboard-Dropdowns - Vereinheitlichte Spracherkennung — behebt die klassische Bug-Klasse „Transkripte kommen in der falschen Sprache zurück“
- OpenAI
gpt-transcribe-Support
Und alle TTS-Provider teilen sich einen einheitlichen Spoken-Text-Preprocessor, der Markdown, Code und URLs aus der Sprache entfernt, bevor sie gesprochen wird.
4. Recherche, der du vertrauen kannst: die Grounded-Citations-Skill
Die neue grounded-citations-Skill bringt Hermes dazu, Recherche zu produzieren, bei der jede Behauptung durch eine überprüfbare Quelle belegt ist:
- Zitate werden gegen echten Seitentext abgeglichen — nicht aus dem Gedächtnis halluziniert
- Zitate verlinken auf den exakten Beleg
- Faktencheck-Modus — lass dieselbe Maschinerie auf jedes Dokument oder jede Behauptung los; sie sagt dir, was sich bestätigt, was nicht und was nicht verifiziert werden konnte
Die offizielle Einordnung: Es ist der Unterschied zwischen „klingt richtig“ und „nachweislich belegt.“ Wenn du Hermes für Recherche nutzt, ist das ein Must-have.
5. Ausgehende Webhooks: Hermes pusht Ereignisse an deine Systeme
Bisher bedeutete die Integration mit Hermes Polling oder Lauschen auf einer Plattform. Jetzt pusht Hermes signierte Lifecycle-Events (Session-Aktivität, Turn-Abschlüsse, Tool-Events) an jeden HTTP-Endpunkt, den du registrierst:
- HMAC-Signaturen — Empfänger können die Authentizität verifizieren
- Verdrahte es in deine CI, Hausautomation, Dashboards oder jeden HTTP-fähigen Dienst
- Kein Polling-Loop nötig
Wir haben früher bereits einen praktischen Leitfaden zu Hermes-Webhook-Geschäftsbenachrichtigungen geschrieben — dieses Release vervollständigt die ausgehende Seite der Geschichte.
6. Die Desktop-App wird zur Plattform: Artifacts, Plugin-SDK, Schnelleingabe
Hermes Desktop ist kein Chat-Client mehr, sondern eine Workbench:
- Artifacts — versionierte Karten mit Sandbox-Live-Vorschau in einem Viewer am rechten Rand; generierte HTML-Apps laufen sicher neben dem Chat
- Plugin-SDK — Kanban kommt als erstes Desktop-Plugin;
ctx.downloadübergibt Nutzern Dateien; schwebende Panels frei platzierbar - Schnelleingabe-Fenster — ein globaler Hotkey erfasst einen Gedanken in jeder Session, von überall in deinem OS
- Mehrere GUI-Fenster
Alles, was du mit Hermes über alle Plattformen hinweg erstellt hast (Bilder aus MCP-verknüpften Tools, HTML-Apps usw.), erscheint in den Artifacts — und weil die Vorschauen in der Sandbox laufen, ist das Testen sicherer.
7. A2A v1.0: Agenten sprechen endlich ein gemeinsames Protokoll
Hermes bündelt jetzt ein Plugin, das das Agent-to-Agent-Protokoll implementiert, sodass es andere A2A-kompatible Agenten entdecken, mit ihnen sprechen und von ihnen gesteuert werden kann. Damit wird Issue #514 geschlossen — einer der ältesten offenen Feature-Requests im Repository.
Der praktische Wert: Wenn deine Workflows heterogene Agenten-Stacks umfassen, hat Hermes jetzt ein Standard-Wire-Protokoll, um sie zu verbinden. Lass Hermes deine anderen Agenten orchestrieren — oder lass einen anderen Agenten Hermes orchestrieren. Skills und APIs, die in jeden Agenten eingesteckt sind, werden als ein System steuerbar.
8. CLI-Power-User-Welle: !, /init, /diff, /context, /focus
v0.20 bringt eine Welle praktischer CLI-Befehle:
| Befehl | Was er tut |
|---|---|
!command |
Einen Shell-Befehl sofort ausführen, ohne einen Modell-Turn zu verbrauchen |
/init |
Dein Projekt scannen und eine AGENTS.md generieren (oder aktualisieren) |
/diff |
Gestagte / alle / Session-Änderungen von jeder Oberfläche anzeigen |
/context |
Aufschlüsseln, was genau dein Kontextfenster füllt |
/focus |
Reduzierte Ausgabe-Ansicht mit Wiederherstellung verborgener Zeilen |
Ctrl+S |
Einen halb geschriebenen Prompt in einem durchsuchbaren Panel ablegen |
Plus: hermes import-agent migriert dein Claude-Code- oder Codex-CLI-Setup in einem Befehl zu Hermes.
9. Den Agenten mitten im Turn korrigieren: Redirects statt Neustarts
Wenn Hermes in die falsche Richtung läuft, musst du nicht mehr /stop drücken und alles neu erklären. Tippe eine Korrektur, während es arbeitet, und der aktive Turn wird umgeleitet:
- Laufende Arbeit bleibt erhalten
- Der ursprüngliche Prompt bleibt erhalten
- Der Agent korrigiert den Kurs mit deiner neuen Anleitung
Gepaart mit dem Verwerfen des Entwurfs per Doppel-ESC und einem Composer-Undo-Stack fühlt sich Steuern wie Editieren an, nicht wie Neustarten.
10. Tools, die sich selbst reparieren
Eine Welle von Self-Recovery-Upgrades bedeutet, dass der Agent deutlich weniger Turns mit Tool-Reibung verschwendet:
- Abgeschnittene Terminal-Ausgaben werden in eine Datei umgeleitet, die der Agent zurücklesen kann
patcherkennt bereits angewendete Edits und diagnostiziert Whitespace-Mismatcheswrite_fileverifiziert den Inhalt auf der Platte- Suchanfragen ohne Treffer prüfen auf Beinahe-Treffer und erholen sich
- Das Standard-Limit für Tool-Call-Iterationen stieg von 90 auf 500 — lange autonome Läufe stoßen nicht mehr an eine künstliche Wand
11. Kompression, die dein Gespräch respektiert
Die Kontext-Kompression wurde grundlegend überarbeitet:
- Proaktives Tool-Result-Pruning für Modelle mit großem Fenster
- Micro-Kompaktierung pro Turn, die die Kosten verteilt statt einer einzigen großen Pause
- Garantierter N-User-Messages-Tail (
compression.min_tail_user_messages) — die jüngste Konversation überlebt immer - Fortschrittsbewusste Timeouts, die langsame Summary-Modelle nicht mehr bestrafen
- Ghost-Skill-Abwehr — eine gekürzte Skill kann eine Session nie still heimsuchen
- Schwellenwerte sind pro Modell und in absoluten Tokens konfigurierbar (
compression.threshold_tokens)
Lange Sessions bleiben kohärent und hören auf zu stottern.
12. Smart Approvals werden erwachsen
Smart Approvals hat mehrere Upgrades bekommen:
hermes approvals suggest— analysiert deine Approval-Historie und schlägt Allowlist-Einträge vor- Anpassbare Smart-Approval-Policy
- Circuit Breaker bei aufeinanderfolgenden Ablehnungen — stoppt eine fehlgeleitete Schleife hart
- Desktop-Pairing-Approvals sind jetzt profilkorrekt, mit einer ordentlichen Oberfläche zum Beantworten
- Ein neues Approval-Gate für docker/podman-Daemon-Redirect-Befehle
Weniger Klicken auf „approve“, ohne auch nur einen Zentimeter Kontrolle abzugeben. Die vollständige Konfigurationsanleitung findest du in unserem Smart Approvals Setup-Guide (die echten Config-Keys sind approvals.mode / approvals.deny — trau veralteten Tutorials nicht).
13. Überall schneller, schon wieder
Die Performance wächst weiter:
hermes -wCold Start sank von ~14s auf ~1,8shermes update-No-Ops wurden 2–6s schneller- Schwere SDKs werden lazy vom Import-Pfad geladen
- Config-Reads tiefkopieren nicht mehr — 54× schneller am Telemetrie-Gate
- Tool-Schemas werden nativ auf Anthropic gecacht, ohne Verlust der Historie
- Desktop lieferte seine zweite 60fps-Welle — Streaming-Kosten unabhängig von der Transcript-Länge, Drag bei 60fps mit fünf Streaming-Tabs, Idle-CPU nahe Null
Eine Klarstellung: Das oft zitierte „First Token 4,3s → 0,9s“ war die v0.19.0-Optimierung. v0.20 baut darauf mit Cold-Start-, Caching- und Desktop-Rendering-Gewinnen auf.
14. Neue Orte zum Laufen und Erreichbarsein
- Buzz kommt als gebündelte Gateway-Plattform (Blocks Nostr-basierter Messenger, nativer WebSocket-Transport, NIP-42-Auth)
- Vercel AI Gateway-Provider und Vercel Sandbox-Terminal-Backend kehren modernisiert zurück
- Desktop erhält einen SSH-Remote-Backend-Verbindungsmodus
- Relay schloss vier Paritätsphasen ab — Medien, interaktive Prompts, Thread-Lebenszyklus, Tipp-Indikatoren
- HSP Personal + Org Skill-Sync
15. Sicherheit & Zuverlässigkeit
- Die Iron-Proxy-Egress-Firewall gegen Credential-Injection ist zurück an Bord
- DNS-gepinnte SSRF-sichere Fetches + Slack-CDN-Allowlist
- Strikte Redaktion an Kompressionsgrenzen; ReDoS in Config-Key-Redaktionsmustern eliminiert
- Windows-Härtungswelle — Textmodus-Subprocess-Decode-Bug-Klasse repo-weit geschlossen, Konsolen-Flackern verborgen
- Vier Session-State-Integritäts-Fixes + FTS-Layout-Optimierung (inkl. CJK-Bigramm-Indexierung)
So aktualisierst du
# Existing installs
hermes update
# Fresh install
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash
Hinweis: Dieses Release benötigt Node 26 (wird von Installern/Self-Heal/Upgrade-Pfaden übernommen), und die brew- sowie pip/PyPI-Wheel-Kanäle sind eingestellt — die unterstützten Kanäle sind der Shell-Installer, Docker und Nix.
Zusammenfassung
Die Kern-Story des Herald-Releases ist der Bote: Es spricht mit dir (Sprache), überbringt Botschaften an andere Agenten (A2A), kündigt Ereignisse an deine Systeme an (Webhooks) und zeigt seine Belege (Zitate). Zusammen mit dem Desktop-als-Plattform-Vorstoß, CLI-Power-Befehlen, smarterer Kompression und erwachsenen Approvals bewegt v0.20 Hermes vom „Tool“ zum „Kollegen, der spricht, kooperiert und seine Quellen zitiert.“
Wenn du die Sprache noch nicht ausprobiert hast: Aktualisiere und sag etwas zu Hermes — und unterbrich es dann mitten im Satz. Es fühlt sich wirklich anders an. Neu bei Hermes? Starte mit dem Installationsleitfaden oder wirf einen Blick auf den v0.19.0-Quicksilver-Deep-Dive für die Speed-Up-Story hinter diesem Release.