Hermes Agent v0.20.0 — The Herald Release
Überblick
v0.20.0 — The Herald Release. Veröffentlicht am 3. August 2026. ~3.650 Commits · ~1.400 gemergte PRs · ~5.200 geänderte Dateien · ~559.000 Einfügungen · ~405.000 Löschungen · ~1.200 geschlossene Issues · 650+ Community-Mitwirkende.
Hermes ist der Herold der Götter, und dieses Release macht ihn wirklich zu einem: Er spricht (konversationelle Echtzeit-Sprachausgabe mit Streaming-TTS, Barge-In, geräteinternen Wake Words und freihändiger Steuerung auf CLI, Desktop und jeder audiofähigen Gateway-Plattform), er überbringt Botschaften an andere Agenten (A2A v1.0), er kündigt Ereignisse in deinen Systemen an (signierte ausgehende Webhooks), und er belegt seine Quellen (fundierte Recherche mit überprüfbaren Zitaten und Faktenprüfung).
Rund um dieses Rückgrat: Die Desktop-App wurde zur Plattform (Artifacts mit isolierter Live-Vorschau, ein Plugin-SDK, Quick-Entry von überall, mehrere Fenster), die CLI erhielt eine Welle von Power-Befehlen (!-Shell-Modus, /init, /diff, /context, /focus), die Komprimierung wurde intelligenter und schonender, und die Tools selbst erholen sich nun von eigenen Fehlern, anstatt das Modell raten zu lassen.
Die Community-Reaktion kam sofort — der Digg-Tech-Thread erreichte innerhalb von 24 Stunden über 900.000 kombinierte Aufrufe und mehr als 5.400 Likes. Teknium nannte es „heralding the new era“. Dieses Release umfasst auch sämtliche Änderungen aus dem v0.19.1-Infrastruktur-Patch-Tag.
Highlights
1. Sprich mit Hermes — Streaming, konversationelle Sprachausgabe mit Barge-In
Der Sprachmodus bedeutete bisher: sprechen, warten, bis die gesamte Antwort generiert ist, dann eine lange Audiodatei anhören. Jetzt spricht Hermes satzweise, während die Antwort streamt, du kannst ihn mitten im Satz durch einfaches Sprechen unterbrechen (er stoppt, hört zu, und das Modell wird informiert, dass du reingeredet hast), und eine aktivitätsbewusste Stilleerkennung sorgt dafür, dass er nicht über dich hinwegredet.
Das ist ein qualitativer, kein quantitativer Sprung — mit Hermes zu sprechen fühlt sich endlich wie ein Gespräch an, nicht wie Voicemail-Pingpong. Funktioniert im CLI-Sprachmodus, auf dem Desktop und über Gateway-Adapter.
# Sprachmodus über CLI oder TUI starten
hermes chat --voice
# Hermes spricht satzweise, du sagst "warte" und er stoppt
# Komplett freihändig — keine Tastatur erforderlich
2. Wake Words und freihändige Steuerung — Sprich von der anderen Seite des Raums
Wähle deinen eigenen Open-Vocabulary-Wake-Phrase („hey Hermes“ oder was immer du möchtest) und Hermes beginnt zuzuhören — die Erkennung läuft geräteintern, sodass keine Audiodaten dein Gerät verlassen, während gewartet wird. Multi-Profile-Voice-Routing bedeutet, dass verschiedene Wake Words verschiedene Profile erreichen können, und ein einfaches „stop“ beendet den Voice-Chat auf jeder Oberfläche, ohne die Tastatur zu berühren. Dein Terminal ist jetzt etwas, mit dem du von der anderen Seite des Raums sprechen kannst.
# Ein benutzerdefiniertes Wake Word registrieren (Voice-Enrollment, 3 Sprachproben)
hermes voice wake-word register --phrase "hey assistant"
# Verschiedene Profile an verschiedene Wake Words binden
hermes voice wake-word bind --profile work --phrase "time to work"
hermes voice wake-word bind --profile personal --phrase "hey hermes"
Community-Reaktion: Entwickler nennen dies den „Alexa/Google-Home-Killer“-Moment. Die Wake-Word-Erkennung läuft geräuschlos im Hintergrund, ohne das Modell-Budget zu verbrauchen.
3. Sprachassistenz überall — WhatsApp, Feishu, DingTalk, LINE, QQ, WeChat
Schicke Hermes eine Sprachnachricht auf WhatsApp, Feishu, DingTalk, LINE, QQ, Photon oder Weixin und sie wird transkribiert und beantwortet. Automatische TTS-Antworten werden plattformgerecht zugestellt (Opus dort, wo Plattformen Opus erwarten, Untertitel korrekt angehängt).
STT ist jetzt vollständig konfigurierbar — eigene hermes tools-Kategorie, GUI-Toggle-Matrix, Dashboard-Dropdowns, Setup-Statusanzeige. Die vereinheitlichte Sprachenauflösung behebt das Problem „Transkript kommt in der falschen Sprache zurück“, das Sprachbenutzer lange geplagt hat. OpenAI gpt-transcribe wird jetzt unterstützt.
Alle TTS-Anbieter teilen sich einen einheitlichen Spoken-Text-Präprozessor — Markdown, Codeblöcke und URLs werden intelligent aus der Sprachausgabe entfernt.
4. Recherche, der du vertrauen kannst — Fundierte Quellenangaben mit Faktenprüfung
Der neue Skill grounded-citations lässt Hermes Recherchen erstellen, bei denen jede Behauptung durch eine überprüfbare Quelle belegt ist: Zitate werden mit dem tatsächlichen Seitentext abgeglichen (nicht halluziniert), Zitationen verlinken auf den exakten Beleg. Ein Faktenprüfungsmodus wendet dieselbe Technik auf jedes Dokument oder jede Behauptung an, die du ihm gibst — er sagt dir, was stimmt, was nicht und was nicht verifiziert werden konnte.
Wenn du Hermes für Recherche nutzt, ist dies der Unterschied zwischen „klingt richtig“ und „nachweislich belegt“.
# Fundierten Recherche-Modus im Gespräch aktivieren
/grounded-citations
# Ein bestehendes Dokument faktenprüfen
/fact-check "Ist dieser Bericht über KI-Sicherheit korrekt?"
5. Agent-zu-Agent-Kommunikation — A2A v1.0 Protokoll
Ein neues gebündeltes Plugin implementiert das Agent-to-Agent-Protokoll — Hermes kann andere A2A-kompatible Agenten entdecken, mit ihnen kommunizieren und von ihnen gesteuert werden. Dies schließt Issue #514 — eine der ältesten offenen Feature-Anfragen im Repository.
Wenn du Multi-Agent-Systeme mit heterogenen Stacks baust, hat Hermes jetzt ein Standard-Wire-Protokoll, um daran teilzunehmen.
# A2A-Plugin aktivieren
hermes plugins enable a2a
# Hermes entdeckt automatisch Agenten im lokalen Netzwerk
# Kann Unteraufgaben autonom an andere Agenten delegieren
Teknium hob dies hervor als eine der bedeutendsten Infrastrukturänderungen in diesem Release — Agenten haben endlich ein Standard-Kommunikationsprotokoll, statt isolierte Blackboxes zu sein.
6. Ausgehende Webhooks — Hermes pusht Ereignisse an deine Systeme
Bisher bedeutete die Integration mit Hermes Polling oder das Lauschen auf einer Plattform. Jetzt pusht Hermes signierte Lifecycle-Ereignisse (Session-Aktivität, Turn-Abschlüsse, Tool-Ereignisse) an jeden von dir registrierten HTTP-Endpunkt — mit HMAC-Signaturen, sodass dein Empfänger die Authentizität verifizieren kann.
Binde Hermes in deine CI/CD-Pipelines, Heimautomatisierung, Monitoring-Dashboards oder jeden HTTP-fähigen Dienst ein, ohne Polling-Loop.
# hermes.config.yaml
webhooks:
- url: "https://your-service.example.com/hermes-events"
events: ["turn_complete", "tool_invocation", "session_activity"]
hmac_secret: "${env:WEBHOOK_HMAC_KEY}"
7. Die Desktop-App wird zur Plattform — Artifacts, Plugin-SDK, Quick-Entry
Die Desktop-App hat aufgehört, ein Chat-Client zu sein, und ist zu einer Workbench geworden:
- Artifacts: versionierte Karten mit isolierter Live-Vorschau in einem rechten Panel-Viewer — generiertes HTML oder Web-Apps laufen sicher neben dem Chat
- Plugin-SDK ist gelandet: Kanban als erstes Desktop-Plugin;
ctx.downloadübergibt Nutzern Dateien von Plugins; Widget-App-SDK (State + Reducer + Render); Widget-Grid-Layout-Engine mit hintergrundbewusster Theme-Engine - Globales Hotkey-Quick-Entry-Fenster: Erfasse einen Gedanken in jede Session von überall im Betriebssystem aus
- Mehrere GUI-Fenster; Floating-Pane-Platzierung
# Desktop: Strg+Leertaste öffnet das globale Quick-Entry-Fenster
# Tippe "erstell mir eine Login-Seite in HTML"
# Hermes generiert sie als Artifact mit Live-Vorschau im rechten Panel
Julian Goldies Review-Video nannte die Artifacts-Live-Vorschau die wichtigste Desktop-Ergänzung, die aus „Code sehen“ ein „Ergebnisse sehen“ macht.
8. CLI-Power-User-Welle — Weniger Rückgängig, mehr Kontrolle
Eine Welle wirkungsvoller CLI-Befehle landet und beendet die „vermasseln und neu anfangen“-Ära:
| Befehl | Was er macht |
|---|---|
!command |
Führt einen Shell-Befehl sofort aus — kein Modell-Turn verbraucht, Ergebnisse sofort |
/init |
Scannt dein Projekt, generiert oder aktualisiert eine AGENTS.md-Kontextdatei |
/diff |
Zeigt gestagete / alle / Session-Diffs von jeder Oberfläche aus |
/context |
Zeigt genau, was dein Kontextfenster füllt |
/focus |
Reduzierte Ausgabeansicht mit Wiederherstellung versteckter Zeilen |
Ctrl+S |
Legt einen halb fertigen Prompt in einem durchsuchbaren Panel ab |
hermes import-agent |
Ein-Befehl-Migration von Claude Code oder Codex CLI |
# Schnelle Shell — kein Modell-Budget verbraucht
! ls -la && cat package.json
# Sieh genau, was dein Kontextfenster belegt
/context
# Ausgabe:
# System prompt: 12.450 tokens
# Letzte 3 Turns: 2.100 tokens
# Tool definitions: 4.800 tokens
# Active skill docs: 3.200 tokens
# Verbleibend: 15.450 / 38.000 tokens
# Migration von Claude Code — ein Befehl
hermes import-agent
AICrier merkte an, dass /context einer der meistgefragten Diagnosebefehle ist — kein Rätselraten mehr, was das Kontextfenster füllt.
9. Korrigiere den Agenten mitten im Turn — Umleiten statt Neustarten
Wenn Hermes in die falsche Richtung läuft, musst du nicht mehr /stop eingeben, den Prompt neu schreiben und auf eine Wiederholung warten. Tippe eine Korrektur, während er arbeitet, und der aktive Turn wird umgeleitet: laufende Arbeit bleibt erhalten, der ursprüngliche Prompt wird beibehalten, und der Agent korrigiert seinen Kurs mit deiner neuen Anleitung.
Gepaart mit Doppel-ESC zum Verwerfen von Entwürfen und einem Composer-Undo-Stack fühlt sich das Steuern von Hermes wie Editieren an, nicht wie Neustarten.
# Hermes führt aus, und du merkst, dass er in die falsche Richtung geht
# Nicht /stop — tippe einfach eine Korrektur:
> Warte, prüfe erst die Node-Version, bevor du entscheidest, welcher Paketmanager verwendet wird
# Hermes leitet sofort um, bewahrt die abgeschlossene Arbeit und macht weiter
10. Tools, die sich selbst heilen — Keine Tool-Friktions-Turns mehr
Eine systematische Welle von Selbstheilungs-Upgrades bedeutet, dass der Agent weit weniger Turns durch Tool-Reibung verschwendet:
- Abgeschnittene Terminal-Ausgabe wird in eine Datei geschrieben, die der Agent zurücklesen kann
patch-Befehl erkennt bereits angewandte Änderungen und diagnostiziert Whitespace-Abweichungen- Null-Ergebnis-Suchen prüfen auf Beinahe-Treffer und erholen sich
write_fileverifiziert den Inhalt auf der Festplatte- Häufige Fehlerklassen kommen mit umsetzbaren Wiederherstellungshinweisen zurück
Das standardmäßige Tool-Calling-Iterationslimit sprang ebenfalls von 90 auf 500 — lange autonome Läufe stoßen nicht mehr an eine künstliche Wand.
# Standard-Tool-Iterationslimit drastisch erhöht
# Alt: Auto-Stopp nach 90 Iterationen
# Neu: 500 Iterationen, genug für komplexe mehrschrittige Aufgabenketten
AICrier-Analyse nennt Tool-Selbstheilung einen „stillen Produktivitätsgewinn“ — man bemerkt es nicht, aber es spart jeden Tag 5–10 verschwendete Turns.
Voice & Speech
Konversationelle Sprachausgabe
- Streaming, satzweise TTS mit Barge-In auf allen Oberflächen (CLI-Sprachmodus + Gateway-Adapter)
- Full-Duplex-Turn-Listener — Unterbrechung per Sprache während der Generierung UND Wiedergabe
- Aktivitätsbewusste Stilleerkennung, Stopp-Hinweise, Denkgeräusche, Barge-In-Fixes
- Das Modell wird informiert, wenn der Nutzer seine gesprochene Antwort unterbricht — Kontext bleibt kohärent
- Desktop spricht den gesamten Turn und leert gehaltene Erzählung im Leerlauf
TTS / STT Infrastruktur
- Vereinheitlichte Spoken-Text-Vorverarbeitung + Geschwindigkeits-/Anweisungs-/Provider-Tool-Parameter; vereinheitlichte STT-Sprachenauflösung (behebt die Klasse der Falschsprachentranskription)
- Vollständig konfigurierbares STT —
hermes tools-Kategorie, GUI-Toggle-Matrix, Dashboard-Dropdowns, Setup-Status; OpenAIgpt-transcribe-Unterstützung - Plattformbewusste automatische TTS-Zustellung (Opus-Plattformen korrekt behandelt, Untertitel angehängt)
- Eingehende Sprachklassifizierung/-routing für WhatsApp, Feishu, DingTalk, LINE, QQ, Photon, Weixin
- Command-TTS/STT-Provider-Härtung (Leerlauf-Timeouts, Env-Bereinigung, No-Shell, Pfad-Schutz)
- Satzweise TTS-Synthese mit Wiedergabe gepipelined — nächster Satz wird gerendert, während der aktuelle gesprochen wird
- Discord-Voice-PCM-Streams zu ffmpeg stdin statt temporärer Dateien
Wake Words & Freihändig
- Geräteinterne Open-Vocabulary-Wake-Words (Voice-Enrollment, 3 Sprachproben)
- Multi-Profile-Voice-Routing — verschiedene Wake Words erreichen verschiedene Profile
- Sage „stop“, um den Voice-Chat auf jeder Oberfläche freihändig zu beenden
- 15-teilige CLI/TUI-Voice-Mode-UX- und Umgebungs-Fix-Welle
Core Agent & Architektur
Komprimierung — Intelligent und schonend
- Proaktives Tool-Result-Pruning für Large-Window-Modelle
- Per-Turn-Mikrokompaktierung — Komprimierungskosten über Turns amortisiert statt einer großen Pause
- Garantierte N-Benutzernachrichten-Endstücke (
compression.min_tail_user_messages) — kürzliche Konversation überlebt immer - Ghost-Skill-Abwehr — bereinigte Skills können niemals still eine Session verfolgen
- Fortschrittsbewusste Timeouts — langsame Zusammenfassungsmodelle werden nicht mehr bestraft
- Per-Modell-Schwellenwert-Überschreibungen; absolute Token-Schwelle (
compression.threshold_tokens); opt-in-leerlaufgesteuerte Kompaktierung
Lange Sessions bleiben kohärent und hören auf zu stocken.
Mid-Turn Redirects
- Nutzerkorrekturen steuern den aktiven Turn und bewahren laufende Arbeit und den ursprünglichen Prompt
- Doppel-ESC verwirft Entwurf
- Composer-Undo-Stack
Genehmigungen — Intelligenter, weniger Klicks
hermes approvals suggestanalysiert die Genehmigungshistorie und schlägt Allowlist-Einträge vor- Anpassbare Smart-Approval-Richtlinie (
approvals.smart_policy) - Schutzschalter bei aufeinanderfolgenden Ablehnungen — drei aufeinanderfolgende Ablehnungen erzwingen den Abbruch der Schleife
- Docker/Podman-Daemon-Weiterleitungsbefehle benötigen jetzt zusätzliche Genehmigung
- Oberflächenübergreifender Genehmigungsmodus-Befehl
- Desktop-Pairing-Genehmigungen: profilkorrekt, mit einer geeigneten Oberfläche zum Antworten
Prompt-Caching & Hot-Path-Performance
- Tool-Schemas auf nativem Anthropic zwischengespeichert ohne Verlaufverlust
- DeepSeek-Prompt-Caching auf OpenCode-Gateways
- Token-Abrechnung pro API-Aufruf vom Turn-Thread entkoppelt
- OpenAI-Wire-Client über sequenzielle LLM-Aufrufe hinweg wiederverwendet
- Send-Path-Tool-Call-Kanonisierung memoized
Provider & Modelle
- Vercel AI Gateway-Provider + Vercel Sandbox-Terminal-Backend kehren zurück, modernisiert (SDK 0.7.2, Telemetrie aus)
- Gemini 3.1 Pro + 3.6 Flash in Katalogen; Gemini-Salvage-Cluster
- claude-opus-5 in OpenRouter und Nous Portal
- deepseek-v4-flash-0731 an Bord
- Bedrock Converse API Prompt-Caching (cachePoint)
- Modellauswahl: kuratierte Standards + einklappbare Provider + Alle-auswählen
- Veraltete Caches sofort ausgeliefert mit Hintergrundaktualisierung
Delegation & Subagents
- Strukturierte Timeout-/Stall-Metadaten + Live-Status pro Kind in
/agents - Subagents können
execute_codenutzen - Redigierte Kind-Tool-Historie in
subagent_stopverfügbar - Öffentliche Subagent-Lifecycle-API für Plugins
Desktop — Vom Chat-Client zur Entwicklungsplattform
Plattform-Fähigkeiten
- Artifacts: versionierte Karten + isolierte Live-Vorschau im rechten Panel-Viewer
- Plugin-SDK: Kanban als erstes Desktop-Plugin;
ctx.downloadübergibt Nutzern Dateien; Widget-App-SDK (State + Reducer + Render); Widget-Grid-Layout-Engine + hintergrundbewusste Theme-Engine - Quick-Entry-Fenster: globaler Hotkey → jede Session
- Mehrere GUI-Fenster: parallele Sessions nebeneinander
- Floating-Pane-Platzierung — Panes überall
- SSH-Remote-Backend-Verbindungsmodus
- Lass den Agenten die Shell steuern (Vorschau-Pane + Pane-Fokus) UND die Desktop-App inspizieren, die er gerade baut
Composer & UX
- Dateien/Ordner/Links per Picker anhängen; @path- und Pasted-Link-Composer-Chips
- Composer-Undo-Stack; Doppel-ESC verwirft Entwurf; Doppel-Enter sendet anstehenden Turn
- Modellwechsel mit 2 Tasten (⌘⇧M); YOLO in ⌘K mit Live-Toggle-Status
- Sidebar-Datumstrenner + angehefteter Bereich + opt-in automatische Archivierung veralteter Sessions
- Gruppierte, live-tickende Tool-Aktivitätszeile; @session-Links lösen zu klickbaren Titeln auf
- iMessage-artige Emoji-Reaktionen (opt-in, bidirektional); Doppelklick zum Herzen
- Credit-Verbrauch-Toasts
- RFC 8252 native Desktop-Anmeldung (Systembrowser + PKCE, keine Webview-Cookies)
- Computer-wach-halten-Toggle + Notch-Weck-Indikator
Desktop-Performance — 60fps Welle 2
- Streaming-Kosten unabhängig von der Transkriptlänge — bleibt flüssig, egal wie lange du schon sprichst
- 60fps in echten Sessions (Reflow-gesteuerte Pins, adaptiver Flush)
- 60fps-Drag mit fünf Streaming-Tabs
- Timer für versteckte Panes pausiert, Scroll-/Status-Schleifen in ausgelasteten Sessions gestoppt
- Leerlauf-CPU nahe null im Hintergrund
- Sidebar/Overlay-Render-Churn beseitigt
- ⌘K öffnet sofort
- Renderer-Kaltstart: shiki/mermaid bleiben vom Boot-Pfad fern
- Zustandsdiagnose (Render- + Store-Churn-Zähler) + Lint-Regel, die atom-mirrored Refs verbietet
- Playwright-E2E-Suite mit visuellen Regressions-Diffs
CLI, TUI & Runtime
| Befehl/Feature | Beschreibung |
|---|---|
!command |
Schnellste Shell — kein Modell-Turn verbraucht |
/init |
Projekt scannen → AGENTS.md generieren/aktualisieren |
/diff |
Drei Diff-Ansichten — gestaged / alle / Session |
/context |
Präzise Aufschlüsselung des Kontextfensters |
/focus |
Reduzierte Ausgabeansicht + Wiederherstellung versteckter Zeilen |
Ctrl+S |
Prompt in durchsuchbarem Panel ablegen |
/goal |
Permanenter Ziel-Indikator |
hermes import-agent |
Ein-Befehl-Migration von Claude Code / Codex CLI |
| Multi-Select-Clarify | Checkbox-Interaktion über CLI/Gateway/TUI hinweg |
| Per-Turn-Zusammenfassungszeile + Live-Token-Flow im Spinner | Transparenter Fortschritt |
| Oberflächenübergreifendes Theme-SDK | Ein Skin styled CLI, TUI und Desktop |
hermes -w Kaltstart |
~14s → ~1,8s |
hermes update No-Ops |
2–6s schneller |
| Runtime | Node 26 in allen Installern; brew/pip/PyPI-Kanäle eingestellt (Shell-Installer / Docker / Nix bleiben) |
TUI: Modellauswahl ruiniert nicht mehr deinen Entwurf, Slash-Menü führt mit deinen meistgenutzten Skills, Anhänge leben im Composer. Arabische (ar) Locale mit RTL auf Desktop/Dashboard/Agent.
Gateway, Plattformen & Relay
Neue Plattformen
- Buzz: Blocks Nostr-basierter Messenger mit nativem WebSocket-Transport + NIP-42-Auth
- Photon: native Umfragen, Effekte, Clarify-as-Poll, Rich Links (4-PR-Bergung)
- Vercel AI Gateway-Provider + Vercel Sandbox-Terminal-Backend kehren zurück
- Slack: native Block-Kit-Clarify-Buttons; opt-in-Reaktionsauslöser; ausgehende Payload-Bereinigung
- Discord: automatische Thread-Sessions, basierend auf
prospective_thread_id; Antwort-Referenzen aus IDs erstellt - WhatsApp: konfigurierbare eingehende Lesebestätigungen
- Kanban-Weckrufe setzen die DM-/Thread-Session des Erstellers fort; Kanban/Delegate-Weckrufe erreichen api_server-Sessions
Relay-Phasenparität
- Phase 1:
supported_ops-Discovery, Identity-Felder,/handoff-Aliasing - Phase 2: Medien
- Phase 3: interaktive Prompts
- Phase 4: Thread-Lifecycle
- Ausgehende Tippindikatoren
HSP Skill Sync
- Persönlicher Client (M1) + Org-Skills-Client (M2) + Org-Skill-Namespace mit token-geschützter Discovery
Zustellzuverlässigkeit
- Session-Aktivitäts-Heartbeats, Stall-Watchdog, begrenzte Komprimierungswartezeiten — erneut ausgerollt und gehärtet nach einem In-Window-Revert
- SessionState-Konsolidierung: 19 sessionbasierte Dicts → ein Turn-/Conversation-/Persistent-Scoped-Objekt
Skills, Plugins & MCP
Neu & aktualisiert
- A2A v1.0: Agent-zu-Agent-Protokoll-Plugin (schließt #514)
grounded-citations-Skill: Quellenzitate + Faktenprüfungsmodus- Curator: nicht verwaltete Skills anzeigen +
curator adopt - Office-Skills gebündelt: docx, xlsx, pdf + aufgefrischtes PowerPoint
- Skills-Tree-Entschlackung geht weiter: yuanbao, segment-anything, jupyter, heartmula, audiocraft → optional-skills
tldraw-offlineScripting-Skillsimplify-codev1.1
MCP
- Comfy-Cloud-Katalogeintrag mit kuratiertem 20-Tool-Standard
- MCP Lazy Server Startup — von einem Fingerprint-indizierten On-Disk-Tool-Schema-Cache; konfigurierte Server starten nicht mehr alle bei Session-Beginn
- Versteckte-Whitespace-Warnungen in der MCP-Konfiguration
- NeMo Relay Observability-Integration (auf stabilem 0.6 erneut ausgerollt)
Sicherheit & Zuverlässigkeit
Härtung von Zugangsdaten & Secrets
- Iron-Proxy-Credential-Injection-Egress-Firewall (erneut ausgerollt)
- DNS-gepinnte SSRF-sichere Fetches + Slack-CDN-Allowlist
- Strikte Redaktion an Komprimierungsgrenzen
- ReDoS in Config-Key-Redaktionsmustern beseitigt
- Tier-3-Credential-Reads gescoped
- CVE-Abhängigkeits-Pins aufgefrischt
- Windows-Härtungswelle: Textmodus-Subprocess-Decode-Bug-Klasse repositoryweit geschlossen, Konsolenflackern versteckt, verbleibende Encoding-Lücken (MCP stdio, Gateway-Update-I/O, STT/TTS, Desktop-Spawn)
- Command-Helper-Secret-Quelle (kompatibel mit allen Vaults)
${env:VAR}SecretRef-Parität zwischen config.yaml und MCP-Konfiguration
Session- & Statusintegrität
- Vier Session-State-Fixes (Safe-Close-Tracking, Flush-Cursor-Klassenfix, Row-Retry, Usage-PK-Heiler)
- Kompaktes v23-FTS-Layout +
hermes sessions optimize+ CJK-Bigram-FTS - Read-Path-Split mit Read-Only-Verbindungen pro Thread
- OpenViking-Memory-Provider-Härtung
- Credential-Pool: reset-bewusste primäre Wiederherstellung + Deferred-Refresh-Locking-Fixes
Upgrade
hermes update
Für Neuinstallationen:
# macOS / Linux / WSL2
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash
# Windows (PowerShell)
iex (irm https://hermes-agent.nousresearch.com/install.ps1)
Wenn du von Claude Code oder Codex CLI kommst, genügt ein Befehl zur Migration:
hermes import-agent
Vollständiger Changelog auf GitHub
← Hermes Agent Changelog