Hermes Agent v0.9.0 — Das Überall-Release
Überblick
v0.9.0 — Das Überall-Release. Veröffentlicht am 13. April 2026. Seit v0.8.0: 487 Commits · 269 gemergte PRs · 167 gelöste Issues · 493 geänderte Dateien · 63.281 Einfügungen · 24 Mitwirkende.
Bei diesem Release dreht sich alles um einen Gedanken: überall sein. Hermes ist aus dem Terminal und einer Handvoll Chat-Plattformen ausgebrochen und taucht jetzt ins Apple-Ökosystem (iMessage), ins chinesische Ökosystem (WeChat) und sogar aufs Handy (Android/Termux) ein. Ein brandneues lokales Web-Dashboard erlaubt dir, alles zu verwalten, ohne Konfigurationsdateien anzufassen. Der Fast Mode eliminiert Wartezeiten bei latenzkritischen Workflows. Die Hintergrundprozess-Überwachung befreit dich aus dem Polling-Albtraum. Und 11 Sicherheitshärtungen sorgen dafür, dass das alles schnell und sicher läuft.
Hauptfunktionen
1. Lokales Web-Dashboard — Alles im Browser verwalten
Hermes wird jetzt mit einem browserbasierten Verwaltungs-Dashboard für die lokale Nutzung ausgeliefert. Einstellungen konfigurieren, Sitzungen überwachen, Skills durchstöbern und das Gateway verwalten — alles über eine aufgeräumte Web-Oberfläche, keine Konfigurationsdateien, kein Terminal nötig. Der einfachste Einstieg in Hermes.
Das Dashboard basiert auf FastAPI + Uvicorn, läuft standardmäßig unter 127.0.0.1:9119 und bietet Echtzeit-Gateway-Status, Sitzungsverlauf und Nutzungsanalysen.
2. Fast Mode (/fast) — Priorisierte Inferenz-Pipeline
Gib /fast im Chat ein, um deine aktuelle Sitzung über priorisierte Verarbeitungswarteschlangen für OpenAI- und Anthropic-Modelle zu leiten und die Inferenz-Latenz drastisch zu senken. Unterstützte Modelle umfassen GPT-5.4, Codex, Claude und mehr.
# Fast Mode aktivieren
/fast
# Alle nachfolgenden LLM-Aufrufe laufen über priorisierte Warteschlangen mit deutlich geringerer Latenz
# Erneutes /fast deaktiviert den Modus wieder
Unterstützt von OpenAI Priority Processing und Anthropics Fast Tier, erweitert auf alle berechtigten Modelle. (#6875, #6960, #7037)
3. iMessage via BlueBubbles — Hermes betritt das Apple-Ökosystem
Volle iMessage-Integration über BlueBubbles. Automatische Webhook-Registrierung, Einrichtung über den Setup-Assistenten und Absturzsicherheit — Hermes kann jetzt iMessages von deinem Mac aus senden und empfangen.
# Wähle BlueBubbles im Setup-Assistenten und folge der Kopplungsanleitung
hermes setup
4. WeChat (Weixin) & WeCom Callback-Modus — Das gesamte chinesische Messaging-Ökosystem
WeChat (Weixin): Native WeChat-Unterstützung über die iLink Bot API, mit Streaming-Cursor, Medien-Uploads und Markdown-Link-Verarbeitung.
WeCom Callback-Modus: Ein Callback-Adapter für selbst erstellte Unternehmens-Apps mit atomarer Zustandspersistenz.
Hermes deckt das chinesische Messaging-Ökosystem jetzt Ende-zu-Ende ab — vom privaten WeChat bis zum geschäftlichen WeCom. (#7166, #7943)
5. Termux / Android-Unterstützung — Hermes wird mobil
Führe Hermes nativ auf Android über Termux aus. Angepasste Installationspfade, für mobile Bildschirme optimierte TUI, Voice-Backend-Unterstützung und der /image-Befehl funktioniert direkt auf dem Gerät.
# Installation in Termux mit dem speziellen Termux-Bundle
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash -s -- --bundle termux
(#6834)
6. Hintergrundprozess-Überwachung (watch_patterns) — Benachrichtigt werden statt Pollen
Definiere Regex-Muster, die in der Ausgabe von Hintergrundprozessen beobachtet werden, und erhalte Echtzeit-Benachrichtigungen bei Treffern. Überwache Fehler, warte auf bestimmte Ereignisse („listening on port 3000“) oder verfolge Build-Logs — kein Polling mehr.
# hermes.config.yaml
watch_patterns:
- pattern: "Error:.*"
notify: true
- pattern: "listening on port \\d+"
notify: true
label: "Service bereit"
(#7635)
7. xAI (Grok) & Xiaomi MiMo — Native Provider-Unterstützung
Zwei bedeutende Modell-Provider erhalten erstklassige Unterstützung:
- xAI (Grok): Direkter API-Zugriff, Modellkatalog, Integration in den Setup-Assistenten
- Xiaomi MiMo: Setup-Assistent, Modellkatalog, automatische Wiederherstellung bei leeren Antworten
Dazu Qwen OAuth mit Portal-Request-Unterstützung. (#7372, #7855)
8. Austauschbare Context-Engine — Steuere, was der Agent sieht
Das Kontext-Management ist jetzt über hermes plugins austauschbar. Verwende benutzerdefinierte Context-Engines, die präzise steuern, was der Agent in jedem Turn sieht — Filtern, Zusammenfassen oder domänenspezifische Kontexteinbindung.
# Ein benutzerdefiniertes Context-Engine-Plugin installieren
hermes plugins install my-context-engine
(#7464)
9. Einheitliche Proxy-Unterstützung — Funktioniert hinter Firewalls
SOCKS-Proxy, DISCORD_PROXY und automatische System-Proxy-Erkennung auf allen Gateway-Plattformen. Hermes funktioniert hinter Unternehmens-Firewalls — macOS erkennt die System-Proxy-Einstellungen automatisch, Windows/Linux benötigen lediglich eine manuelle Konfiguration. (#6814)
10. Umfassende Sicherheitshärtung — 11 Kritische Fehlerbehebungen
Die tiefgreifendste Sicherheitshärtung in der Geschichte von Hermes:
| Schwachstelle | Behebung | PR |
|---|---|---|
| SMS RCE | Twilio-Webhook-Signaturvalidierung | #7933 |
| Shell-Injection | Quoting der Sandbox-Schreibpfade | #7940 |
| Git-Argument-Injection | Schutz vor Path-Traversal + Argument-Injection | #7944 |
| SSRF | Redirect-Schutz bei Slack-Bilduploads | #7151 |
| Path Traversal | Grenzschutz in Checkpoint-Manager + Skill-Manager | #7156 |
| API Bind Guard | Erzwingt API_SERVER_KEY für nicht-lokale Bindungen |
#7455 |
| Approval-Button-Auth | Authentifizierung für Sitzungsfortsetzung erforderlich | #6930 |
11. hermes backup & hermes import — Backup & Wiederherstellung mit einem Klick
Vollständiges Backup und Wiederherstellung deiner Hermes-Konfiguration, Sitzungen, Skills und Erinnerungen. Migration zwischen Maschinen oder Snapshot vor größeren Änderungen — ein Befehl erledigt alles.
# Alles sichern
hermes backup
# Auf einem neuen Rechner wiederherstellen
hermes import ./backup-2026-04-13.tar.gz
(#7997)
12. 16 unterstützte Plattformen — Wirklich überall
Mit diesem Release unterstützt Hermes 16 Messaging-Plattformen:
Telegram, Discord, Slack, WhatsApp, Signal, Matrix, iMessage (neu), WeChat (neu), WeCom, E-Mail, SMS, DingTalk, Feishu, Mattermost, Home Assistant, Webhooks
13. Debugging-Toolkit — /debug & hermes debug share
Neue Debugging-Befehle: Der /debug-Slash-Befehl ist auf allen Plattformen für schnelle Diagnosen verfügbar, und hermes debug share lädt einen vollständigen Debug-Bericht zur einfachen Weitergabe bei der Fehlersuche in ein Pastebin hoch. (#8681)
# Schnelldiagnose in der CLI
/debug
# Debug-Bericht exportieren und teilen
hermes debug share
Kern-Agent & Architektur
Provider- & Modellunterstützung
- xAI (Grok) als nativer Provider mit direktem API-Zugriff und Modellkatalog
- Xiaomi MiMo als erstklassiger Provider — Setup-Assistent, Modellkatalog, Wiederherstellung bei leeren Antworten
- Qwen OAuth-Provider mit Portal-Request-Unterstützung
- Fast Mode —
/fast-Umschalter für OpenAI Priority Processing + Anthropic Fast Tier - Strukturierte API-Fehlerklassifizierung für intelligente Failover-Entscheidungen
- Rate-Limit-Header-Erfassung, angezeigt in
/usage - API-Server-Modellname abgeleitet vom Profilnamen
- Benutzerdefinierte Provider jetzt in
/model-Auflistungen und -Auflösung enthalten - Fallback-Provider-Aktivierung bei wiederholten leeren Antworten mit benutzersichtbarem Status
- OpenRouter-Varianten-Tags (
:free,:extended,:fast) bleiben beim Modellwechsel erhalten - Credential-Exhaustion-TTL von 24 Stunden auf 1 Stunde reduziert
- OAuth-Credential-Lebenszyklus-Härtung — veraltete Pool-Keys, auth.json-Synchronisation, Codex-CLI-Race-Conditions behoben
- Wiederherstellung bei leeren Antworten für Reasoning-Modelle (MiMo, Qwen, GLM)
- MiniMax-Kontextlängen, Thinking-Guard, Endpunkt-Korrekturen
- Z.AI-Endpunkt-Autoerkennung über Probe und Cache
Agent-Schleife & Konversation
- Austauschbarer Context-Engine-Slot über
hermes plugins - Hintergrundprozess-Überwachung —
watch_patternsfür Echtzeit-Benachrichtigungen bei Ausgabetreffern - Verbesserte Kontextkomprimierung — höhere Limits, Tool-Tracking, Degradationswarnungen, Token-Budget-Schutz am Ende
/compress <fokus>— geführte Komprimierung mit einem Fokusthema- Abgestufte Kontextdruck-Warnungen mit Gateway-Deduplizierung
- Gestaffelte Inaktivitätswarnung vor Timeout-Eskalation
- Verhindert Abbruch des Agenten mitten in der Aufgabe — Komprimierungsgrenze, Budget-Überholung, Aktivitätsverfolgung
- Weiterleitung von Kind-Aktivität an Elternknoten bei
delegate_task - Erkennung abgeschnittener Streaming-Tool-Aufrufe vor der Ausführung
- Wiederholung bei leeren Antworten (3 Versuche mit Anstoß)
- Adaptives Streaming-Backoff + Cursor-Strip zur Vermeidung von Nachrichtenabschneidung
- Komprimierung verwendet Live-Sitzungsmodell statt veralteter persistierter Konfiguration
- Entfernt
<thought>-Tags aus Gemma-4-Antworten - Verhindert, dass
<think>im Fließtext die Antwortausgabe unterdrückt - Diagnoseprotokollierung am Turn-Ende in der Agent-Schleife
- Tool-Interrupt-Signal pro Thread isoliert, um Cross-Session-Leaks zu vermeiden
Speicher & Sitzungen
- Hindsight Memory Plugin — Funktionsgleichheit, Setup-Assistent, Konfigurationsverbesserungen (@nicoloboschi)
- Honcho — optionales
initOnSessionStartfür den Tools-Modus (@Kathie-yu) - Verwaiste Kindelemente statt Kaskadenlöschung bei Prune/Delete
- Doctor-Befehl prüft nur den aktiven Speicher-Provider
Messaging-Plattformen (Gateway)
Neue Plattformen
- BlueBubbles (iMessage) — vollständiger Adapter mit automatischer Webhook-Registrierung, Setup-Assistent und Absturzsicherheit
- WeChat (Weixin) — native Unterstützung über iLink Bot API mit Streaming, Medien-Uploads und Markdown-Links
- WeCom Callback-Modus — Adapter für selbst erstellte Unternehmens-Apps mit atomarer Zustandspersistenz
Plattform-Verbesserungen
Discord:
- Whitelist für erlaubte Kanäle konfigurierbar
- Themenvererbung von Forum-Kanälen in Thread-Sitzungen
DISCORD_REPLY_TO_MODE-Einstellung- Akzeptiert
.log-Anhänge, erhöhtes Dokumentengrößen-Limit - Entkopplung der Slash-Command-Synchronisation von der Bereitschaft
Slack:
- Konsolidierte Slack-Verbesserungen — 7 Community-PRs in einem zusammengeführt
- Behandlung von Assistant-Thread-Lebenszyklusereignissen
Matrix:
- Migration von matrix-nio zu mautrix-python
- SQLite-Krypto-Speicher ersetzt Pickle (behebt E2EE-Entschlüsselung)
- Cross-Signing-Wiederherstellungsschlüssel-Verifikation für E2EE-Migration
- DM-Erwähnungs-Threads + Gruppenchat-Ereignisse für Feishu
Gateway-Kern
- Einheitliche Proxy-Unterstützung — SOCKS, DISCORD_PROXY, Multi-Plattform mit automatischer macOS-Erkennung
- Eingehende Text-Batch-Verarbeitung für Discord, Matrix, WeCom + adaptive Verzögerung
- Natürliche Mid-Turn-Assistant-Nachrichten in Chat-Plattformen anzeigen
- WSL-bewusstes Gateway mit intelligenter systemd-Erkennung
- Alle fehlenden Plattformen zum Setup-Assistenten hinzugefügt
- Pro-Plattform-
tool_progress-Überschreibungen - Konfigurierbares Intervall für „arbeitet noch“-Benachrichtigungen
/model-Wechsel bleibt über Nachrichten hinweg erhalten/usagezeigt Rate Limits, Kosten und Token-Details zwischen Turns an- Laufende Arbeit vor Neustart abschließen
- Kein Entfernen des zwischengespeicherten Agenten bei fehlgeschlagenen Durchläufen — verhindert MCP-Neustartschleifen
- Ersetzt
os.environ-Sitzungszustand durchcontextvars - Kanalverzeichnis-Plattformen aus Enum statt hartcodierter Liste abgeleitet
- Bild-Downloads vor dem Caching validieren (plattformübergreifend)
- Plattformübergreifende Webhook-Zustellung für alle Plattformen
- Cron-Discord-Thread-ID-Zustellungsunterstützung
- Feishu-QR-basiertes Bot-Onboarding
- Gateway-Status auf aktives Profil beschränkt
- Verhindert, dass Hintergrundprozess-Benachrichtigungen falsche Kopplungsanfragen auslösen
CLI & Benutzererfahrung
Interaktive CLI
- Termux / Android-Unterstützung — angepasste Installationspfade, TUI, Voice,
/image - Nativer
/model-Auswahl-Modal für Provider → Modell-Auswahl - Live-Timer pro Tool im TUI-Spinner wiederhergestellt
- Gestapelter Tool-Progress-Scrollback in der TUI
- Zufällige Tipps bei neuem Sitzungsstart (CLI + Gateway, 279 Tipps)
hermes dump— kopierbare Setup-Zusammenfassung für Debugginghermes backup/hermes import— vollständiges Konfigurations-Backup und Wiederherstellung- WSL-Umgebungshinweis im System-Prompt
- Profil-Erstellungs-UX — SOUL.md anlegen + Credential-Warnung
- Shell-bewusste sudo-Erkennung, Unterstützung für leere Passwörter
- stdin nach curses/terminal-Menüs leeren, um Escape-Sequenz-Leckagen zu vermeiden
- Behandlung von defektem stdin beim prompt_toolkit-Start
Einrichtung & Konfiguration
- Pro-Plattform-Anzeigedetaillierung konfigurierbar
- Komponentengetrenntes Logging mit Sitzungskontext und Filterung
network.force_ipv4-Konfiguration zur Behebung von IPv6-Timeout-Problemen- Standardisierung von Nachrichten-Whitespace und JSON-Formatierung
- OpenClaw → Hermes Rebranding während der Migration
- config.yaml hat Vorrang vor Env-Variablen für Hilfseinstellungen
- Härtung der Setup-Provider-Abläufe + Live-OpenRouter-Katalogaktualisierung
- Normalisierung der Reasoning-Effort-Reihenfolge auf allen Oberflächen
- Entfernte
LLM_MODEL-Env-Variable + Migration zur Bereinigung veralteter Einträge - Entfernung des
/prompt-Slash-Befehls — Prefix-Expansion-Fußangel HERMES_HOME_MODE-Env-Variable zur Überschreibung von Berechtigungen- Fallback auf Standardmodell bei leerer Modellkonfiguration
- Warnung, wenn das Komprimierungsmodell einen zu kleinen Kontext hat
Werkzeugsystem
Umgebungen & Ausführung
- Vereinheitlichte Spawn-per-Call-Ausführungsschicht für Umgebungen
- Vereinheitlichte Dateisynchronisation mit mtime-Tracking, Löschung und transaktionalem Zustand
- Persistente Sandbox-Umgebungen überleben zwischen Turns
- Bulk-Dateisynchronisation via Tar-Pipe für SSH/Modal-Backends
- Daytona — Bulk-Upload, Konfigurationsbrücke, stille Speicherplatzbegrenzung
- Vordergrund-Timeout-Obergrenze zur Vermeidung von Sitzungs-Deadlocks
- Schutz vor ungültigen Befehlswerten
MCP
hermes mcp add --envund--preset-Unterstützung- Kombiniert
contentundstructuredContent, wenn beide vorhanden sind - MCP-Tool-Namenskonflikt-Behebungen
Browser
- Browser-Härtung — Entfernung von totem Code, Caching, Scroll-Performance, Sicherheit, Thread-Sicherheit
/browser connectAuto-Launch verwendet dediziertes Chrome-Profilverzeichnis- Verwaiste Browser-Sitzungen beim Start aufräumen
Sprache & Vision
- Voxtral TTS-Provider (Mistral AI)
- TTS-Geschwindigkeitsunterstützung für Edge TTS, OpenAI TTS, MiniMax
- Vision-Auto-Resize für übergroße Bilder, Limit auf 20 MB erhöht, Wiederholung bei Fehlschlag
- STT-Provider-Modell-Diskrepanz behoben (whisper-1 vs. faster-whisper)
Weitere Werkzeuge
hermes dump-Befehl für Setup-Zusammenfassung- TODO-Speicher erzwingt ID-Eindeutigkeit bei Ersetzungsoperationen
- Alle verfügbaren Toolsets in der
delegate_task-Schemabeschreibung auflisten - API-Server: Tool-Progress als benutzerdefiniertes SSE-Event zur Vermeidung von Modellverfälschung
- API-Server: Ein Docker-Container für alle Konversationen gemeinsam nutzen
Fähigkeiten-Ökosystem
- Zentralisierter Skills-Index + Tree-Cache — eliminiert Rate-Limit-Fehler bei der Installation
- Durchsetzungsstärkere Skill-Ladeanweisungen im System-Prompt (v3)
- Google Workspace Skill auf GWS-CLI-Backend migriert
- Creative Divergence Strategies Skill (@SHL0MS)
- Creative Ideation — constraint-gesteuerte Projektgenerierung (@SHL0MS)
- Parallelisierung von Skills-Browse/Search zur Vermeidung von Hängern
- Name aus SKILL.md-Frontmatter in skills_sync lesen
Sicherheit & Zuverlässigkeit
Sicherheitshärtung
- Twilio-Webhook-Signaturvalidierung — SMS-RCE-Behebung
- Shell-Injection-Neutralisierung in
_write_to_sandboxdurch Pfad-Quoting - Git-Argument-Injection und Path-Traversal-Schutz im Checkpoint-Manager
- SSRF-Redirect-Umgehung bei Slack-Bilduploads + base.py-Cache-Helfer
- Path Traversal, Credential-Gate, DANGEROUS_PATTERNS-Lücken
- API Bind Guard — erzwingt
API_SERVER_KEYfür nicht-lokale Bindungen - Approval-Button-Autorisierung — Authentifizierung für Sitzungsfortsetzung erforderlich
- Pfadbegrenzungsschutz in Skill-Manager-Operationen
- DingTalk/API-Webhook-URL-Ursprungsvalidierung, Header-Injection-Abwehr
Zuverlässigkeit
- Kontextbezogene Fehlerdiagnose für ungültige API-Antworten
- Verhindert 400-Formatfehler beim Auslösen der Komprimierungsschleife auf Codex
- Keine Halbierung von context_length bei Output-Cap-Too-Large-Fehlern
- Wiederherstellung des primären Clients bei OpenAI-Transportfehlern
- Credential-Pool-Rotation bei als Abrechnungsfehler klassifizierten 400ern
- Automatische Erhöhung des Stream-Read-Timeouts für lokale LLM-Provider
- Fallback auf Standardzertifikate, wenn der CA-Bundle-Pfad nicht existiert
- Disambiguierung von Usage-Limit-Mustern im Fehlerklassifizierer
- Härtung von Cron-Skript-Timeout und Provider-Wiederherstellung
- Gateway-Interrupt-Erkennung resistent gegen Monitor-Task-Fehler
- Verhindert unerwünschtes automatisches Session-Reset nach sauberen Gateway-Neustarts
- Verhindert doppelte Update-Prompt-Spam im Gateway-Watcher
- Deduplizierung von Reasoning-Elementen in der Responses-API-Eingabe
Infrastruktur
- Multi-Arch-Docker-Image — amd64 + arm64
- Docker läuft als Nicht-Root-Benutzer mit Virtualenv
- Verwendung von
uvfür Docker-Abhängigkeitsauflösung - Container-bewusste Nix-CLI — automatische Weiterleitung in verwalteten Container
- Nix-Shared-State-Berechtigungsmodell für interaktive CLI-Benutzer
- Pro-Profil-Subprocess-HOME-Isolierung
- Profilpfade in Docker korrigiert — Profile gehen ins gemountete Volume
- Docker-Container-Gateway-Pfad gehärtet
- Unbuffered stdout für Live-Docker-Logs aktiviert
- procps im Docker-Image installiert
- Shallow Git Clone für schnellere Installation
hermes updatesetzt bei Stash-Konflikten immer zurück- Update-Exit-Code vor Gateway-Neustart schreiben (Cgroup-Kill-Race)
- Nix:
setupSecretsoptional, tirith-Laufzeitabhängigkeit - launchd-Stop verwendet
bootout, damitKeepAlivenicht neu startet
Wichtige Fehlerbehebungen
- Fix:
/model-Wechsel bleibt nicht über Gateway-Nachrichten erhalten - Fix: sitzungsbezogene Gateway-Modell-Überschreibungen ignoriert
- Fix: Komprimierungsmodell-Kontextlänge ignoriert Konfiguration (3 zusammenhängende Issues)
- Fix: OpenCode.ai-Kontextfenster auf 128K statt 1M aufgelöst
- Fix: Codex-Fallback-Auth-Store-Lookup
- Fix: doppelte Abschlussbenachrichtigungen bei Prozessabbruch
- Fix: Agent-Daemon-Thread verhindert verwaiste CLI-Prozesse beim Schließen des Tabs
- Fix: veraltete Bildanhänge beim Einfügen von Text und bei Spracheingabe
- Fix: DM-Thread-Session-Seeding verursacht Cross-Thread-Kontamination
- Fix: OpenClaw-Migration zeigt Dry-Run-Vorschau vor Ausführung
- Fix: Auth-Fehler als wiederholbar fehlklassifiziert
- Fix: Copilot-Integration-Id-Header fehlt
- Fix: ACP-Session-Fähigkeiten
- Fix: ACP-PromptResponse-Nutzung aus Top-Level-Feldern
- Fix: mehrere fehlschlagende/flaky Tests auf main
- Fix: Backup-Marker-Dateinamen
- Fix:
NoneTypein fast_mode-Prüfung - Fix: fehlende Imports in uninstall.py
Dokumentation
- Plattform-Adapter-Entwicklerhandbuch + WeCom-Callback-Dokumentation
- Cron-Fehlerbehebungsleitfaden
- Streaming-Timeout-Autoerkennung für lokale LLMs
- Dokumentation zur Tool-Use-Durchsetzung erweitert
- BlueBubbles-Kopplungsanleitung
- Abschnitt zur Telegram-Proxy-Unterstützung
hermes dumpundhermes logsCLI-Referenztool_progress_overrides-Konfigurationsreferenz- Dokumentation zur Komprimierungsmodell-Kontextlängen-Warnung
Upgrade
hermes update
Für Neuinstallationen besuchen Sie den Installationsleitfaden.
Vollständiges Changelog auf GitHub
← Hermes Agent Changelog