Hermes Agent v0.8.0 — Das Intelligence-Release
Überblick
v0.8.0 — The Intelligence Release. Veröffentlicht am 8. April 2026. Nur 5 Tage nach v0.7.0: 209 gemergte PRs · 82 gelöste Issues · hunderte geänderte Dateien · dutzende Community-Mitwirkende.
War v0.7.0 der „Resilience-Release“ (austauschbare Memory-Provider, Camofox Anti-Detection-Browser, tiefgreifende Gateway-Härtung), dreht sich bei v0.8.0 alles um eines — intelligenter werden. Hermes hat gelernt, eigene Fehlermodi zu diagnostizieren und sich selbst zu patchen. Es hat gelernt, dich zu benachrichtigen, wenn Hintergrundaufgaben abgeschlossen sind. Es hat gelernt, tatsächliche Tool-Aktivität statt reiner Wanduhrzeit zu verfolgen, um Timeout-Entscheidungen zu treffen. Das sind keine Feature-Aufzählungen. Das ist eine systematische Steigerung der Agent-Intelligenz.
Hauptfunktionen
1. Automatische Benachrichtigungen für Hintergrundaufgaben (notify_on_complete) — Kein Polling mehr
Hintergrundaufgaben benachrichtigen den Agenten nun automatisch, wenn sie abgeschlossen sind. Starte einen langlaufenden Prozess — Modelltraining, Test-Suites, Deployments, Builds — und der Agent greift die Ergebnisse bei Fertigstellung auf. Kein ps, kein tail -f, keine Polling-Schleifen. Der Agent sagt dir einfach, wenn es erledigt ist.
# Starte einen Hintergrund-Trainingsjob
hermes run "python train.py --epochs 100" --background
# Arbeite währenddessen mit dem Agenten an anderen Dingen weiter
# Wenn das Training abgeschlossen ist, wird der Agent benachrichtigt und meldet die Ergebnisse
(#5779)
2. Kostenloses Xiaomi MiMo v2 Pro im Nous Portal
Der kostenlose Tarif des Nous Portals enthält jetzt Xiaomi MiMo v2 Pro für Hilfsaufgaben — Komprimierung, Vision, Zusammenfassung. Die Modellauswahl-UI zeigt die Preisgestaltung neben jedem Modell an, und die Free-Tier-Beschränkung ist transparent. Falls du Hermes bisher wegen des Geldbeutels zurückgestellt hast — diese Woche wurde der kostenlose Tarif spürbar besser.
3. Live-Modellwechsel (/model-Befehl) — Modelle mitten in der Sitzung wechseln
Wechsle Modelle und Provider mitten in der Sitzung — über CLI, Telegram, Discord, Slack oder jede Gateway-Plattform. Der Resolver ist aggregator-bewusst — wenn du OpenRouter oder Nous Portal verwendest, bleibst du beim Aggregator, solange das Modell dort verfügbar ist, und fällst nur bei Bedarf auf direkte Provider zurück. Telegram und Discord erhalten interaktive Inline-Button-Auswahlmenüs — antippen zum Auswählen, kein Tippen erforderlich.
# Jederzeit während einer Sitzung wechseln
/model claude-sonnet-4-20250514
# Oder das interaktive Auswahlmenü öffnen
/model
4. Selbstoptimierte GPT/Codex Tool-Use-Anleitungen — Der Agent hat sich selbst gepatcht
Dies ist der technisch faszinierendste PR in v0.8.0. Das Team baute eine automatisierte Pipeline für verhaltensbasiertes Benchmarking, die GPT- und Codex-Modelle systematisch testete, fünf spezifische Fehlermodi bei Tool-Aufrufen identifizierte, gezielte Anleitungs-Strings zur Behebung generierte, die Verbesserung maß und das Ergebnis als Teil des System-Prompts auslieferte. Der Agent diagnostizierte und patchte sich selbst — Menschen saßen als Reviewer im Loop, nicht als Prompt Engineers.
Gepaart mit Execution-Discipline-Anleitungen in System-Prompts und Thinking-Only-Prefill-Fortsetzung für strukturiertes Reasoning — all das verbessert die Zuverlässigkeit beim Einsatz von Hermes auf OpenAI-Modellen drastisch.
5. Google AI Studio (Gemini) als nativer Provider
Direkter Zugriff auf Gemini-Modelle über die AI Studio-API von Google. Integriert mit der models.dev-Registry zur automatischen Echtzeit-Erkennung der Kontextlänge — kein manuelles Festlegen von Token-Limits mehr.
(#5577)
6. Intelligente Inaktivitäts-Timeouts — Arbeitende Agenten werden nie gekillt
Gateway- und Cron-Timeouts verfolgen jetzt die tatsächliche Tool-Aktivität statt der reinen Wanduhrzeit. Langlaufende Aufgaben, die aktiv Ausgaben produzieren (Befehle ausführen, Dateien lesen/schreiben), werden niemals beendet. Nur wirklich inaktive Agenten laufen in einen Timeout.
7. Genehmigungs-Buttons auf Slack & Telegram — Vergiss das Tippen von /approve
Genehmigungen für gefährliche Befehle erfolgen jetzt über native Plattform-Buttons. Slack bewahrt den Thread-Kontext, Telegram zeigt Emoji-Reaktionen für den Genehmigungsstatus. Deutlich schneller, als jedes Mal /approve einzutippen.
8. MCP OAuth 2.1 PKCE + OSV-Malware-Scanning
Vollständig OAuth-2.1-PKCE-standardskonformer Client für die MCP-Server-Authentifizierung. Zusätzlich werden MCP-Erweiterungspakete bei der Installation automatisch gegen die OSV-Schwachstellendatenbank gescannt — so wird bösartiger Code erkannt, bevor er ausgeführt wird.
9. Zentralisiertes Logging & Konfigurationsvalidierung
Strukturiertes Logging nach ~/.hermes/logs/ (agent.log + errors.log), mit dem neuen hermes logs-Befehl zum Verfolgen und Filtern. Die Konfigurationsstruktur-Validierung erkennt fehlerhaftes YAML beim Start mit umsetzbaren Fehlermeldungen — Schluss mit „mysteriösen Abstürzen“.
# Aktuelle Logs anzeigen
hermes logs
# Nur Fehler
hermes logs --level WARNING
10. Erweiterung des Plugin-Systems
Plugins können jetzt:
- Eigenständige CLI-Subcommands registrieren, ohne den Core-Code anzufassen
- Request-scoped API-Hooks mit Correlation-IDs empfangen
- Während der Installation nach erforderlichen Umgebungsvariablen fragen
- Sich in Session-Lifecycle-Events einklinken (finalize / reset)
11. Matrix auf Tier 1 hochgestuft
Matrix erhält Reactions, Lesebestätigungen, Rich-Formatierung und Raumverwaltung — und erreicht damit Funktionsgleichstand mit Telegram und Discord als First-Class-Plattform.
12. Sicherheitshärtungs-Durchlauf
SSRF-Schutz, Timing-Attack-Mitigationen, Tar-Traversal-Prävention, Schutz vor Credential-Leaks, Cross-Session-Isolation — ein systematisches Sicherheitsaudit über die gesamte Codebasis.
Core-Agent & Architektur
Provider- & Modell-Support
- Nativer Google AI Studio (Gemini)-Provider mit models.dev-Autoerkennung für Kontextlängen
/model-Befehl — vollständige Überarbeitung des Provider+Modell-Systems mit Live-Wechsel über CLI und alle Gateways- Interaktiver Modell-Picker für Telegram und Discord mit Inline-Buttons
- Nous Portal Free-Tier-Modellbeschränkung mit Preisanzeige in der Modellauswahl
- xAI (Grok) Prompt-Caching via
x-grok-conv-id-Header - MiniMax TTS-Provider (speech-2.8)
- Warnung vor nicht-agentischen Modellen — alarmiert beim Laden von Hermes-LLMs, die nicht für Tool-Use ausgelegt sind
- Ollama Cloud Auth, Modellwechsel-Persistenz, Alias-Tab-Vervollständigung
- Modellpreis-Anzeige für OpenRouter und Nous Portal
- Auxiliary-Client-Zahlungs-Fallback — Wiederholung mit nächstem Provider bei 402
- Auxiliary-Client löst benannte Custom-Provider und ‘main’-Alias auf
- Provider-Credential-Reset-Fenster werden bei gepooltem Failover berücksichtigt
- OAuth-Token-Synchronisation zwischen Credential-Pool und Credentials-Datei
- Veraltete OAuth-Credentials blockieren OpenRouter-Autoerkennung nicht mehr
- Codex OAuth-Credential-Pool — Disconnect- und Abgelaufene-Token-Import-Fixes
- Vision-Autoerkennung versucht zuerst den Haupt-Provider
- MiniMax-Kontextlängen, Thinking-Guard, Aux-Modell, Config-base_url-Korrekturen
- Z.AI-Endpunkt-Autoerkennung via Probe und Cache
- Community-Provider/Modell-Resolution-Fixes — 4 Community-PRs gerettet
Agent-Loop & Konversation
- Selbstoptimierte GPT/Codex Tool-Use-Anleitungen — automatisiertes verhaltensbasiertes Benchmarking identifizierte und patchte 5 Fehlermodi
- GPT/Codex Execution-Discipline-Anleitungen in System-Prompts
- Thinking-Only-Prefill-Fortsetzung für strukturiertes Reasoning
- Akzeptiere Reasoning-Only-Antworten ohne Wiederholungen — setzt Inhalt auf „(empty)“ statt endloser Retries
- Jittered Retry Backoff — exponentieller Backoff mit Jitter für API-Retries
- Intelligentes Thinking-Block-Signatur-Management — bewahrt Anthropic-Thinking-Signaturen über Turns hinweg
- Erzwinge Tool-Call-Argumente passend zu JSON-Schema-Typen — behebt Modelle, die Strings statt Numbers/Booleans senden
- Speichere übergroße Tool-Ergebnisse in Datei statt destruktiver Kürzung
- Streaming-Fallback nach Edit-Fehlern verbessert
- Codex-Leerausgabe-Lücken in Fallback + Normalizer + Auxiliary-Client abgedeckt
- Codex-Stream-Ausgabe-Backfill aus output_item.done-Events
- Stream-Consumer erstellt neue Nachricht nach Tool-Grenzen
- Filtere Transcript-Only-Rollen aus Chat-Completions-Payload
- Bereinige tool_calls für alle Strict-APIs (Fireworks, Mistral etc.)
- Bridge tool-calls im Copilot-ACP-Adapter
Memory & Sessions
- Supermemory Memory-Provider — Multi-Container, search_mode, Identity-Template, Env-Var-Override
- Geteilte Thread-Sessions als Standard — Multi-User-Thread-Support auf Gateway-Plattformen
- Subagent-Sessions mit Parent verknüpft und aus Sitzungsliste ausgeblendet
- Profil-bezogene Memory-Isolation und Clone-Support
- Thread-Gateway-user_id an Memory-Plugins für benutzerbezogene Abgrenzung
- Honcho-Plugin-Drift-Überholung + Plugin-CLI-Registrierungssystem
- mem0 API v2-Kompatibilität, Prefetch-Context-Fencing, Secret-Redaction
- RetainDB — API-Routen, Write-Queue, Dialektik, Agent-Modell-Fixes
- Hindsight Memory-Plugin-Überholung + Memory-Setup-Wizard-Fixes
- OpenViking atexit-Sicherheitsnetz für Session-Commit, Tenant-Scoping-Header
- ByteRover brv-Abfrage läuft synchron vor dem LLM-Aufruf
- Bereinigte User-Nachricht wird für alle Memory-Provider-Operationen verwendet
Messaging-Plattformen (Gateway)
Gateway Core
- Inaktivitätsbasiertes Timeout ersetzt Wanduhrzeit — aktive Aufgaben werden nie gekillt
- Genehmigungs-Buttons für Slack & Telegram + Slack-Thread-Kontext-Erhaltung
- Live-Stream-/update-Ausgabe + Weiterleitung interaktiver Prompts an Benutzer
- Unendliches Timeout + periodische Benachrichtigungen + umsetzbare Fehlermeldungen
- Duplicate-Message-Prävention — Gateway-Dedup + Partial-Stream-Guard
- Webhook-delivery_info-Persistenz + vollständige Session-ID in /status
- Tool-Vorschau-Kürzung respektiert tool_preview_length in allen/neuen Fortschrittsmodi
- Approval-Session-Key pro Turn isoliert
- Active-Session-Guard-Bypass für /approve, /deny, /stop, /new
- Tippindikator pausiert während Genehmigungswartezeiten
- Caption-Prüfung verwendet exakten zeilenweisen Abgleich statt Substring (alle Plattformen)
- MEDIA:-Tags entfernt aus gestreamten Gateway-Nachrichten, aus Cron-Delivery extrahiert
- Profil-bewusste Service-Units + Voice-Transcription-Bereinigung
- Thread-sicherer PairingStore mit atomaren Schreibvorgängen
- Cron-statische-Methoden-Wrapper zur Verhinderung von Self-Binding
Plattform-Verbesserungen
| Plattform | Wichtigste Änderungen |
|---|---|
| Telegram | Gruppen-Themen-Skill-Binding, Emoji-Reaktions-Genehmigungen, Duplicate-Message-Prävention, Befehlsnamen-Bereinigung, deaktivierbare Skills pro Plattform |
| Discord | Kanalsteuerung (ignored_channels / no_thread_channels), Skills als native Slash-Commands, /approve als Slash-Commands registriert, unnötigen Members-Intent entfernt |
| Slack | Thread-Auto-Engagement, mrkdwn in edit_message, Thread-Antworten ohne @mentions |
| Matrix | Tier-1-Upgrade: Reactions, Lesebestätigungen, Rich-Formatierung, Raumverwaltung, CJK-Eingabe, E2EE, Reconnect |
| Signal | Vollständige MEDIA:-Tag-Zustellung |
| Mattermost | Dateianhang-Support |
| Feishu | Interaktive Card-Genehmigungs-Buttons, Reconnect + ACL-Fixes |
| Webhooks | {__raw__}-Template-Token, thread_id-Durchreichung für Foren-Themen |
CLI & User Experience
Interaktive CLI
- Antwortinhalt zurückstellen, bis der Reasoning-Block abgeschlossen ist
- Ghost-Statuszeilen bei Terminal-Größenänderung gelöscht
- Normalisiere \r\n- und \r-Zeilenenden in eingefügtem Text
- Native Windows-Bildeinfügung unterstützt
--yolound andere Flags werden nicht mehr stillschweigend ignoriert, wenn sie vor dem ‘chat’-Subcommand stehen- ChatConsole-Fehler, Curses-Scroll, Skin-bewusster-Banner, Git-State-Fixes
Setup & Konfiguration
- Konfigurationsstruktur-Validierung — erkennt fehlerhaftes YAML beim Start mit umsetzbaren Meldungen
- Zentralisiertes Logging nach
~/.hermes/logs/(agent.log + errors.log) mithermes logs-Befehl - Doctor-Diagnose — Sync-Provider-Prüfungen, Config-Migration, WAL- und mem0-Diagnose
- Timeout-Debug-Logging und benutzerorientierte Diagnose verbessert
- Reasoning-Effort ausschließlich in config.yaml vereinheitlicht
- Permanente Befehls-Allowlist wird beim Start geladen
hermes auth removelöscht jetzt per Umgebungsvariable gesetzte Credentials dauerhaft- Gebündelte Skills werden bei Update mit allen Profilen synchronisiert
hermes updatekillt nicht mehr den frisch neugestarteten Gateway-Dienst- Subprocess.run()-Timeouts zu allen Gateway-CLI-Befehlen hinzugefügt
- Docs-Links zu Setup-Wizard-Abschnitten hinzugefügt
Cron-System
- Inaktivitätsbasiertes Cron-Timeout — aktive Aufgaben laufen unbegrenzt
- Pre-Run-Script-Injection für Datensammlung und Änderungserkennung
- Zustellungsfehler-Tracking im Job-Status
- Zustellungsanleitung in Cron-Prompts — verhindert send_message-Dauerflackern
- MEDIA-Dateien werden als native Plattform-Anhänge zugestellt
- [SILENT]-Unterdrückung funktioniert an beliebiger Stelle in der Antwort
- Cron-Pfad-Traversal-Härtung
Tool-System
Terminal & Ausführung
- Execute_code auf Remote-Backends — Docker, SSH, Modal und andere Remote-Terminal-Backends
- Exit-Code-Kontext für gängige CLI-Tools — hilft dem Agenten zu verstehen, was schiefgelaufen ist
- Progressive Subdirectory-Hint-Erkennung — der Agent lernt die Projektstruktur beim Navigieren
- notify_on_complete für Hintergrundprozesse
- Docker-Env-Konfiguration — explizite Container-Umgebungsvariablen via docker_env
- Genehmigungs-Metadaten in Terminal-Tool-Ergebnissen enthalten
- Workdir-Parameter über alle Backends hinweg bereinigt
Browser
- Managed-Browser-Provider von Browserbase auf Browser Use umgestellt
- Firecrawl Cloud Browser-Provider
- JS-Auswertung via browser_console-Expression-Parameter
- Windows-Browser-Fixes
MCP
- MCP OAuth 2.1 PKCE — vollständig standardkonformer OAuth-Client
- OSV-Malware-Prüfung für MCP-Erweiterungspakete
- Bevorzuge structuredContent vor text + no_mcp-Sentinel
- Warnung vor unbekannten Toolsets für MCP-Servernamen unterdrückt
Web & Dateien
- .zip-Dokument-Support + automatisches Mounten von Cache-Verzeichnissen in Remote-Backends
- Query-Secrets schwärzen in send_message-Fehlern
Delegation
- Credential-Pool-Sharing + Workspace-Pfad-Hinweise für Subagents
ACP (VS Code / Zed / JetBrains)
- Aggregierte ACP-Verbesserungen — Auth-Kompatibilität, Protokoll-Fixes, Command-Ads, Delegation, SSE-Events
Skills-Ökosystem
Skills-System
- Skill-Config-Interface — Skills können erforderliche config.yaml-Einstellungen deklarieren, werden beim Setup abgefragt und beim Laden injiziert
- Plugin-CLI-Registrierungssystem — Plugins registrieren eigene CLI-Subcommands, ohne main.py anzufassen
- Request-scoped API-Hooks mit Tool-Call-Correlation-IDs für Plugins
- Session-Lifecycle-Hooks — on_session_finalize und on_session_reset für CLI + Gateway
- Abfrage erforderlicher Umgebungsvariablen während der Plugin-Installation
- Plugin-Namensvalidierung — weist Namen zurück, die zum Plugins-Root auflösen
- pre_llm_call-Plugin-Kontext in User-Nachricht verschoben, um Prompt-Cache zu erhalten
Neue & aktualisierte Skills
- popular-web-designs — 54 produktive Website-Designsysteme
- p5js Creative Coding
- manim-video — mathematische und technische Animationen
- llm-wiki — Karpathys LLM-Wiki
- gitnexus-explorer — Codebase-Indizierung und Wissensbereitstellung
- research-paper-writing — AI-Scientist- & GPT-Researcher-Muster
- blogwatcher auf JulienTant-Fork aktualisiert
- Claude Code Skill umfassendes Rewrite v2.0 + v2.2
- Manim CE-Referenz-Docs erweitert — Geometrie, Animationen, LaTeX
- Code-Verifizierungs-Skills in einem konsolidiert
Sicherheit & Zuverlässigkeit
Sicherheitshärtung
- Konsolidierte Sicherheit — SSRF-Schutz, Timing-Attack-Mitigationen, Tar-Traversal-Prävention, Credential-Leak-Schutz
- Cross-Session-Isolation + Cron-Pfad-Traversal-Härtung
- Workdir-Parameter im Terminal-Tool über alle Backends bereinigt
- Genehmigungs-,Once“-Session-Eskalation verhindert + Cron-Delivery-Plattform-Validierung
- Profil-bezogene Google Workspace OAuth-Tokens geschützt
Zuverlässigkeit
- Aggressives Worktree- und Branch-Cleanup zur Vermeidung von Ansammlungen
- O(n²) katastrophales Backtracking in Redact-Regex behoben — 100-fache Verbesserung bei großen Ausgaben
- Laufzeitstabilitäts-Fixes in Core-, Web-, Delegate- und Browser-Tools
- API-Server-Streaming-Fix + Conversation-History-Support
- OpenViking-API-Endpunkt-Pfade und Antwort-Parsing korrigiert
Wichtige Bugfixes
- 9 Community-Bugfixes gerettet — Gateway, Cron, Deps, macOS launchd in einem Durchgang
- Batch-Core-Bugfixes — Modellkonfiguration, Session-Reset, Alias-Fallback, launchctl, Delegation, atomare Schreibvorgänge
- Batch-Gateway/Plattform-Fixes — Matrix E2EE, CJK-Eingabe, Windows-Browser, Feishu Reconnect + ACL
- Veraltete Test-Skips entfernt, Regex-Backtracking, File-Search-Bug und Test-Flakiness
- Nix-Flake — Version lesen, uv.lock neu generieren, hermes_logging hinzufügen
- Regressionstests für Kleinbuchstaben-Variablen-Redaction
Testing
- 57 fehlschlagende CI-Tests repariert über 14 Dateien hinweg
- Test-Suite-Neuarchitektur + CI-Fehlerbehebungen
- Codebase-weite Lint-Bereinigung — ungenutzte Imports, toter Code und ineffiziente Muster
- browser_close-Tool entfernt — Auto-Cleanup übernimmt dies
Dokumentation
- Umfassendes Dokumentations-Audit — veraltete Informationen behoben, dünne Seiten erweitert, Tiefe hinzugefügt
- 40+ Diskrepanzen zwischen Dokumentation und Codebasis behoben
- 13 Features aus den PRs der letzten Woche dokumentiert
- Guides-Bereich überholt — Bestehende repariert + 3 neue Tutorials hinzugefügt
- 4 Docs-PRs gerettet — Docker-Setup, Post-Update-Validierung, Local-LLM-Guide, signal-cli-Installation
- Discord-Konfigurationsreferenz
- Community-FAQ-Einträge für gängige Workflows und Fehlerbehebung
- WSL2-Netzwerk-Guide für lokale Modellserver
- Honcho-CLI-Referenz + Plugin-CLI-Registrierungsdokumentation
- Obsidian Headless Setup für Server in llm-wiki
- Hermes Mod visueller Skin-Editor zur Skins-Seite hinzugefügt
Upgrade
hermes update
Für Neuinstallationen besuche den Installationsleitfaden.
Vollständiger Changelog auf GitHub
← Hermes Agent Changelog