Hermes Agent v0.3.0 — Streaming, Plugins & Multi-Provider
Übersicht
v0.3.0 — Streaming, Plugins & Multi-Provider. Veröffentlicht am 17. März 2026, nur 5 Tage nach der ersten öffentlichen Version v0.2.0. Diese Version verwandelte Hermes Agent von einem vielversprechenden Open-Source-Agenten in eine produktionsreife Plattform für autonome Abläufe.
Wenn v0.2.0 der Welt zeigte, was Hermes kann, dann machte v0.3.0 daraus ein poliertes Produkt. Die tokenweise Streaming-Ausgabe beseitigte das Problem des „auf einen leeren Bildschirm starren“. Die Plugin-Architektur öffnete die Tür für Community-Beiträge ohne den Kerncode anzufassen. Und der Neuaufbau des Provider-Systems bedeutete, dass man mit einem einzigen Befehl zwischen OpenAI, Anthropic, den über 200 Modellen von OpenRouter oder einem beliebigen benutzerdefinierten Endpoint wechseln konnte.
Die Community-Reaktion war unmittelbar und massiv: Als diese Version veröffentlicht wurde, nannte die Zero-Human-Companies-Community Hermes Agent bereits „das Betriebssystem für autonome Abläufe“.
Kennzahlen: ~50+ Bugfixes · 14 Hauptfunktionen · 10+ neue Skills · 4 Messaging-Plattform-Überholungen
Hauptfunktionen
1. Einheitliche Streaming-Infrastruktur
Die sichtbarste Änderung in v0.3.0: Antworten werden jetzt Token für Token in der CLI und auf allen Gateway-Plattformen gestreamt.
Was sich ändert:
- Jeder Provider streamt jetzt über eine einheitliche Infrastruktur
- CLI, Telegram, Discord, Slack und alle Gateway-Plattformen erhalten Tokens, sobald sie generiert werden
- Langlaufende Werkzeugaufrufe zeigen den Fortschritt in Echtzeit
# Streaming ist jetzt Standard — keine Konfiguration nötig
hermes
> Schreibe ein Python-Skript, das eine 10GB-Logdatei verarbeitet
# Tokens werden beim Generieren gestreamt. Du kannst:
# - In Echtzeit sehen, was der Agent denkt
# - Mit Ctrl+C unterbrechen, wenn er in die falsche Richtung geht
# - Mittendrin umlenken: "verwende stattdessen Rust"
2. Erstklassige Plugin-Architektur
Das Plugin-System war der Schlüssel zum Community-Wachstum. Lege Python-Dateien in ~/.hermes/plugins/ ab und Hermes erkennt sie automatisch — benutzerdefinierte Werkzeuge, Slash-Befehle, Lifecycle-Hooks, alles ohne das Repository zu forken.
# ~/.hermes/plugins/mein_plugin.py
from hermes.plugin import Plugin, tool
class MeinPlugin(Plugin):
"""Ein Plugin, das ein benutzerdefiniertes Wetter-Werkzeug hinzufügt."""
@tool
def wetter_abrufen(self, stadt: str) -> dict:
"""Aktuelles Wetter für eine Stadt abrufen."""
import requests
resp = requests.get(f"https://api.wetter.beispiel/{stadt}")
return resp.json()
@tool
def stimmung_analysieren(self, text: str) -> dict:
"""Stimmung eines Textes analysieren."""
return {"stimmung": "positiv", "wertung": 0.85}
Plugin-Lifecycle-Hooks:
on_load— wird beim ersten Laden des Plugins ausgeführton_unload— Bereinigung vor dem Entfernenon_tool_call— jeden Werkzeugaufruf abfangen und modifizierenon_response— Agent-Antworten nachbearbeiten
3. Nativer Anthropic-Provider
Vor v0.3.0 bedeutete die Nutzung von Claude-Modellen das Routing über OpenRouter. Der native Anthropic-Provider änderte alles.
Was er ermöglicht:
- Direkte Anthropic-API-Aufrufe — geringere Latenz, kein OpenRouter-Zwischenhändler
- Automatische Claude-Code-Anmeldeerkennung — wenn du Claude Code verwendet hast, findet Hermes deine Anmeldedaten automatisch
- OAuth PKCE-Flows — sichere, standardkonforme Authentifizierung mit Token-Erneuerung
- Natives Prompt-Caching — Anthropics Prompt-Caching reduziert Kosten für lange Gespräche um bis zu 90 %
# Setup mit Anthropic-Provider ausführen
hermes setup --provider anthropic
# Oder mitten in der Sitzung wechseln
/hermes model claude-sonnet-4-20250514
# Hermes erkennt Claude-Code-Anmeldedaten automatisch, falls verfügbar
# hermes.config.yaml
providers:
- name: anthropic
provider: anthropic
model: claude-sonnet-4-20250514
prompt_caching: true
4. Intelligente Freigaben + /stop-Befehl
Inspiriert von Codex’ Ansatz zur Befehlssicherheit lernt das intelligente Freigabesystem, welche Befehle sicher sind, und merkt sich deine Einstellungen.
> Ausführen: pip install pandas numpy scikit-learn
# Erstes Mal: "Diesen pip install-Befehl genehmigen? [j/n/immer]"
# Wähle 'i' (immer) → nie wieder für pip install gefragt
> Ausführen: rm -rf /tmp/build-cache
# "Diese Löschung genehmigen?" — andere Kategorie, fragt erneut
Der /stop-Befehl ist deine Notbremse:
# Agent geht in die falsche Richtung — sofort anhalten
/stop
5. Sprachmodus
Der Sprachmodus kam in v0.3.0 auf drei Oberflächen:
CLI: Push-to-Talk
# Leertaste gedrückt halten zum Sprechen, loslassen zum Senden
hermes --voice
# Oder Sprachmodus mitten in der Sitzung umschalten
/voice
Messaging-Plattformen: Sprachnotizen
- Sende Sprachnotizen auf Telegram oder Discord — Hermes transkribiert und antwortet
- Transkriptionen verwenden faster-whisper für kostenlose lokale Verarbeitung
Discord-Sprachkanäle
- Hermes kann Discord-Sprachkanälen beitreten
- Hört auf Erwähnungen und antwortet verbal
# hermes.config.yaml — Sprachkonfiguration
voice:
stt:
enabled: true
engine: faster-whisper # lokal, kostenlos, kein API-Key nötig
tts:
enabled: true
engine: openai
6. Parallele Werkzeugausführung
Mehrere unabhängige Werkzeugaufrufe werden jetzt parallel über ThreadPoolExecutor ausgeführt.
Vor v0.3.0: Sequenzielle Ausführung — ~9 Sekunden für 3 Suchanfragen Nach v0.3.0: Parallele Ausführung — ~3 Sekunden für 3 Suchanfragen
7. Honcho-Speicherintegration
Honcho (von @erosika) brachte dialektische Benutzermodellierung zu Hermes — der Agent baut im Laufe der Zeit ein Theory-of-Mind-Modell von dir auf.
# hermes.config.yaml
memory:
honcho:
enabled: true
recall_mode: recent # recent | relevant | all
max_memories_per_turn: 5
8. PII-Anonymisierung
Wenn privacy.redact_pii aktiviert ist, werden personenbezogene Daten automatisch entfernt, bevor der Kontext an LLM-Provider gesendet wird.
privacy:
redact_pii: true
Die Anonymisierung erfolgt lokal, bevor Daten deinen Rechner verlassen.
9. /browser connect via CDP
Verbinde Browser-Werkzeuge mit einer laufenden Chrome-Instanz über das Chrome DevTools Protocol.
# Chrome mit Remote-Debugging starten
chrome --remote-debugging-port=9222
# In Hermes verbinden
/browser connect --port 9222
10. Vercel AI Gateway Provider
Leite Hermes durch Vercels AI Gateway für Zugriff auf deren Modellkatalog und Infrastruktur.
providers:
- name: vercel
provider: vercel-ai-gateway
api_key: ${VERCEL_AI_GATEWAY_KEY}
11. Zentralisierter Provider-Router
Das Provider-System wurde komplett um eine einzige call_llm-API herum neu aufgebaut.
# Nahtlos zwischen Modellen wechseln
/hermes model gpt-5 # → OpenAI
/hermes model claude-sonnet-4 # → Anthropic (automatisch erkannt)
/hermes model grok-3 # → xAI
# Präfix-Abgleich funktioniert ebenfalls
/mod gpt-5 # wird zu /model gpt-5 aufgelöst
12. ACP-Server — IDE-Integration
VS Code, Zed und JetBrains können sich jetzt über das Agent Communication Protocol mit Hermes als Agent-Backend verbinden.
# Hermes im ACP-Servermodus starten
hermes serve --acp
13. Persistenter Shell-Modus
Von @alt-glitch. Lokale und SSH-Terminal-Backends behalten den Shell-Zustand über Werkzeugaufrufe hinweg bei.
> cd /mein-projekt
> ls
# (gleiche Shell, Zustand bleibt erhalten)
# Zeigt den Inhalt von /mein-projekt ✓
> export DATABASE_URL=postgres://localhost/mydb
> python manage.py migrate
# DATABASE_URL ist gesetzt ✓
14. Agentic On-Policy Distillation (OPD)
Neue RL-Trainingsumgebung zur Destillation von Agentenrichtlinien, die das Atropos-Trainingsökosystem erweitert.
CLI- & UX-Verbesserungen
| Funktion | Beschreibung |
|---|---|
| Persistente Statusleiste | Modell, Provider und Token-Zähler stets sichtbar |
| Dateipfad-Autovervollständigung | Tab-Vervollständigung für Dateipfade im Prompt |
/plan-Befehl |
Implementierungspläne aus Spezifikationen generieren |
| Präfix-Abgleich | /mod → /model, /sta → /status |
| Skill-Vorabladen | Skills werden beim Start geladen, bereit vor dem ersten Prompt |
Setup & Konfiguration
- OpenClaw-Migration — nahtlose Migration von OpenClaw bei der Ersteinrichtung
- Headless-Setup — vollständiger Einrichtungsablauf funktioniert auf reinen SSH-Servern
.env-Neuladen — Umgebungsänderungen werden ohne Neustart erkannt
Plattform-Updates
Gateway-Kern
| Funktion | Auswirkung |
|---|---|
| Systemdienst-Modus | Als systemd-Systemdienst ausführen |
| Reasoning Hot Reload | Reasoning-Einstellungen ohne Neustart ändern |
| Benutzer-Sitzungsisolation | Gruppenchats teilen keinen Zustand mehr zwischen Benutzern |
| SSL-Autoerkennung | Funktioniert auf NixOS und nicht-standardisierten Systemen |
Telegram
- Medienpufferung verhindert Unterbrechungen durch Fotoserien
- Wiederholung bei vorübergehenden TLS-Fehlern
Discord
/thread-Befehl mitauto_thread-Konfiguration- Automatische Thread-Erstellung bei @Erwähnung
Slack
- Vollständige Überarbeitung der Thread-Behandlung
- Korrektur der maximalen Nachrichtenlänge (3900 → 39000)
- IMAP-UID-Verfolgung und SMTP-TLS-Verifikation
skip_attachments-Option via config.yaml
Neue Skills
| Skill | Beschreibung |
|---|---|
| Linear | Projektmanagement-Integration |
| X/Twitter | Social Media via x-cli |
| Telephony | Twilio SMS und KI-Anrufe |
| 1Password | Passwortverwaltung (von @arceus77-7) |
| NeuroSkill BCI | Brain-Computer-Interface-Integration |
| Blender MCP | 3D-Modellierung |
| OSS Security Forensics | Sicherheitsanalyse-Toolkit |
| Parallel CLI | Recherche-Skill |
| OpenCode | CLI-Skill |
| ASCII Video | Überarbeitet (von @SHL0MS) |
MCP-Verbesserungen
- Selektives Werkzeugladen — filtern, welche MCP-Werkzeuge verfügbar sind
- Auto-Reload — MCP-Werkzeuge werden bei Konfigurationsänderungen neu geladen
- npx-Verbindungsfixes — Stdio-Verbindungsfehler behoben
Cron-System
- Einziges
cronjob-Werkzeug ersetzt mehrere Befehle - Jobs werden in SQLite persistiert — überleben Neustarts
- Laufzeit-Overrides pro Job (Provider, Modell, base_url)
Sicherheit
- Tirith Pre-Exec-Scanning — statische Analyse von Befehlen vor der Ausführung
- Provider-Umgebungsvariablen-Stripping — alle Provider-/Gateway-Env-Vars aus Subprozessen entfernt
- Explizite Docker-cwd-Freigabe — Host-Verzeichniseinbindungen jetzt explizit, nie automatisch
Wichtige Bugfixes
| Problem | Behebung |
|---|---|
/status zeigte 0 Tokens |
Zeigt jetzt Live-Status und Token-Zähler |
| Benutzerdefinierte Modell-Endpoints defekt | Wiederhergestellte Endpoint-Auflösung |
| MCP-Werkzeuge bis Neustart unsichtbar | Auto-Reload bei Konfigurationsänderung |
Terminal-Subprozesse erben OPENAI_BASE_URL |
Env-Vars aus allen Subprozessen entfernt |
| Gateway-Leistungsverschlechterung | Log-Handler-Akkumulation behoben |
| Cron-Jobs nicht persistent | Jetzt in SQLite gespeichert |
| Setup hängt bei Headless-SSH | Vollständiger Headless-Ablauf |
| Modellwechsel ohne Wirkung | Provider-Auflösung beim Wechsel behoben |
Was die Community sagte
“Hermes ist kein an eine IDE gebundener Coding-Copilot. Es ist kein Chatbot-Wrapper um eine einzelne API. Es ist ein persistenter, plattformübergreifender, multi-modellfähiger autonomer Agent, der mit seinem Einsatz wächst.” — ZHC Institute, Field Notes zu v0.3.0
Breaking Changes
- Provider-Konfigurationsformat aktualisiert — benutzerdefinierte Provider-Konfigs aus v0.2.0 müssen möglicherweise umstrukturiert werden
- Legacy-OpenClaw-Konfigs müssen den Migrationsablauf durchlaufen (
hermes claw migrate)
Upgrade
hermes update
Migration von OpenClaw:
hermes claw migrate
Für Neuinstallationen besuche die Installationsanleitung.
Vollständiger Changelog auf GitHub
← Hermes Agent Changelog