v0.3.0

Hermes Agent v0.3.0 — Streaming, Plugins & Multi-Provider


Übersicht

v0.3.0 — Streaming, Plugins & Multi-Provider. Veröffentlicht am 17. März 2026, nur 5 Tage nach der ersten öffentlichen Version v0.2.0. Diese Version verwandelte Hermes Agent von einem vielversprechenden Open-Source-Agenten in eine produktionsreife Plattform für autonome Abläufe.

Wenn v0.2.0 der Welt zeigte, was Hermes kann, dann machte v0.3.0 daraus ein poliertes Produkt. Die tokenweise Streaming-Ausgabe beseitigte das Problem des „auf einen leeren Bildschirm starren“. Die Plugin-Architektur öffnete die Tür für Community-Beiträge ohne den Kerncode anzufassen. Und der Neuaufbau des Provider-Systems bedeutete, dass man mit einem einzigen Befehl zwischen OpenAI, Anthropic, den über 200 Modellen von OpenRouter oder einem beliebigen benutzerdefinierten Endpoint wechseln konnte.

Die Community-Reaktion war unmittelbar und massiv: Als diese Version veröffentlicht wurde, nannte die Zero-Human-Companies-Community Hermes Agent bereits „das Betriebssystem für autonome Abläufe“.

Kennzahlen: ~50+ Bugfixes · 14 Hauptfunktionen · 10+ neue Skills · 4 Messaging-Plattform-Überholungen


Hauptfunktionen

1. Einheitliche Streaming-Infrastruktur

Die sichtbarste Änderung in v0.3.0: Antworten werden jetzt Token für Token in der CLI und auf allen Gateway-Plattformen gestreamt.

Was sich ändert:

  • Jeder Provider streamt jetzt über eine einheitliche Infrastruktur
  • CLI, Telegram, Discord, Slack und alle Gateway-Plattformen erhalten Tokens, sobald sie generiert werden
  • Langlaufende Werkzeugaufrufe zeigen den Fortschritt in Echtzeit
# Streaming ist jetzt Standard — keine Konfiguration nötig
hermes
> Schreibe ein Python-Skript, das eine 10GB-Logdatei verarbeitet

# Tokens werden beim Generieren gestreamt. Du kannst:
# - In Echtzeit sehen, was der Agent denkt
# - Mit Ctrl+C unterbrechen, wenn er in die falsche Richtung geht
# - Mittendrin umlenken: "verwende stattdessen Rust"

2. Erstklassige Plugin-Architektur

Das Plugin-System war der Schlüssel zum Community-Wachstum. Lege Python-Dateien in ~/.hermes/plugins/ ab und Hermes erkennt sie automatisch — benutzerdefinierte Werkzeuge, Slash-Befehle, Lifecycle-Hooks, alles ohne das Repository zu forken.

# ~/.hermes/plugins/mein_plugin.py
from hermes.plugin import Plugin, tool

class MeinPlugin(Plugin):
    """Ein Plugin, das ein benutzerdefiniertes Wetter-Werkzeug hinzufügt."""

    @tool
    def wetter_abrufen(self, stadt: str) -> dict:
        """Aktuelles Wetter für eine Stadt abrufen."""
        import requests
        resp = requests.get(f"https://api.wetter.beispiel/{stadt}")
        return resp.json()

    @tool
    def stimmung_analysieren(self, text: str) -> dict:
        """Stimmung eines Textes analysieren."""
        return {"stimmung": "positiv", "wertung": 0.85}

Plugin-Lifecycle-Hooks:

  • on_load — wird beim ersten Laden des Plugins ausgeführt
  • on_unload — Bereinigung vor dem Entfernen
  • on_tool_call — jeden Werkzeugaufruf abfangen und modifizieren
  • on_response — Agent-Antworten nachbearbeiten

3. Nativer Anthropic-Provider

Vor v0.3.0 bedeutete die Nutzung von Claude-Modellen das Routing über OpenRouter. Der native Anthropic-Provider änderte alles.

Was er ermöglicht:

  • Direkte Anthropic-API-Aufrufe — geringere Latenz, kein OpenRouter-Zwischenhändler
  • Automatische Claude-Code-Anmeldeerkennung — wenn du Claude Code verwendet hast, findet Hermes deine Anmeldedaten automatisch
  • OAuth PKCE-Flows — sichere, standardkonforme Authentifizierung mit Token-Erneuerung
  • Natives Prompt-Caching — Anthropics Prompt-Caching reduziert Kosten für lange Gespräche um bis zu 90 %
# Setup mit Anthropic-Provider ausführen
hermes setup --provider anthropic

# Oder mitten in der Sitzung wechseln
/hermes model claude-sonnet-4-20250514

# Hermes erkennt Claude-Code-Anmeldedaten automatisch, falls verfügbar
# hermes.config.yaml
providers:
  - name: anthropic
    provider: anthropic
    model: claude-sonnet-4-20250514
    prompt_caching: true

4. Intelligente Freigaben + /stop-Befehl

Inspiriert von Codex’ Ansatz zur Befehlssicherheit lernt das intelligente Freigabesystem, welche Befehle sicher sind, und merkt sich deine Einstellungen.

> Ausführen: pip install pandas numpy scikit-learn
# Erstes Mal: "Diesen pip install-Befehl genehmigen? [j/n/immer]"
# Wähle 'i' (immer) → nie wieder für pip install gefragt

> Ausführen: rm -rf /tmp/build-cache
# "Diese Löschung genehmigen?" — andere Kategorie, fragt erneut

Der /stop-Befehl ist deine Notbremse:

# Agent geht in die falsche Richtung — sofort anhalten
/stop

5. Sprachmodus

Der Sprachmodus kam in v0.3.0 auf drei Oberflächen:

CLI: Push-to-Talk

# Leertaste gedrückt halten zum Sprechen, loslassen zum Senden
hermes --voice

# Oder Sprachmodus mitten in der Sitzung umschalten
/voice

Messaging-Plattformen: Sprachnotizen

  • Sende Sprachnotizen auf Telegram oder Discord — Hermes transkribiert und antwortet
  • Transkriptionen verwenden faster-whisper für kostenlose lokale Verarbeitung

Discord-Sprachkanäle

  • Hermes kann Discord-Sprachkanälen beitreten
  • Hört auf Erwähnungen und antwortet verbal
# hermes.config.yaml — Sprachkonfiguration
voice:
  stt:
    enabled: true
    engine: faster-whisper  # lokal, kostenlos, kein API-Key nötig
  tts:
    enabled: true
    engine: openai

6. Parallele Werkzeugausführung

Mehrere unabhängige Werkzeugaufrufe werden jetzt parallel über ThreadPoolExecutor ausgeführt.

Vor v0.3.0: Sequenzielle Ausführung — ~9 Sekunden für 3 Suchanfragen Nach v0.3.0: Parallele Ausführung — ~3 Sekunden für 3 Suchanfragen

7. Honcho-Speicherintegration

Honcho (von @erosika) brachte dialektische Benutzermodellierung zu Hermes — der Agent baut im Laufe der Zeit ein Theory-of-Mind-Modell von dir auf.

# hermes.config.yaml
memory:
  honcho:
    enabled: true
    recall_mode: recent  # recent | relevant | all
    max_memories_per_turn: 5

8. PII-Anonymisierung

Wenn privacy.redact_pii aktiviert ist, werden personenbezogene Daten automatisch entfernt, bevor der Kontext an LLM-Provider gesendet wird.

privacy:
  redact_pii: true

Die Anonymisierung erfolgt lokal, bevor Daten deinen Rechner verlassen.

9. /browser connect via CDP

Verbinde Browser-Werkzeuge mit einer laufenden Chrome-Instanz über das Chrome DevTools Protocol.

# Chrome mit Remote-Debugging starten
chrome --remote-debugging-port=9222

# In Hermes verbinden
/browser connect --port 9222

10. Vercel AI Gateway Provider

Leite Hermes durch Vercels AI Gateway für Zugriff auf deren Modellkatalog und Infrastruktur.

providers:
  - name: vercel
    provider: vercel-ai-gateway
    api_key: ${VERCEL_AI_GATEWAY_KEY}

11. Zentralisierter Provider-Router

Das Provider-System wurde komplett um eine einzige call_llm-API herum neu aufgebaut.

# Nahtlos zwischen Modellen wechseln
/hermes model gpt-5          # → OpenAI
/hermes model claude-sonnet-4 # → Anthropic (automatisch erkannt)
/hermes model grok-3          # → xAI

# Präfix-Abgleich funktioniert ebenfalls
/mod gpt-5    # wird zu /model gpt-5 aufgelöst

12. ACP-Server — IDE-Integration

VS Code, Zed und JetBrains können sich jetzt über das Agent Communication Protocol mit Hermes als Agent-Backend verbinden.

# Hermes im ACP-Servermodus starten
hermes serve --acp

13. Persistenter Shell-Modus

Von @alt-glitch. Lokale und SSH-Terminal-Backends behalten den Shell-Zustand über Werkzeugaufrufe hinweg bei.

> cd /mein-projekt
> ls
# (gleiche Shell, Zustand bleibt erhalten)
# Zeigt den Inhalt von /mein-projekt ✓
> export DATABASE_URL=postgres://localhost/mydb
> python manage.py migrate
# DATABASE_URL ist gesetzt ✓

14. Agentic On-Policy Distillation (OPD)

Neue RL-Trainingsumgebung zur Destillation von Agentenrichtlinien, die das Atropos-Trainingsökosystem erweitert.


CLI- & UX-Verbesserungen

Funktion Beschreibung
Persistente Statusleiste Modell, Provider und Token-Zähler stets sichtbar
Dateipfad-Autovervollständigung Tab-Vervollständigung für Dateipfade im Prompt
/plan-Befehl Implementierungspläne aus Spezifikationen generieren
Präfix-Abgleich /mod/model, /sta/status
Skill-Vorabladen Skills werden beim Start geladen, bereit vor dem ersten Prompt

Setup & Konfiguration

  • OpenClaw-Migration — nahtlose Migration von OpenClaw bei der Ersteinrichtung
  • Headless-Setup — vollständiger Einrichtungsablauf funktioniert auf reinen SSH-Servern
  • .env-Neuladen — Umgebungsänderungen werden ohne Neustart erkannt

Plattform-Updates

Gateway-Kern

Funktion Auswirkung
Systemdienst-Modus Als systemd-Systemdienst ausführen
Reasoning Hot Reload Reasoning-Einstellungen ohne Neustart ändern
Benutzer-Sitzungsisolation Gruppenchats teilen keinen Zustand mehr zwischen Benutzern
SSL-Autoerkennung Funktioniert auf NixOS und nicht-standardisierten Systemen

Telegram

  • Medienpufferung verhindert Unterbrechungen durch Fotoserien
  • Wiederholung bei vorübergehenden TLS-Fehlern

Discord

  • /thread-Befehl mit auto_thread-Konfiguration
  • Automatische Thread-Erstellung bei @Erwähnung

Slack

  • Vollständige Überarbeitung der Thread-Behandlung
  • Korrektur der maximalen Nachrichtenlänge (3900 → 39000)

E-Mail

  • IMAP-UID-Verfolgung und SMTP-TLS-Verifikation
  • skip_attachments-Option via config.yaml

Neue Skills

Skill Beschreibung
Linear Projektmanagement-Integration
X/Twitter Social Media via x-cli
Telephony Twilio SMS und KI-Anrufe
1Password Passwortverwaltung (von @arceus77-7)
NeuroSkill BCI Brain-Computer-Interface-Integration
Blender MCP 3D-Modellierung
OSS Security Forensics Sicherheitsanalyse-Toolkit
Parallel CLI Recherche-Skill
OpenCode CLI-Skill
ASCII Video Überarbeitet (von @SHL0MS)

MCP-Verbesserungen

  • Selektives Werkzeugladen — filtern, welche MCP-Werkzeuge verfügbar sind
  • Auto-Reload — MCP-Werkzeuge werden bei Konfigurationsänderungen neu geladen
  • npx-Verbindungsfixes — Stdio-Verbindungsfehler behoben

Cron-System

  • Einziges cronjob-Werkzeug ersetzt mehrere Befehle
  • Jobs werden in SQLite persistiert — überleben Neustarts
  • Laufzeit-Overrides pro Job (Provider, Modell, base_url)

Sicherheit

  • Tirith Pre-Exec-Scanning — statische Analyse von Befehlen vor der Ausführung
  • Provider-Umgebungsvariablen-Stripping — alle Provider-/Gateway-Env-Vars aus Subprozessen entfernt
  • Explizite Docker-cwd-Freigabe — Host-Verzeichniseinbindungen jetzt explizit, nie automatisch

Wichtige Bugfixes

Problem Behebung
/status zeigte 0 Tokens Zeigt jetzt Live-Status und Token-Zähler
Benutzerdefinierte Modell-Endpoints defekt Wiederhergestellte Endpoint-Auflösung
MCP-Werkzeuge bis Neustart unsichtbar Auto-Reload bei Konfigurationsänderung
Terminal-Subprozesse erben OPENAI_BASE_URL Env-Vars aus allen Subprozessen entfernt
Gateway-Leistungsverschlechterung Log-Handler-Akkumulation behoben
Cron-Jobs nicht persistent Jetzt in SQLite gespeichert
Setup hängt bei Headless-SSH Vollständiger Headless-Ablauf
Modellwechsel ohne Wirkung Provider-Auflösung beim Wechsel behoben

Was die Community sagte

“Hermes ist kein an eine IDE gebundener Coding-Copilot. Es ist kein Chatbot-Wrapper um eine einzelne API. Es ist ein persistenter, plattformübergreifender, multi-modellfähiger autonomer Agent, der mit seinem Einsatz wächst.” — ZHC Institute, Field Notes zu v0.3.0


Breaking Changes

  • Provider-Konfigurationsformat aktualisiert — benutzerdefinierte Provider-Konfigs aus v0.2.0 müssen möglicherweise umstrukturiert werden
  • Legacy-OpenClaw-Konfigs müssen den Migrationsablauf durchlaufen (hermes claw migrate)

Upgrade

hermes update

Migration von OpenClaw:

hermes claw migrate

Für Neuinstallationen besuche die Installationsanleitung.


Vollständiger Changelog auf GitHub

← Hermes Agent Changelog