v0.2.0

Hermes Agent v0.2.0 — Die erste öffentliche Version


Überblick

v0.2.0 — Die erste öffentliche Version. 12. März 2026. 216 zusammengeführte Pull Requests · 63 Mitwirkende · 119 gelöste Issues · von nahezu null Tests auf 3.289.

Dies ist der Moment, in dem Hermes Agent der Welt vorgestellt wurde. In etwas mehr als zwei Wochen nach dem internen v0.1.0-Fundament explodierte das Projekt von einem kleinen Forschungsprototypen zu einer voll ausgestatteten, community-getriebenen KI-Agentenplattform. Was dieses Release so bemerkenswert macht, ist nicht nur die Feature-Liste — es ist die Geschwindigkeit. 63 Personen aus der Open-Source-Community steuerten Code, Tests, Dokumentation und Sicherheitsfixes bei und formten die Architektur des Projekts von Tag eins an.

v0.2.0 etabliert die Kern-DNA, die Hermes für alle nachfolgenden Releases prägen sollte: Skills, die sich selbst verbessern, ein Messaging-Gateway, das Nutzer überall erreicht, MCP für Tool-Erweiterbarkeit und ein kompromissloser Fokus auf Sicherheit von Anfang an.


Wichtigste Features

1. Multi-Plattform-Messaging-Gateway

Hermes ist nicht nur ein CLI-Tool — es lebt dort, wo du lebst. Das Gateway-System bringt das volle Agenten-Erlebnis auf sieben Messaging-Plattformen, mit einheitlicher Sitzungsverwaltung, Medienanhängen und plattformspezifischer Tool-Konfiguration.

Plattform Kernfähigkeiten
Telegram Dateianhänge, Dokumentverarbeitung (PDF/Office), Forum-Theme-Isolation, Browser-Screenshots, Standortfreigabe
Discord Kanalthemen-Kontext, Dokument-/Video-Unterstützung, Bot-Nachrichtenfilterung
Slack App-Erwähnungsbehandlung, Dokument-/Video-Freigabe, strukturiertes Logging
WhatsApp Natives Medienversenden (Bilder/Video/Dokumente), Multi-User-Sitzungsisolation, plattformübergreifende Port-Behandlung
Signal Vollständiges Gateway via signal-cli-rest-api, Medien-URL-Unterstützung
E-Mail (IMAP/SMTP) Vollständiges E-Mail-Gateway — Senden und Empfangen über jeden E-Mail-Anbieter
Home Assistant REST-Tools + WebSocket-Integration, Service-Discovery

Der Gateway-Kern führte zudem plattformübergreifende Features ein: Sichtbarkeit von Subagent-Toolaufrufen, konfigurierbare Benachrichtigungen für Hintergrundprozesse, edit_message() mit Plattform-Fallbacks sowie Slash-Befehle wie /compress, /usage und /update.

2. MCP (Model Context Protocol) Client

Native MCP-Unterstützung war eine der frühesten Architekturentscheidungen bei Hermes — und eine weitsichtige. Bevor MCP zum Industriestandard wurde, der es heute ist, hatte Hermes bereits einen produktionsreifen Client.

# MCP-Server werden in config.yaml konfiguriert
# Hermes entdeckt Tools, Ressourcen und Prompts automatisch
hermes tools  # MCP-Tools in der Curses-UI durchsuchen und aktivieren
/reload-mcp   # MCP-Server ohne Neustart neu laden

Kernfähigkeiten:

  • stdio- und HTTP-Transports — Verbindung zu lokalen und entfernten MCP-Servern
  • Sampling-Unterstützung — MCP-Server können LLM-Anfragen über Hermes initiieren
  • Ressourcen- und Prompt-Discovery — Serverfähigkeiten automatisch anzeigen
  • Automatische Wiederverbindung — Wiederherstellung nach Serverabstürzen ohne Zustandsverlust
  • Sicherheitshärtung — Tools von MCP-Servern unterliegen denselben Genehmigungsrichtlinien

(#291@0xbyt4, #301, #753)

3. Skills-Ökosystem — 70+ Skills, selbstverbessernder Agent

Das Skills-System — Hermes’ charakteristisches Alleinstellungsmerkmal — war bereits zum Launch umfassend. 70+ gebündelte und optionale Skills in über 15 Kategorien, mit einem Skills Hub für die Community-Entdeckung.

Wie Skills funktionieren: Skills sind Markdown-Dokumente, die in ~/.hermes/skills/ gespeichert werden. Wenn Hermes auf eine relevante Aufgabe stößt, lädt es den passenden Skill als prozedurale Anleitung in den Kontext. Nach Abschluss einer Aufgabe bewertet ein Hintergrund-„Review Fork“, ob der Skill geholfen hat — und schreibt oder aktualisiert Skills automatisch.

# Den Skills Hub durchsuchen
hermes skills browse

# Skills können pro Plattform aktiviert/deaktiviert werden
# Bedingte Aktivierung basierend auf Tool-Verfügbarkeit
# Voraussetzungen stellen sicher, dass Skills mit nicht erfüllten Abhängigkeiten verborgen bleiben

Neue Skills in v0.2.0:

  • ASCII Art — pyfiglet (571 Schriftarten), cowsay, Bild-zu-ASCII
  • ASCII Video — Vollständige Produktions-Pipeline für Terminal-Video
  • DuckDuckGo Search — Datenschutzorientierte Websuche mit Firecrawl-Fallback
  • Solana Blockchain — Wallet-Guthaben, USD-Preise, Token-Namen
  • AgentMail — Agent-eigene E-Mail-Postfächer
  • Polymarket — Prognosemarktdaten (schreibgeschützt)
  • OpenClaw Migration — Offizielles Migrationstool von OpenClaw zu Hermes
  • Domain Intelligence — Passive Aufklärung: Subdomains, SSL, WHOIS, DNS
  • Superpowers — Softwareentwicklungs-Skills
  • Hermes-Atropos — RL-Umgebungsentwicklung
  • Plus: arXiv-Suche, OCR/Dokumente, Excalidraw-Diagramme, YouTube-Transkripte, GIF-Suche und 40+ MLOps-Skills

(#743@teyrebaz33, #785@teyrebaz33)

4. Zentraler Provider-Router

Vor v0.2.0 war die Provider-Logik über Vision, Summarization, Compression und Trajectory Saving verstreut — jeder rief LLMs über seinen eigenen Codepfad auf. Der zentrale Provider-Router vereinheitlicht all dies hinter einer einzigen call_llm() / async_call_llm() API.

# Alle Nebenverbraucher laufen jetzt über einen Codepfad:
# resolve_provider_client() → call_llm()
# Automatische Auflösung von Anmeldedaten, Fehlerbehandlung und Wiederholungslogik

Unterstützte Provider beim Launch:

  • Nous Portal — native OAuth-Integration
  • OpenAI Codex — Responses API mit ChatGPT-Abonnement-Unterstützung
  • OpenRouter — 200+ Modelle mit Routing-Präferenzen
  • Kimi Code API — Moonshots code-spezialisiertes Modell
  • MiniMax — aktualisierte Modell-IDs
  • z.ai/GLM — Tsinghuas zweisprachiges Modell
  • Azure OpenAI — Enterprise-Deployment-Unterstützung
  • Self-hosted Firecrawl — Web Scraping auf eigener Infrastruktur

(#1003)

5. ACP-Server — Editor-Integration

VS Code, Zed und JetBrains-Editoren können sich jetzt über den Agent Communication Protocol (ACP)-Standard mit Hermes verbinden. Das bedeutet, dass derselbe Agent, der in deinem Terminal und deinen Messaging-Apps läuft, direkt in deinem Editor assistieren kann.

(#949)

6. CLI-Skin/Theme-Engine

Ein datengesteuertes visuelles Anpassungssystem mit 7 integrierten Skins (default, ares, mono, slate, poseidon, sisyphus, charizard) sowie Unterstützung für benutzerdefinierte YAML-Skins. Banner, Spinner, Farben und Branding sind alle konfigurierbar — keine Code-Änderungen erforderlich.

# ~/.hermes/skins/my-skin.yaml
banner: "custom"
spinner: "dots"
colors:
  accent: "#00E5A0"
  background: "#0A0A0F"

7. Git-Worktree-Isolation

hermes -w startet isolierte Agent-Sitzungen in Git-Worktrees und ermöglicht sicheres paralleles Arbeiten am selben Repository. Jedes Worktree erhält sein eigenes Arbeitsverzeichnis, seinen eigenen Branch und seine eigene Agent-Sitzung — kein gegenseitiges Stören mehr beim Ausführen mehrerer Agents.

# Hermes in einem Git-Worktree für isoliertes paralleles Arbeiten starten
hermes -w

(#654)

8. Dateisystem-Checkpoints & Rollback

Automatische Snapshots werden vor destruktiven Dateioperationen erstellt. Der /rollback-Befehl stellt Dateien in ihren vorherigen Zustand wieder her — ein Sicherheitsnetz, mit dem du ohne Angst experimentieren kannst.

# Agent erstellt automatisch Snapshots vor destruktiven Operationen
# /rollback in der CLI zum Wiederherstellen
# Funktioniert mit allen Terminal-Backends (lokal, Docker, SSH, Modal)

(#824)


Kernagent & Architektur

Verbesserungen der Agent-Schleife

Die Agent-Schleife wurde erheblich gehärtet, um reale Grenzfälle zu bewältigen:

  • Einfaches Fallback-Modell — wenn der primäre Provider ausfällt, wechselt Hermes transparent zu einer konfigurierten Alternative (#740)
  • Gemeinsame Iterationsbudgets — Eltern-Agent und Subagent-Delegation teilen sich ein gemeinsames Budget, wodurch unkontrollierte Subagent-Schleifen verhindert werden
  • 413-Payload-zu-groß-Behandlung — anstatt abzubrechen, komprimiert Hermes den Kontext und versucht es erneut (#153)
  • Toolaufruf-Reparatur-Middleware — Auto-Kleinschreibung und Handler für ungültige Tools korrigieren fehlerhafte Toolaufrufe des Modells
  • Reasoning-Effort-Konfiguration — steuere, wie viel das Modell vor dem Handeln nachdenkt (/reasoning-Befehl)
  • Schleifenerkennung nach Komprimierung — verhindert, dass der Agent nach der Kontextkomprimierung Dateien erneut liest/durchsucht (#705)

Sitzung & Speicher

  • Benannte Sitzungen — gib Sitzungen eindeutige Titel, durchsuche mit Filterung, setze nach Namen fort (#720)
  • Honcho-Benutzermodellierung — KI-natives sitzungsübergreifendes Benutzerprofil, das sich mit der Zeit verbessert (#38)
  • Proaktiver Memory Flush — asynchrone Speicherpersistenz bei Sitzungsablauf
  • Intelligente Kontextlängenerkennung — Modellkontextgrenzen mit persistentem Caching erkennen

CLI & Benutzererfahrung

Interaktive CLI

Das Terminal-Erlebnis erhielt eine umfassende Überarbeitung:

  • /personality-Befehl — benutzerdefinierte Agent-Persönlichkeit oder komplett deaktivieren (#773)
  • Benutzerdefinierte Quick Commands — die Agent-Schleife für schnelle, vordefinierte Aktionen umgehen (#746)
  • /verbose — Debug-Ausgabe zur Laufzeit umschalten (#94)
  • /insights — Nutzungsanalysen, Kostenschätzung und Aktivitätsmuster (#552)
  • /background — Hintergrundprozesse von der CLI aus verwalten
  • Signalton bei Abschluss — Terminal-Glocke, wenn der Agent eine Aufgabe beendet (#738)
  • Pfeiltasten-Verlauf — durch vorherige Befehle navigieren
  • Clipboard-Bildeinfügung — Alt+V / Strg+V zum Einfügen von Bildern
  • --quiet/-Q — programmatischer Einzelabfrage-Modus mit minimaler Ausgabe
  • --fuck-it-ship-it — alle Genehmigungsaufforderungen für vollautomatisierte Workflows umgehen (#724)

Einrichtung & Konfiguration

  • Modularer Einrichtungsassistent mit Abschnitts-Unterbefehlen und Tool-zentrierter UX
  • Konfigurations-Migrationssystem — nahtloses Upgrade über Konfigurationsformatversionen hinweg (v7 beim Launch)
  • hermes tools — plattformspezifisches Tool-Aktivieren/Deaktivieren mit Curses-UI
  • hermes doctor — Gesundheitsprüfungen für alle konfigurierten Provider
  • hermes update — mit automatischem Neustart des Gateway-Dienstes
  • Atomare Schreibvorgänge für .env — Verhinderung von API-Key-Verlust bei Absturz (#954)

Sicherheit

Hermes Agent nahm Sicherheit von Anfang an ernst. v0.2.0 wurde mit einer umfassenden Sicherheitshärtung ausgeliefert:

Schwachstellenprävention

Kategorie Beschreibung
Path Traversal In skill_view behoben — verhinderte das Lesen beliebiger Dateien (#220)
Shell Injection Prävention bei sudo-Passwort-Piping (#65), tee/Prozesssubstitutionsmuster (#280)
Symlink-Angriffe Grenzwertprüfungs-Korrekturen in skills_guard (#386), macOS-Schreib-Verbotslisten-Umgehung (#61)
Prompt Injection Prävention von Mehrwort-Umgehungen (#192), Cron-Scanner-Umgehungs-Fix (#63)
Gefährliche Befehle Erkennung von mehrzeiligen Umgehungen (#233), --force-Flag korrekt blockiert (#388)

Datenschutz

  • Atomare Schreibvorgänge für Sitzungen, Cron-Jobs, .env-Konfiguration, Prozess-Checkpoints, Batch-Runner und Skill-Dateien — Verhinderung von Datenverlust bei Absturz
  • Dateiberechtigungserzwingung — 0600/0700 für sensible Dateien, .env auf Besitzer beschränkt
  • FTS5-Abfragebereinigung — verhindert SQL-Injection durch Volltextsuchabfragen
  • Secret-Redaction — erweiterbare Muster zum Entfernen von Secrets aus Logs und Transkripten
  • Permanente In-Memory-Allowlist — verhindert, dass sensible Daten auf die Festplatte gelangen (#600)

Tests — Von null auf 3.289

Als die v0.2.0-Entwicklung begann, hatte das Projekt nahezu null Testabdeckung. Die Community reagierte mit einem massiven Testaufwand:

  • 3.289 Tests über Agent-, Gateway-, Tool-, Cron- und CLI-Module hinweg
  • Parallelisierte Testsuite mit pytest-xdist (#802)
  • Vier Batches von Unit-Tests für Kernmodule, sicherheitskritische Pfade und die AIAgent-Schleife
  • 43 Telegram-Format-Tests für Genauigkeit der Kursiv-/Fett-/Code-Darstellung
  • 42 Vision-Tools-Tests mit vollständigen Typannotationen
  • Compressor-Regressionstests für Toolaufruf-Grenzfallbehandlung

Dieses Testfundament sollte sich als entscheidend erweisen, als das Projekt seine schnelle Iteration fortsetzte — mit 3.289 Tests, die Regressionen abfingen, bevor sie die Benutzer erreichten.


RL & Evaluierungsumgebungen

Hermes Agent war von Anfang an als Plattform zur Generierung agentischer Trainingsdaten konzipiert. v0.2.0 wurde ausgeliefert mit:

  • WebResearchEnv — mehrschrittige Web-Recherche-RL-Umgebung (#434)
  • YC-Bench — Langzeithorizont-Agenten-Benchmark-Umgebung
  • OpenThoughts-TBLite — Evaluierungsumgebung und Skripte
  • Lokale vLLM-Unterstützung — Evaluierungen gegen lokal gehostete Modelle ausführen
  • Hermes-Atropos — gebündelter Skill für RL-Umgebungsentwicklung (#815)

Windows-Kompatibilität

Windows-Unterstützung war von Anfang an ein erstklassiges Anliegen:

  • POSIX-spezifische Prozessfunktionen für Windows-Kompatibilität abgesichert
  • Native Unterstützung via Git Bash + ZIP-basierter Update-Fallback
  • pywinpty für PTY-Unterstützung unter Windows (#457)
  • Explizite UTF-8-Kodierung bei allen Konfigurations-/Daten-Datei-I/O (#458)
  • Laufwerksbuchstaben-Pfadbehandlung für regex-basierte Suchausgabe (#533)

Upgrade

hermes update

Für Neuinstallationen:

# Linux / macOS / WSL2
curl -fsSL https://raw.githubusercontent.com/NousResearch/hermes-agent/main/scripts/install.sh | bash

Vollständiger Changelog auf GitHub

← Hermes Agent Changelog