Hermes Agent v0.2.0 — Die erste öffentliche Version
Überblick
v0.2.0 — Die erste öffentliche Version. 12. März 2026. 216 zusammengeführte Pull Requests · 63 Mitwirkende · 119 gelöste Issues · von nahezu null Tests auf 3.289.
Dies ist der Moment, in dem Hermes Agent der Welt vorgestellt wurde. In etwas mehr als zwei Wochen nach dem internen v0.1.0-Fundament explodierte das Projekt von einem kleinen Forschungsprototypen zu einer voll ausgestatteten, community-getriebenen KI-Agentenplattform. Was dieses Release so bemerkenswert macht, ist nicht nur die Feature-Liste — es ist die Geschwindigkeit. 63 Personen aus der Open-Source-Community steuerten Code, Tests, Dokumentation und Sicherheitsfixes bei und formten die Architektur des Projekts von Tag eins an.
v0.2.0 etabliert die Kern-DNA, die Hermes für alle nachfolgenden Releases prägen sollte: Skills, die sich selbst verbessern, ein Messaging-Gateway, das Nutzer überall erreicht, MCP für Tool-Erweiterbarkeit und ein kompromissloser Fokus auf Sicherheit von Anfang an.
Wichtigste Features
1. Multi-Plattform-Messaging-Gateway
Hermes ist nicht nur ein CLI-Tool — es lebt dort, wo du lebst. Das Gateway-System bringt das volle Agenten-Erlebnis auf sieben Messaging-Plattformen, mit einheitlicher Sitzungsverwaltung, Medienanhängen und plattformspezifischer Tool-Konfiguration.
| Plattform | Kernfähigkeiten |
|---|---|
| Telegram | Dateianhänge, Dokumentverarbeitung (PDF/Office), Forum-Theme-Isolation, Browser-Screenshots, Standortfreigabe |
| Discord | Kanalthemen-Kontext, Dokument-/Video-Unterstützung, Bot-Nachrichtenfilterung |
| Slack | App-Erwähnungsbehandlung, Dokument-/Video-Freigabe, strukturiertes Logging |
| Natives Medienversenden (Bilder/Video/Dokumente), Multi-User-Sitzungsisolation, plattformübergreifende Port-Behandlung | |
| Signal | Vollständiges Gateway via signal-cli-rest-api, Medien-URL-Unterstützung |
| E-Mail (IMAP/SMTP) | Vollständiges E-Mail-Gateway — Senden und Empfangen über jeden E-Mail-Anbieter |
| Home Assistant | REST-Tools + WebSocket-Integration, Service-Discovery |
Der Gateway-Kern führte zudem plattformübergreifende Features ein: Sichtbarkeit von Subagent-Toolaufrufen, konfigurierbare Benachrichtigungen für Hintergrundprozesse, edit_message() mit Plattform-Fallbacks sowie Slash-Befehle wie /compress, /usage und /update.
2. MCP (Model Context Protocol) Client
Native MCP-Unterstützung war eine der frühesten Architekturentscheidungen bei Hermes — und eine weitsichtige. Bevor MCP zum Industriestandard wurde, der es heute ist, hatte Hermes bereits einen produktionsreifen Client.
# MCP-Server werden in config.yaml konfiguriert
# Hermes entdeckt Tools, Ressourcen und Prompts automatisch
hermes tools # MCP-Tools in der Curses-UI durchsuchen und aktivieren
/reload-mcp # MCP-Server ohne Neustart neu laden
Kernfähigkeiten:
- stdio- und HTTP-Transports — Verbindung zu lokalen und entfernten MCP-Servern
- Sampling-Unterstützung — MCP-Server können LLM-Anfragen über Hermes initiieren
- Ressourcen- und Prompt-Discovery — Serverfähigkeiten automatisch anzeigen
- Automatische Wiederverbindung — Wiederherstellung nach Serverabstürzen ohne Zustandsverlust
- Sicherheitshärtung — Tools von MCP-Servern unterliegen denselben Genehmigungsrichtlinien
3. Skills-Ökosystem — 70+ Skills, selbstverbessernder Agent
Das Skills-System — Hermes’ charakteristisches Alleinstellungsmerkmal — war bereits zum Launch umfassend. 70+ gebündelte und optionale Skills in über 15 Kategorien, mit einem Skills Hub für die Community-Entdeckung.
Wie Skills funktionieren:
Skills sind Markdown-Dokumente, die in ~/.hermes/skills/ gespeichert werden. Wenn Hermes auf eine relevante Aufgabe stößt, lädt es den passenden Skill als prozedurale Anleitung in den Kontext. Nach Abschluss einer Aufgabe bewertet ein Hintergrund-„Review Fork“, ob der Skill geholfen hat — und schreibt oder aktualisiert Skills automatisch.
# Den Skills Hub durchsuchen
hermes skills browse
# Skills können pro Plattform aktiviert/deaktiviert werden
# Bedingte Aktivierung basierend auf Tool-Verfügbarkeit
# Voraussetzungen stellen sicher, dass Skills mit nicht erfüllten Abhängigkeiten verborgen bleiben
Neue Skills in v0.2.0:
- ASCII Art — pyfiglet (571 Schriftarten), cowsay, Bild-zu-ASCII
- ASCII Video — Vollständige Produktions-Pipeline für Terminal-Video
- DuckDuckGo Search — Datenschutzorientierte Websuche mit Firecrawl-Fallback
- Solana Blockchain — Wallet-Guthaben, USD-Preise, Token-Namen
- AgentMail — Agent-eigene E-Mail-Postfächer
- Polymarket — Prognosemarktdaten (schreibgeschützt)
- OpenClaw Migration — Offizielles Migrationstool von OpenClaw zu Hermes
- Domain Intelligence — Passive Aufklärung: Subdomains, SSL, WHOIS, DNS
- Superpowers — Softwareentwicklungs-Skills
- Hermes-Atropos — RL-Umgebungsentwicklung
- Plus: arXiv-Suche, OCR/Dokumente, Excalidraw-Diagramme, YouTube-Transkripte, GIF-Suche und 40+ MLOps-Skills
(#743 — @teyrebaz33, #785 — @teyrebaz33)
4. Zentraler Provider-Router
Vor v0.2.0 war die Provider-Logik über Vision, Summarization, Compression und Trajectory Saving verstreut — jeder rief LLMs über seinen eigenen Codepfad auf. Der zentrale Provider-Router vereinheitlicht all dies hinter einer einzigen call_llm() / async_call_llm() API.
# Alle Nebenverbraucher laufen jetzt über einen Codepfad:
# resolve_provider_client() → call_llm()
# Automatische Auflösung von Anmeldedaten, Fehlerbehandlung und Wiederholungslogik
Unterstützte Provider beim Launch:
- Nous Portal — native OAuth-Integration
- OpenAI Codex — Responses API mit ChatGPT-Abonnement-Unterstützung
- OpenRouter — 200+ Modelle mit Routing-Präferenzen
- Kimi Code API — Moonshots code-spezialisiertes Modell
- MiniMax — aktualisierte Modell-IDs
- z.ai/GLM — Tsinghuas zweisprachiges Modell
- Azure OpenAI — Enterprise-Deployment-Unterstützung
- Self-hosted Firecrawl — Web Scraping auf eigener Infrastruktur
(#1003)
5. ACP-Server — Editor-Integration
VS Code, Zed und JetBrains-Editoren können sich jetzt über den Agent Communication Protocol (ACP)-Standard mit Hermes verbinden. Das bedeutet, dass derselbe Agent, der in deinem Terminal und deinen Messaging-Apps läuft, direkt in deinem Editor assistieren kann.
(#949)
6. CLI-Skin/Theme-Engine
Ein datengesteuertes visuelles Anpassungssystem mit 7 integrierten Skins (default, ares, mono, slate, poseidon, sisyphus, charizard) sowie Unterstützung für benutzerdefinierte YAML-Skins. Banner, Spinner, Farben und Branding sind alle konfigurierbar — keine Code-Änderungen erforderlich.
# ~/.hermes/skins/my-skin.yaml
banner: "custom"
spinner: "dots"
colors:
accent: "#00E5A0"
background: "#0A0A0F"
7. Git-Worktree-Isolation
hermes -w startet isolierte Agent-Sitzungen in Git-Worktrees und ermöglicht sicheres paralleles Arbeiten am selben Repository. Jedes Worktree erhält sein eigenes Arbeitsverzeichnis, seinen eigenen Branch und seine eigene Agent-Sitzung — kein gegenseitiges Stören mehr beim Ausführen mehrerer Agents.
# Hermes in einem Git-Worktree für isoliertes paralleles Arbeiten starten
hermes -w
(#654)
8. Dateisystem-Checkpoints & Rollback
Automatische Snapshots werden vor destruktiven Dateioperationen erstellt. Der /rollback-Befehl stellt Dateien in ihren vorherigen Zustand wieder her — ein Sicherheitsnetz, mit dem du ohne Angst experimentieren kannst.
# Agent erstellt automatisch Snapshots vor destruktiven Operationen
# /rollback in der CLI zum Wiederherstellen
# Funktioniert mit allen Terminal-Backends (lokal, Docker, SSH, Modal)
(#824)
Kernagent & Architektur
Verbesserungen der Agent-Schleife
Die Agent-Schleife wurde erheblich gehärtet, um reale Grenzfälle zu bewältigen:
- Einfaches Fallback-Modell — wenn der primäre Provider ausfällt, wechselt Hermes transparent zu einer konfigurierten Alternative (#740)
- Gemeinsame Iterationsbudgets — Eltern-Agent und Subagent-Delegation teilen sich ein gemeinsames Budget, wodurch unkontrollierte Subagent-Schleifen verhindert werden
- 413-Payload-zu-groß-Behandlung — anstatt abzubrechen, komprimiert Hermes den Kontext und versucht es erneut (#153)
- Toolaufruf-Reparatur-Middleware — Auto-Kleinschreibung und Handler für ungültige Tools korrigieren fehlerhafte Toolaufrufe des Modells
- Reasoning-Effort-Konfiguration — steuere, wie viel das Modell vor dem Handeln nachdenkt (
/reasoning-Befehl) - Schleifenerkennung nach Komprimierung — verhindert, dass der Agent nach der Kontextkomprimierung Dateien erneut liest/durchsucht (#705)
Sitzung & Speicher
- Benannte Sitzungen — gib Sitzungen eindeutige Titel, durchsuche mit Filterung, setze nach Namen fort (#720)
- Honcho-Benutzermodellierung — KI-natives sitzungsübergreifendes Benutzerprofil, das sich mit der Zeit verbessert (#38)
- Proaktiver Memory Flush — asynchrone Speicherpersistenz bei Sitzungsablauf
- Intelligente Kontextlängenerkennung — Modellkontextgrenzen mit persistentem Caching erkennen
CLI & Benutzererfahrung
Interaktive CLI
Das Terminal-Erlebnis erhielt eine umfassende Überarbeitung:
/personality-Befehl — benutzerdefinierte Agent-Persönlichkeit oder komplett deaktivieren (#773)- Benutzerdefinierte Quick Commands — die Agent-Schleife für schnelle, vordefinierte Aktionen umgehen (#746)
/verbose— Debug-Ausgabe zur Laufzeit umschalten (#94)/insights— Nutzungsanalysen, Kostenschätzung und Aktivitätsmuster (#552)/background— Hintergrundprozesse von der CLI aus verwalten- Signalton bei Abschluss — Terminal-Glocke, wenn der Agent eine Aufgabe beendet (#738)
- Pfeiltasten-Verlauf — durch vorherige Befehle navigieren
- Clipboard-Bildeinfügung — Alt+V / Strg+V zum Einfügen von Bildern
--quiet/-Q— programmatischer Einzelabfrage-Modus mit minimaler Ausgabe--fuck-it-ship-it— alle Genehmigungsaufforderungen für vollautomatisierte Workflows umgehen (#724)
Einrichtung & Konfiguration
- Modularer Einrichtungsassistent mit Abschnitts-Unterbefehlen und Tool-zentrierter UX
- Konfigurations-Migrationssystem — nahtloses Upgrade über Konfigurationsformatversionen hinweg (v7 beim Launch)
hermes tools— plattformspezifisches Tool-Aktivieren/Deaktivieren mit Curses-UIhermes doctor— Gesundheitsprüfungen für alle konfigurierten Providerhermes update— mit automatischem Neustart des Gateway-Dienstes- Atomare Schreibvorgänge für .env — Verhinderung von API-Key-Verlust bei Absturz (#954)
Sicherheit
Hermes Agent nahm Sicherheit von Anfang an ernst. v0.2.0 wurde mit einer umfassenden Sicherheitshärtung ausgeliefert:
Schwachstellenprävention
| Kategorie | Beschreibung |
|---|---|
| Path Traversal | In skill_view behoben — verhinderte das Lesen beliebiger Dateien (#220) |
| Shell Injection | Prävention bei sudo-Passwort-Piping (#65), tee/Prozesssubstitutionsmuster (#280) |
| Symlink-Angriffe | Grenzwertprüfungs-Korrekturen in skills_guard (#386), macOS-Schreib-Verbotslisten-Umgehung (#61) |
| Prompt Injection | Prävention von Mehrwort-Umgehungen (#192), Cron-Scanner-Umgehungs-Fix (#63) |
| Gefährliche Befehle | Erkennung von mehrzeiligen Umgehungen (#233), --force-Flag korrekt blockiert (#388) |
Datenschutz
- Atomare Schreibvorgänge für Sitzungen, Cron-Jobs, .env-Konfiguration, Prozess-Checkpoints, Batch-Runner und Skill-Dateien — Verhinderung von Datenverlust bei Absturz
- Dateiberechtigungserzwingung — 0600/0700 für sensible Dateien, .env auf Besitzer beschränkt
- FTS5-Abfragebereinigung — verhindert SQL-Injection durch Volltextsuchabfragen
- Secret-Redaction — erweiterbare Muster zum Entfernen von Secrets aus Logs und Transkripten
- Permanente In-Memory-Allowlist — verhindert, dass sensible Daten auf die Festplatte gelangen (#600)
Tests — Von null auf 3.289
Als die v0.2.0-Entwicklung begann, hatte das Projekt nahezu null Testabdeckung. Die Community reagierte mit einem massiven Testaufwand:
- 3.289 Tests über Agent-, Gateway-, Tool-, Cron- und CLI-Module hinweg
- Parallelisierte Testsuite mit pytest-xdist (#802)
- Vier Batches von Unit-Tests für Kernmodule, sicherheitskritische Pfade und die AIAgent-Schleife
- 43 Telegram-Format-Tests für Genauigkeit der Kursiv-/Fett-/Code-Darstellung
- 42 Vision-Tools-Tests mit vollständigen Typannotationen
- Compressor-Regressionstests für Toolaufruf-Grenzfallbehandlung
Dieses Testfundament sollte sich als entscheidend erweisen, als das Projekt seine schnelle Iteration fortsetzte — mit 3.289 Tests, die Regressionen abfingen, bevor sie die Benutzer erreichten.
RL & Evaluierungsumgebungen
Hermes Agent war von Anfang an als Plattform zur Generierung agentischer Trainingsdaten konzipiert. v0.2.0 wurde ausgeliefert mit:
- WebResearchEnv — mehrschrittige Web-Recherche-RL-Umgebung (#434)
- YC-Bench — Langzeithorizont-Agenten-Benchmark-Umgebung
- OpenThoughts-TBLite — Evaluierungsumgebung und Skripte
- Lokale vLLM-Unterstützung — Evaluierungen gegen lokal gehostete Modelle ausführen
- Hermes-Atropos — gebündelter Skill für RL-Umgebungsentwicklung (#815)
Windows-Kompatibilität
Windows-Unterstützung war von Anfang an ein erstklassiges Anliegen:
- POSIX-spezifische Prozessfunktionen für Windows-Kompatibilität abgesichert
- Native Unterstützung via Git Bash + ZIP-basierter Update-Fallback
pywinptyfür PTY-Unterstützung unter Windows (#457)- Explizite UTF-8-Kodierung bei allen Konfigurations-/Daten-Datei-I/O (#458)
- Laufwerksbuchstaben-Pfadbehandlung für regex-basierte Suchausgabe (#533)
Upgrade
hermes update
Für Neuinstallationen:
# Linux / macOS / WSL2
curl -fsSL https://raw.githubusercontent.com/NousResearch/hermes-agent/main/scripts/install.sh | bash
Vollständiger Changelog auf GitHub
← Hermes Agent Changelog