v0.14.0

Hermes Agent v0.14.0 — The Foundation Release (Grundstein-Release)


Übersicht

v0.14.0 — The Foundation Release. Veröffentlicht am 16. Mai 2026. 808 Commits · 633 gemergte PRs · 1.393 geänderte Dateien · 165.061 Einfügungen · 545 geschlossene Issues (12 P0, 50 P1) · 215 Community-Mitwirkende.

Hermes Agent v0.14.0 dreht sich nicht um auffällige Features — es geht darum, das gesamte Erlebnis solide zu machen. Das Thema ist einfach: Hermes installiert und läuft überall, liefert das mit, was du tatsächlich willst, und lässt weg, was du nicht brauchst. pip install hermes-agent funktioniert erstmals von PyPI aus. Schwere Backends werden bei der ersten Nutzung lazy-installiert. Der Kaltstart spart ~19 Sekunden. Browser-CDP-Aufrufe sind 180x schneller. Und das Fundament für alles andere — Provider, Messaging-Plattformen, Tools, Plugins, Skills — wird grundlegend aufgewertet.

Vom Team als „The Foundation Release“ bezeichnet, beantwortet v0.14.0 die Frage: Kann ein Agent-Framework von einem „coolen Projekt“ zu etwas werden, „auf das du dich jeden Tag verlässt“?


Hauptfunktionen

1. PyPI-Installation und Entschlackungswelle

Hermes Agent ist jetzt ein echtes PyPI-Paket. Ein Befehl und du bist startklar:

pip install hermes-agent
hermes

Das Wheel enthält das Ink TUI-Bundle und den Shell-Launcher direkt — kein Klonen von Repos, keine Shell-Installer. Aktualisieren erfolgt mit pip install --upgrade hermes-agent.

Noch wichtiger: Die Basisinstallation ist drastisch leichter. Schwere Backends (Slack-, Matrix-, Feishu-, DingTalk-Adapter, Image-Gen-SDKs, Voice/TTS-Provider, Camofox, Codex App-Server) werden jetzt automatisch bei der ersten Nutzung installiert. Die [all]-Extras lassen alles weg, was von Lazy-Deps abgedeckt wird, und der Installer fällt stufenweise zurück, wenn ein Wheel nicht auf deine Plattform passt. Ein Supply-Chain-Advisory-Checker scannt jede Installation auf unsichere Versionen.

Was das in der Praxis bedeutet: Schnellere Installationen, geringerer Speicherverbrauch, weniger transitive Schwachstellen und eine drastisch niedrigere Einstiegshürde für neue Nutzer. Die Zeiten von „Ich probiere es später, die Installation ist zu schwer“ sind vorbei.

Zugehörige PRs: #24220, #24515, #25014, #25038, #25766, #21818, #26593, #26148.

2. xAI Grok via SuperGrok OAuth — 1M Kontextfenster

Wenn du für SuperGrok zahlst, kannst du Grok jetzt in Hermes nutzen, indem du dich mit deinem xAI-Konto anmeldest — kein API-Key, keine separate Abrechnung. Die Verbindung hebt grok-4.3 auf ein 1M Token Kontextfenster an, sodass du ganze Codebasen oder Forschungskorpora in einen einzigen Prompt packen kannst.

# Nach OAuth-Login einfach Grok im Modell-Selektor auswählen
hermes model  # wähle xAI > grok-4.3

Enthält korrekte Behandlung von Berechtigungsfehlern und eine SSH-zu-Tunnel-Dokumentationsseite für Fälle, in denen du per SSH auf einer entfernten Maschine bist und den OAuth-Flow abschließen musst.

Zugehörige PRs: #26534, #26664, #26644, #26592.

3. OpenAI-kompatibler lokaler Proxy für OAuth-Provider

Das Vorzeige-Feature für Multi-Tool-Workflows: hermes proxy startet einen lokalen Endpunkt, der die OpenAI-API spricht, aber von dem OAuth-Provider unterstützt wird, bei dem du angemeldet bist — Claude Pro, ChatGPT Pro, SuperGrok.

# Proxy starten
hermes proxy --provider anthropic --port 8080

# Jetzt funktioniert jedes OpenAI-kompatible Tool
export OPENAI_BASE_URL=http://localhost:8080/v1

Jedes Tool, das einen OpenAI-kompatiblen Endpunkt erwartet (Codex CLI, Aider, Cline, Continue, deine eigenen Skripte), kann jetzt dein bestehendes Abonnement nutzen. Ein Abonnement, alle Tools. Das ist bedeutend für Entwickler, die zwischen Coding-Assistenten wechseln — kein Jonglieren mit API-Keys pro Tool mehr, keine separate Abrechnung. Hermes wird zur einheitlichen Routing-Schicht zwischen deinen Abonnements und deinem Workflow.

Halte den Port lokal — nicht dem öffentlichen Internet aussetzen.

Zugehöriger PR: #25969.

4. x_search — Erstklassige X (Twitter)-Suche

Der Agent kann jetzt direkt auf X suchen, ohne einen Skill zu installieren oder eine benutzerdefinierte Integration einzurichten. Durchsuche die Timeline, finde Threads, entdecke bestimmte Beiträge — direkt aus dem Chat heraus.

# Im Gespräch mit dem Agenten
"Durchsuche X nach dem, was die Leute über das neue Claude-Release sagen"

Die Authentifizierung funktioniert entweder mit deinem X OAuth-Login oder einem API-Key, was du gerade hast. Das entwickelt sich vom „Community-Hack“ zum erstklassigen Built-in-Tool.

Zugehöriger PR: #26763.

5. Microsoft Teams — Ende-zu-Ende

Der gesamte Microsoft Graph-Stack kommt zusammen: Auth + Client-Grundlage, ein Webhook-Listener, der Teams-Ereignisse empfängt, eine Pipeline-Plugin-Runtime und ausgehende Zustellung. Richte den Bot einmal ein und chatte dann mit deinem Agenten von jedem Teams-Kanal, jeder DM oder Gruppe aus.

Dies vervollständigt die Teams-Integration, die seit v0.12.0 teilweise verfügbar war — die grundlegenden Bausteine sind jetzt alle für den Produktionseinsatz bereit.

Zugehörige PRs: #21922, #21969, #22007, #22024.

6. Performance: ~19s schnellerer Kaltstart, 180x schnellerer Browser

Zwei große Performance-Stränge in diesem Release:

Kaltstart-Optimierung (~19 Sekunden gespart):

  • Schwere Adapter-Importe auf erste Nutzung verschoben (Feishu, QQ, Yuanbao, Google Chat, Teams, fal_client)
  • Modellkataloge zuerst aus Disk-Cache, Netzwerk überspringen wenn frisch
  • Doctor-Konnektivitätsprüfungen parallel mit deaktiviertem IMDS
  • chat -q Einzelabfrage-Modus überspringt den Willkommens-Banner vollständig
  • hermes tools Alle-Plattformen-Bildschirm: 14s → unter 1,5s

Browser CDP: 180x schneller:

Alle browser_console-Auswertungen teilen jetzt eine persistente WebSocket-Verbindung zu Chrome, anstatt bei jedem Aufruf eine neue DevTools-Sitzung zu starten. Seiteninteraktionen, die früher Sekunden dauerten, antworten jetzt in Millisekunden.

Zugehörige PRs: #22138, #22120, #22681, #22790, #22808, #22831, #22859, #22904, #22766, #25341, #23226.

7. Sitzungsübergreifender 1-Stunden Claude Prompt-Cache

Wenn du Claude über Anthropic, OpenRouter oder Nous Portal verwendest, wird das Prompt-Präfix (System-Prompt, Skills, Memory) jetzt eine Stunde lang sitzungsübergreifend gecacht. Starte eine /new-Sitzung und die erste Antwort kommt schneller und günstiger zurück, weil der Cache noch von deiner letzten Sitzung warm ist. Die Hintergrund-Memory-Überprüfung trifft ebenfalls auf den Cache.

Wenn du Hermes täglich mit Claude nutzt, summieren sich die Token-Einsparungen schnell — jede /new-Sitzung verwendet das teure System-Prompt-Präfix wieder, anstatt den vollen Preis zu zahlen.

Zugehörige PRs: #23828, #25434, #24778.

8. LINE + SimpleX Chat — 22 Messaging-Plattformen

Zwei neue Messaging-Plattformen stoßen zur Familie:

  • LINE — entscheidend für Japan, Korea und Taiwan, an die LINE Messaging API angebunden.
  • SimpleX Chat — datenschutzorientierter, dezentraler Messenger ohne Benutzer-IDs, jetzt eine erstklassige Plattform.

Damit erreicht Hermes insgesamt 22 Messaging-Plattformen. Wo auch immer du und dein Team chattet, der Agent kann dabei sein.

Zugehörige PRs: #23197, #26232.

9. /handoff — Live-Sitzungsübergabe

Modelle oder Persönlichkeiten mitten im Gespräch zu wechseln, bedeutete früher, den Kontext zu verlieren oder neu anzufangen. Jetzt migriert /handoff deine gesamte aktive Sitzung — Nachrichten, Tool-Aufrufe, Kontext — live zu einem Zielmodell, einer Persona oder einem Profil, ohne etwas zu verlieren.

# Von einem schnellen Modell zu einem Deep-Reasoning-Modell übergeben
/handoff deep-reasoning

# Profile für verschiedene Teile einer Aufgabe wechseln
/handoff production-profile

Ein beliebter Workflow: Erledige die Routinearbeit mit einem schnellen Modell, dann /handoff zu einem Reasoning-Modell, wenn du an eine Grenze stößt. Kein neues Fenster, kein Kontextverlust.

Zugehöriger PR: #23395.

10. Native Button-UI für clarify auf Telegram und Discord

Wenn der Agent das clarify-Tool verwendet, um dir eine Multiple-Choice-Frage zu stellen, zeigt er jetzt echte plattformeigene Buttons auf Telegram und Discord an, anstatt dich die Optionsnummer eintippen zu lassen. Tippe auf den Button und der Agent erhält deine Antwort. Besonders angenehm auf dem Handy, wo das Eintippen von Optionsnummern mühsam ist.

Zugehörige PRs: #24199, #25485.

11. Discord-Kanal-Verlaufsnachladung

Wenn Hermes zum ersten Mal einem Discord-Kanal oder -Thread beitritt, liest es jetzt den kürzlichen Nachrichtenverlauf, sodass es weiß, was besprochen wurde, bevor es antwortet. Kein „Worüber reden wir?“ mehr — der Agent betritt den Raum mit demselben Kontext, den alle anderen bereits auf dem Bildschirm haben.

Standardmäßig aktiviert. Zugehöriger PR: #25984.

12. LSP-Semantikdiagnose bei jedem Schreibvorgang

Wenn der Agent write_file oder patch verwendet, führt Hermes jetzt einen echten Language Server gegen die bearbeitete Datei aus und zeigt dem Agenten vor dem nächsten Zug alle neuen Fehler an. Typfehler, undefinierte Symbole, fehlende Imports — sofort erkannt.

Dies ist ein bedeutendes Upgrade gegenüber dem Syntax-Level-Linting von v0.13.0, denn es handelt sich um echte semantische Analyse eines realen Language Servers. Der Agent erkennt seine eigenen Fehler, bevor sie sich anhäufen.

Zugehörige PRs: #24168, #25978.

13. Dateiänderungs-Prüfer pro Zug

Nach jedem Zug, in dem Dateien geschrieben oder bearbeitet wurden, erhält der Agent jetzt eine kurze Zusammenfassung, was genau auf der Festplatte geändert wurde — Dateipfade, Zeilenanzahl, das tatsächliche Delta. Der Agent erkennt seine eigenen Fehler, wenn ein Schreibvorgang nicht angewendet oder stillschweigend überschrieben wurde, anstatt dir selbstbewusst zu sagen: „Ich habe die Funktion hinzugefügt“, obwohl die Datei gar nicht gespeichert wurde.

Zugehöriger PR: #24498.

14. vision_analyze liefert Rohpixel

Wenn du den Agenten mit vision_analyze auf ein Bild verweist und das aktive Modell tatsächlich sehen kann (GPT-5, Claude, Gemini, Grok-Vision), übergibt Hermes jetzt die Rohpixel direkt an das Modell, anstatt sie zuerst in eine Textbeschreibung umzuwandeln. Du erhältst die tatsächliche visuelle Schlussfolgerung des Modells anstelle eines degradierten Text-Zusammenfassungs-Umwegs.

Zugehöriger PR: #22955.

15. Vereinheitlichtes video_generate mit austauschbaren Backends

Ein Tool, jedes Videomodell. Hermes wird bereits mit den offensichtlichen Backends ausgeliefert, aber du kannst einen neuen Videoanbieter als Plugin hinzufügen, ohne den Kern anzufassen. Wenn nächsten Monat ein neues Videomodell erscheint, kann es ein Ein-Datei-Plugin sein statt eines Forks.

Zugehöriger PR: #25126.

16. computer_use CUA-Driver — Funktioniert mit Nicht-Anthropic-Modellen

Computer-Use (der Agent steuert Maus und Tastatur, um GUI-Anwendungen zu bedienen) war früher auf das Anthropic-SDK beschränkt. Das neue CUA-Driver-Backend funktioniert auch mit Nicht-Anthropic-Providern, hat ordnungsgemäße fokus-sichere Operationen und aktualisiert sich bei hermes update. Jetzt kann jedes visuell fähige Modell deinen Desktop steuern.

Zugehörige PRs: #21967, #24063.

17. Klickbare URLs in jedem Terminal

Links in der Agent-Ausgabe sind jetzt echte OSC8-Hyperlinks mit Hover-Hervorhebung in jedem Terminal, das sie unterstützt (iTerm2, Kitty, Ghostty, modernes Windows-Terminal usw.). Klicken zum Öffnen im Browser — kein Kopieren-Einfügen-Zurechtschneiden langer URLs aus der Abschrift mehr.

Zugehörige PRs: #25071, #24013.

18. Native Windows-Unterstützung (frühe Beta)

Hermes läuft jetzt nativ auf cmd.exe und PowerShell ohne WSL. Ein vollständiger PowerShell-Installer kümmert sich um die automatische MinGit-Installation, Erkennung von Microsoft Store Python-Stubs und den Vordergrund-Ctrl+C-Tanz. Über 40 Windows-spezifische Korrekturen sind gelandet, damit die grundlegende Schleife Ende-zu-Ende auf einer sauberen Windows-Maschine funktioniert. Noch als „frühe Beta“ gekennzeichnet — Ecken und Kanten bleiben — aber der Kernpfad funktioniert.

Zugehöriger PR: #21561.


Neue Provider und Modellverbesserungen

Funktion Beschreibung
xAI Grok OAuth SuperGrok-Abo-Integration mit OAuth-Login
NovitaAI Neuer Provider für Open-Source-Modell-Hosting (Llama, Qwen, DeepSeek, etc.)
OpenRouter Pareto Code Router min_coding_score-Regler — routet zum günstigsten Modell, das deine Qualitätsanforderungen erfüllt
Codex App-Server Runtime Optionale Runtime, die OpenAIs Codex CLI antreibt, mit Sitzungswiederverwendung, automatischer Stilllegung blockierter Sitzungen und OAuth-Refresh-Klassifizierung
Qwen Cloud Alibaba Cloud in Qwen Cloud umbenannt (Konfiguration rückwärtskompatibel)
NVIDIA NIM Unterstützung für Billing-Origin-Header

Neue optionale Skills

Neun neue optionale Skills stoßen zum Ökosystem:

Skill Beschreibung
Hyperliquid Perp- und Spot-Trading via SDK und REST-API
Yahoo Finance Live-Marktdaten, Fundamentaldaten, Historisches
api-testing REST- und GraphQL-Debug-Rezepte
Unified EVM Multi-Chain Ein Skill für Ethereum + L2s + Base
darwinian-evolver Evolutionäre Prompt- und Skill-Optimierung
osint-investigation OSINT-Rezepte für Personen, Domains und Organisationen
pinggy-tunnel Lokale Dienste dem öffentlichen Internet zugänglich machen
watchers RSS / HTTP JSON / GitHub-Polling via Cron im no_agent-Modus
Notion Komplette Überarbeitung für die Developer Platform Mai 2026

Zusätzlich ist huggingface/skills jetzt ein vertrauenswürdiger Standard-Tap im Skills Hub — dort gehostete Community-Skills sind direkt aus hermes skills ohne zusätzliche Konfiguration installierbar.

Zugehörige PRs: #23582, #23583, #23590, #25299, #26760, #26729, #26765, #21881, #26612, #26219.


Plugin- und Erweiterungsverbesserungen

ctx.llm — in die Modell-Pipeline des Agenten einklinken. Plugin-Autoren können jetzt LLM-Aufrufe über den aktiven Provider und dessen Anmeldeinformationen tätigen — kein manuelles Client-Verdrahten nötig. Plugins erhalten dasselbe Modell-Routing und dieselbe Auth-Infrastruktur, die der Kern-Agent verwendet.

tool_override — eingebaute Tools austauschen. Ein Plugin kann ein eingebautes Tool sauber durch seine eigene Implementierung ersetzen. Dies schließt eine langjährige Community-Anfrage (#11049).

Teilbare Profile via Git. Verteile vollständige Hermes-Profile (Config, Skills, Memory) über Git-Repositories — ideal für Team-Standardisierung.

Zed ACP Registry. Hermes ist jetzt im Agent Client Protocol-Register von Zed gelistet. Installation mit einem Klick via uvx, keine npm-Abhängigkeit.

Zugehörige PRs: #23194, #26759, #20831, #26079, #26120, #26234.


Neue eingebaute Tools und Befehle

Tool / Befehl Beschreibung Verwendung
x_search Timeline, Threads und Beiträge auf X (Twitter) durchsuchen Den Agenten bitten, direkt auf X zu suchen
hermes proxy OpenAI-kompatibler lokaler Proxy, unterstützt von OAuth-Providern hermes proxy --provider anthropic --port 8080
/handoff Live-Übergabe der Sitzung an ein anderes Modell/Persona/Profil /handoff deep-reasoning
/subgoal Erfolgskriterien an ein laufendes /goal anhängen /subgoal Unit-Tests für das neue Modul hinzufügen
/sessions Frühere Sitzungen im TUI durchsuchen und fortsetzen /sessions
Brave Search Websuche-Provider mit kostenlosem Kontingent In den Web-Search-Einstellungen konfigurieren
DDGS DuckDuckGo-Scraper — kostenlos, kein API-Key nötig In den Web-Search-Einstellungen konfigurieren

Verbesserungen

Messaging-Plattformen

  • Telegram: natives Entwurf-Streaming (sendMessageDraft, Bot API 9.5+), Benachrichtigungsmodus, Gast-Erwähnungsmodus, überlange Bearbeitungen aufteilen statt stillschweigend abzuschneiden
  • Discord: thread_require_mention für Multi-Bot-Threads
  • Slack: !cmd als alternatives Präfix für Slash-Befehle in Threads
  • WhatsApp: Metadaten zitierter Antworten von Baileys anzeigen
  • Feishu: native Update-Prompt-Karten
  • Google Chat: Setup-Prompt-Importe reparieren, Relay-deklarierten sender_type beachten
  • Gateway: läuft weiter, wenn einzelne Plattformen ausfallen, Circuit Breaker pro Plattform mit /platform-Befehl

TUI und CLI

  • /sessions Slash-Befehl zum Durchsuchen und Fortsetzen früherer Sitzungen
  • Zugsegmentierung mit visuellen Trennlinien
  • Unterstützung für Verbindung zu einem bestehenden Gateway
  • Markdown-Links zu lesbaren Seitentiteln aufgelöst
  • Breitenbewusste Markdown-Tabellen-Darstellung mit vertikaler Alternative
  • YOLO-Modus-Warnung in Banner und Statusleiste
  • Bestätigungsaufforderung für destruktive Slash-Befehle

Kanban (Multi-Agent)

  • specify — Hilfs-LLM arbeitet Triage-Aufgaben aus
  • Orchestrator-Board-Tools: kanban_list + kanban_unblock
  • stranded_in_ready-Diagnose für nicht beanspruchte Aufgaben
  • Deduplizierte Benachrichtigungszustellung via atomarer Beanspruchung + Rücklauf bei Fehler

Google Workspace

  • Drive-Schreiboperationen + Docs/Sheets erstellen/anhängen

i18n

  • Alle Gateway-Befehle + Web-Dashboard lokalisiert, 8 neue Sprachen hinzugefügt (16 insgesamt)

Performance

  • Kaltstart: ~19s gespart durch verzögerte Importe, Festplatten-gecachte Modellkataloge, parallele Doctor-Prüfungen und chat -q ohne Willkommens-Banner
  • Browser: browser_console 180x schneller durch persistente CDP-WebSocket
  • Telegram: optimierte Taktung + adaptiver Schnellpfad für kurze Antworten
  • Prompt-Caching: 1-stündiger sitzungsübergreifender Claude-Präfix-Cache auf Anthropic, OpenRouter und Nous Portal
  • TUI: breitenbewusste Tabellen-Darstellung, Transkript-Scrollen während Prompts

Sicherheit und Zuverlässigkeit

Sicherheitshärtung

  • Sudo-Brute-Force blockiert: sudo -S-Versuche als GEFÄHRLICH eingestuft; stdin-gefütterte und askpass-entfernte Sudo-Aufrufe erkannt
  • Drei Umgehungen gefährlicher Befehle geschlossen (inspiriert von Claude Codes Befehlserkennungsarbeit)
  • Tool-Fehlerbereinigung: Schädliche Dateien oder Remote-Dienste können keine Anweisungen über Fehlerausgaben einschleusen
  • SSRF-Abrufpfade im Skills-Hub abgedeckt
  • Dashboard-Authentifizierung für Plugin-API-Routen erforderlich
  • Supply-Chain-Advisory-Checker scannt jede Installation
  • Kanban-Kommentar-Autorenbereinigung — keine vom Aufrufer kontrollierte Autorenüberschreibung
  • Quick-Command-Ausgabenredaktion und Umgebungsbereinigung
  • Reduziertes unnötiges shell=True in Subprocess-Aufrufen

Bemerkenswerte Fehlerbehebungen

  • SQLite: Rückfall auf journal_mode=DELETE bei NFS/SMB/FUSE (behebt /resume auf Netzwerk-Mounts)
  • Codex-Runtime: blockierte Sitzungen stilllegen + Post-Tool-Watchdog + OAuth-Refresh-Klassifizierung
  • Daytona: Legacy-Sandbox-Suche auf Cursor-basiertes list() migriert
  • MCP: keine Wiederholungsversuche bei initialen Auth-Fehlern, verhindert Endlosschleifen
  • ACP: Inline-Dateianhang-Ressourcen
  • Profile + Banner: Infrastruktur von --clone-all ausschließen, veraltete Update-Check-Repo-Auflösung beheben

Upgrade

hermes update

Wenn du von einer Version vor v0.14.0 aktualisierst, sichere zuerst dein ~/.hermes-Verzeichnis. Führe nach dem Upgrade hermes doctor aus, um zu überprüfen, ob alles in Ordnung ist.

Für Neuinstallationen:

pip install hermes-agent
hermes setup

Vollständiger Changelog auf GitHub

← Hermes Agent Changelog