Hermes Agent v0.19.0 — The Quicksilver Release (Das Quicksilver-Release)
Überblick
v0.19.0 — The Quicksilver Release. Veröffentlicht am 20. Juli 2026. ~2.245 Commits · ~1.065 gemergte PRs · ~2.465 geänderte Dateien · ~300.000 Einfügungen · ~36.000 Löschungen · ~3.300 geschlossene Issues · 450+ Community-Mitwirkende.
Hermes ist der Götterbote, und in diesem Fenster haben wir ihn auch so schnell gemacht. Das Quicksilver-Release ist um eine einzige Überzeugung herum gebaut: Ein autonomer Agent, der sich träge anfühlt, ist ein Agent, den du nicht benutzen wirst. Die Time-to-First-Token der ersten Runde sank um ~80 % auf jeder Plattform — Cold Start von ~4,3 s auf ~0,9 s. Reasoning-Modelle streamen ihr Denken jetzt standardmäßig live. Die Desktop-App erhielt 20+ gezielte Performance-PRs (14× schnelleres Streaming-Markdown, virtualisierte Diffs, flüssiges Session-Switching). Das TUI rendert Markdown inkrementell.
Um dieses Geschwindigkeitsfundament herum liegt ein Release voller neuer Fähigkeiten: Terminal-Abrechnung (/subscription und /topup), Passwort-Manager-Integration (Bitwarden & 1Password), Intelligente Genehmigungen (LLM-geprüfte Befehle als Standard), Live-Subagent-Überwachungsfenster, ein dauerhaftes Delivery-Ledger, das Gateway-Abstürze übersteht, und profilbasiertes Nachrichten-Routing für Multi-Tenant-Bereitstellungen. Neue Provider (Fireworks AI, DeepInfra) und die neuesten Frontier-Modelle (GPT-5.6, grok-4.5, kimi-k3, Claude Sonnet 5) runden den Katalog ab.
Dieses Release enthält auch alles aus den v0.18.1- und v0.18.2-Infrastruktur-Patches — diese Fenster sind hier vollständig dokumentiert.
Highlights
1. Hermes wurde dramatisch schneller — First Token in einem Bruchteil der Zeit
Die „Initializing agent…“-Phase beim Cold Start verschlang früher ~4,3 Sekunden, bevor deine erste Eingabe überhaupt das Modell erreichte. Jetzt sind es ~0,9 s — eine Reduzierung um ~80 %, die gleichermaßen für CLI, Gateway, TUI, Desktop und Cron gilt.
Was sich unter der Haube geändert hat:
- Discord-Fähigkeitenerkennung wurde aus dem kritischen Pfad genommen, mit einem Token-basierten 24-Stunden-Disk-Cache plus Hintergrundaktualisierung
- Ollama-Probe wird bei bekannten Nicht-Ollama-Providern übersprungen
- Agent-Init-Blockierarbeit aus dem Cold Path entfernt
- Prompt-Build-Caching und mtime-gecachte Zeitzonenauflösung
Wahrgenommene Latenz — Runde 2 zielte darauf ab, was du siehst, während du wartest:
display.show_reasoningist jetzt standardmäßig AN — Reasoning-Modelle streamen ihr Denken live, statt 30+ Sekunden lang einen Spinner zu zeigen- Der Antwortbereich malt pro Token statt pro Zeile, mit breitenabhängigem Force-Flush
- Gemischte Tool-Batches werden jetzt segmentiert, um verlorene Parallelität wiederherzustellen
- Pro-Call-Base64-Re-Serialisierung aus den Request-Size-Schätzungen entfernt
Wenn Hermes sich jemals anfühlte, als würde er vor einer Antwort tief Luft holen — dieser Atemzug ist verschwunden.
2. Desktop-App-Geschwindigkeitsoffensive — 20+ gezielte Performance-PRs
@OutThisLife leitete eine fokussierte Leistungsüberholung, die die Desktop-App selbst unter Last mit massiven Transkripten und aktiven Agenten nativ schnell wirken lässt.
| Bereich | Verbesserung |
|---|---|
| Streaming-Markdown | 14× weniger CPU durch inkrementelles Block-Lexing |
| Diff-Rendering | Virtualisierte Review-Pane-Diffs — kein Full-Shiki-Freeze mehr bei großen Dateien |
| Session-Wechsel | Sofortiger Wechsel selbst bei riesigen Konversationen, Layout-Thrash-Kaskade beseitigt |
| Start | Serialisierung reduziert + Pro-Turn-REST-Amplifikation entfernt; Profil-Backends werden bei Hover-Intent vorgewärmt |
| Boot-verborgene Panels | Werden im Leerlauf gemountet statt auf dem kritischen Cold-Start-Pfad |
| Pro-Token-Re-Renderings | Sidebar und Tool-Zeilen werden während des Streamings nicht mehr neu gerendert; eager JSON.stringify von Tool-Args/Results entfernt |
| Profiling | Systematisierter Perf-Benchmark-Harness, der 12 einmalige Skripte ersetzt |
Das Netto-Ergebnis: das schnellste und geschmeidigste Hermes-Desktop-Erlebnis aller Zeiten.
3. Verwalte deinen Nous-Tarif vom Terminal aus — /subscription und /topup
Einen Tarif zu wechseln bedeutete früher den Umweg über die Abrechnungs-Website. Jetzt passiert das direkt im Terminal:
# Öffne den vollständigen Abonnement-Flow im TUI oder klassischen CLI
/subscription
# Was du siehst:
# - Aktueller Tarif und verbleibendes Kontingent
# - Upgrade-Vorschau: „Pay $46.30 & upgrade now"
# - Downgrade-Wirksamkeitsdatum: „Downgrade takes effect on Aug 1"
# - Banner für geplante Änderungen mit Rückgängig-Option
# Konto aufladen
/topup
Die Desktop-App erhielt einen passenden Abrechnungs-Einstellungs-Tab. Dein Wallet muss die Tastatur nie verlassen.
4. Intelligente Genehmigungen — Standardmäßig LLM-geprüfte Befehle
Wenn Hermes einen markierten Befehl ausführen möchte, bewertet ihn jetzt ein LLM-Reviewer unabhängig, statt dass du jeden einzelnen genehmigen musst. Jedes Urteil gilt nur für genau diesen Befehl — ein späterer Befehl, der demselben Muster entspricht, erhält seine eigene neue Prüfung.
Der Entscheidungsfluss:
- Sicher → automatisch genehmigt, keine Unterbrechung
- Gefährlich → automatisch abgelehnt, mit protokolliertem Grund
- Unsicher → zur manuellen Entscheidung an den Benutzer eskaliert
In Kombination mit benutzerdefinierten Ablehnungsregeln (die Befehle selbst im Yolo-Modus blockieren) und /deny <Grund> (das dem Agenten mitteilt, warum du abgelehnt hast, damit er gegensteuern kann), sinkt die tägliche Genehmigungsmüdigkeit drastisch, ohne die Kontrolle aufzugeben.
# Ablehnen mit Begründung — der Agent lernt aus deiner Ablehnung
/deny that would delete the production database
# Ablehnungsregeln in der Konfiguration definieren, die auch im YOLO-Modus blockieren
deny_rules:
- pattern: "rm -rf /"
reason: "Never delete root"
- pattern: "DROP (DATABASE|TABLE)"
reason: "Database operations require manual review"
5. Passwort-Manager-Integration — Bitwarden- und 1Password-Secret-Quellen
API-Schlüssel müssen nicht länger in einer Plaintext-.env-Datei leben. Ein neues, austauschbares SecretSource-Interface lässt Hermes Secrets von Bitwarden und 1Password (op://-Referenzen) zur Ladezeit abrufen.
# hermes.config.yaml
secret_sources:
- provider: bitwarden
vault: "dev-creds"
priority: 1
- provider: onepassword
vault: "Production"
priority: 2
# op://-Referenzen werden zur Ladezeit aufgelöst:
# op://Production/OpenAI/credential → OPENAI_API_KEY
Zentrale Designentscheidungen:
- Mehrere Vaults gleichzeitig aktiviert mit deterministischer Rangfolge
- Konfliktwarnungen, wenn zwei Quellen dieselbe Variable bereitstellen
- Pro-Variable-Provenienz-Tracking — du weißt immer, woher ein Secret stammt
- Elf konkurrierende Community-PRs wurden in einer orchestrierten Schnittstelle zusammengeführt
- Zukünftige Vault-Provider (HashiCorp Vault, AWS Secrets Manager usw.) können als Plugins integriert werden
6. Beobachte deine Subagents bei der Arbeit — Live-Transkripte + dauerhafte Hintergrunddelegation
Delegierte Subagents sind keine unsichtbaren Arbeiter mehr, die hinter einem Spinner verschwinden.
# delegate_task liefert jetzt Live-Transkriptdateien zurück
/delegate_task "Research competitors A, B, C in parallel"
# Beobachte jeden Subagent live aus einem anderen Terminal
tail -f /tmp/hermes-delegate-abc123.log
# Jeder Tool-Aufruf, jedes Ergebnis und jede gestreamte Antwort — ein lesbares Log pro Kind
Dauerhafte Hintergrunddelegation bedeutet: Wenn der Prozess mitten im Lauf neu startet, werden Ergebnisse wiederhergestellt und über ein eigentumsgeprüftes Ledger zugestellt, statt zu verschwinden. Fächere eine Flotte auf, beobachte jeden Worker live und verliere niemals die Ergebnisse.
7. Delivery-Obligation-Ledger — Absturzsichere Antworten
Wenn das Gateway abstürzte, nachdem es deine Antwort generiert, aber bevor es die tatsächliche Zustellung bestätigt hatte, war diese Antwort früher stillschweigend verloren — und du hattest für die Runde bezahlt. Das ist jetzt vorbei.
Endgültige Antworten werden nun in einem dauerhaften Ledger in state.db rund um den Plattformversand aufgezeichnet und beim nächsten Start erneut zugestellt. Dies schließt ein P1-Fenster für stillen Verlust bei Telegram, Discord, Slack und jedem anderen Nachrichtenkanal. Eine abgeschlossene Antwort kann nicht mehr verloren gehen.
8. Ein Gateway, viele Profile — Profilbasiertes Nachrichten-Routing
Ein einziges gemultiplextes Gateway, das ein Bot-Token teilt, kann jetzt bestimmte Gilden, Kanäle oder Threads zu verschiedenen Profilen routen — jedes mit vollständig isolierter Konfiguration, Skills, Speicher und Secrets.
# Leite deinen Arbeits-Discord-Server zum Profil 'work'
# und deinen Hobby-Server zu 'personal' — von einem Bot aus
gateway:
multiplex_profiles:
- profile: work
discord:
guilds: ["123456789"]
channels: ["987654321"]
- profile: personal
discord:
guilds: ["111111111"]
Eine zweite Härtungswelle des Multiplexings bedeutet, dass ein fehlkonfiguriertes Profil nicht länger das gesamte Gateway lahmlegen kann.
9. Neue Provider & Frontier-Modelle
| Neuzugang | Details |
|---|---|
| Fireworks AI | Erstklassiger Provider mit Kostenschätzung, auf Platz 2 in der Provider-Auswahl aufgestiegen |
| DeepInfra | Gehärtete Integration mit vollständiger Katalog-Anbindung |
| Upstage Solar | Neuer Provider durch Community-Rettung |
| GPT-5.6 | Sol/Terra/Luna + Pro-Varianten, durchgängig über jede Route verdrahtet |
| grok-4.5 | GA-Katalogeintrag mit Reasoning-Allowlist |
| kimi-k3 | Vollständiges Rollout über Nous Portal, OpenRouter und Kimi Coding-Endpunkte; kimi-k2.x ausgemustert |
| Claude Sonnet 5 | Kuratierter Katalog, Einführungspreis, Metadaten über jede Route |
| Claude Fable 5 | Zusammen mit Sonnet 5 kuratiert |
| LM Studio | JIT-Modellladen für lokale Setups |
| Bedrock Catalog Wave | Echtes Kontextfenster-Probing vom Live-Endpunkt; 1M-Kontext-Zeilen für aktuelle Claude + Fable |
Du kannst jetzt Provider ausblenden, die du nicht nutzt, mit enabled: false pro Provider oder excluded_providers, um unerwünschte Einträge aus den /model-Auswahlen zu entfernen.
10. Reasoning Effort — max- und ultra-Stufen
Reasoning ist jetzt ein Regler, kein globaler Schalter:
# CLI: sitzungsbezogene Reasoning-Steuerung
/reasoning # interaktive Auswahl: off → low → medium → high → max → ultra
# Pro-Modell-Überschreibungen in der Konfiguration
reasoning:
models:
"gpt-5.6-sol": ultra
"claude-sonnet-5": max
# Pro-Slot-Effort in MoA-Presets — Berater denken gründlich, Synthesizer bleibt schnell
moa:
presets:
deep-council:
references:
- model: gpt-5.6-sol
reasoning_effort: max
- model: claude-sonnet-5
reasoning_effort: max
aggregator:
model: gpt-5.6-luna
reasoning_effort: medium
GPT-5.6- und Codex-Top-Stufen werden vollständig unterstützt, mit sinnvoller Begrenzung bei Providern mit kleineren Skalen. Durchgängige Pro-Modell-, Pro-Aufgaben- und Pro-Slot-MoA-Effort-Steuerung.
Performance — Das Geschwindigkeitsfundament
First-Turn-Latenz (Alle Plattformen)
- ~80 % TTFT-Reduzierung: Cold Submit→Dispatch ~4,3 s → ~0,9 s über CLI, Gateway, TUI, Desktop und Cron hinweg
- Reasoning-Streaming standardmäßig AN: Beobachte das Modell beim Denken, statt auf einen Spinner zu starren
- Pro-Token-Antwortdarstellung mit breitenabhängigem Force-Flush
- Prompt-Build-Caching und mtime-gecachte Zeitzonenauflösung
- Gemischte Tool-Batches segmentiert, um verlorene Parallelität wiederherzustellen
Desktop-Geschwindigkeitsoffensive
- 14× weniger Splitter-CPU durch inkrementelles Block-Lexing für Streaming-Markdown
- Virtualisierte Review-Pane-Diffs — kein Full-Shiki-Freeze mehr
- Flüssiges Session-Wechseln bei großen Transkripten, Layout-Thrash-Kaskade beseitigt
- Startup-Optimierung: Serialisierung reduziert, Pro-Turn-REST-Amplifikation entfernt
- Profil-Backends werden bei Hover-Intent vorgewärmt; Boot-verborgene Panels im Leerlauf gemountet
- Pro-Token-Render-Eliminierung: Sidebar + Tool-Zeilen-Re-Renderings während des Streamings gestoppt
- Systematisierter Perf-Benchmark-Harness
Überall sonst
- TUI rendert gestreamtes Markdown inkrementell pro Block
- Skill-Erkennung durch Scan-Signatur gecacht; Snapshot-Manifest-Builds ~5× schneller
- Copy-on-Write-Nachrichtenvorbereitung statt vollständigem Deepcopy
- Modell-Metadaten-Probe-Cache-Cluster für schnelleren Modellwechsel
- Gateway: Byte-stabile System-Prompts halten den Prompt-Cache über Runden hinweg am Leben
hermes updateüberspringt npm install, wenn Node-Manifeste unverändert sind
Hauptfunktionen
Gateway, Fleet & Relay
Dauerhaftes Delivery-Obligation-Ledger — endgültige Antworten werden in state.db aufgezeichnet und beim nächsten Start erneut zugestellt, wenn das Gateway vor der Plattform-Bestätigung abstürzt.
Profilbasiertes Routing — ein Bot-Token, mehrere Profile. Route bestimmte Discord-Gilden/Kanäle, Telegram-Chats oder Slack-Workspaces zu verschiedenen Profilen mit isolierter Konfiguration, Skills, Speicher und Secrets.
Pro-Session-Turn-Lease — verhindert doppelte Verarbeitung derselben Nachricht. Konversationsbezogener Funnel und vereinheitlichte Session-Reset-Grenzen.
Relay-Reifegrad — generisches OIDC-Client-Credentials-Provisioning (NAS-frei), geroutete Profile vom Connector-Wire-Ursprung übernommen, Channel-Kontext vom Connector konsumiert, Nous-Auth-Forensik mit nous_session_valid auf /api/status für gehostete Selbstheilung.
Messaging-Plattformen
| Plattform | Wichtige Updates |
|---|---|
| Telegram, Discord, Matrix | Inline-Choice-Picker für /reasoning und /fast — native Buttons mit einem Tipp |
| Native Baileys Polls (Klärungsfragen als Umfrage), Standorte, umfangreiche eingehende Metadaten, Dashboard-Pairing-Flow | |
| Discord | Nachrichten wiederherstellen, die während der Wiederverbindung verpasst wurden; automatisch erstellte Threads zu Session-Titeln umbenannt; konfigurierbares interaktives Ansichts-Timeout; Opt-in-Besitzer-Erwähnungen bei Ausführungsgenehmigungsaufforderungen |
| Slack | Live-Statuszeile pro Tool während der Agent-Ausführung |
| Telegram | Pro-Thema-Free-Response-Allowlist |
| Google Chat | Klärungsaufforderungen als Karten gerendert |
| Voice | stt.echo_transcripts-Toggle; MEDIA-Beschriftungen bei eigenständigen Sendungen |
Desktop-App
- Beitragsgetriebene Shell-Architektur auf einem Layout-Tree-Modell — Panels, Zonen und Layouts als Daten
- Capabilities-Seite: Skills/Tools/MCP + Hub an einem Ort mit responsiver Overlay-Navigation
- Hermes-Cloud-Verbindungsmodus mit weichem Gateway-Wechsel und verfeinerten Gateway-Einstellungen
- Keybind-Hinweis-Tooltips + Keybinds-Einstellungs-Tab + vereinheitlichter Worktree-Dialog
- Session + Project Color System — vom Projekt erben, pro Session überschreiben, in Sidebar/Tabs geteilt
- Deklaratives Memory-Provider-Panel + Full-Config-Modal
- Konfig-definierte TTS/STT-Provider mit xAI-TTS-Parametern
- UI-Skalierungseinstellung, Strg/Cmd+Rad-Zoom, Chat-Hintergrund-Umschalter
- Vollständige TypeScript-Konvertierung des Desktop-Baums
CLI & TUI
/model --once— One-Turn-Modell-Überschreibung, die automatisch zurückgesetzt wird- Gestapelte Slash-Skill-Aufrufe —
/skill-a /skill-b do XYZlädt beide Skills nacheinander --safe-mode-Fehlerbehebungsflag; Deinstallations-Probelauf; TLS-Fehler schlagen sofort mit Reparaturhinweisen fehl/compact-Alias + Vorschau-Flags- Hermes Console REPL mit Perf-Nachbereitungen
- TUI: Modellauswahl-Aktualisierungsunterstützung; benutzerdefinierte Skill-Bundles werden als Agent-Turns ausgeführt
Tool-System, Skills & MCP
- MCP:
mcp__server__tool-Namenskonvention; Server-Log-Benachrichtigungen in agent.log; gehostetes OAuth über Dashboard + Desktop abgeschlossen; konfigurierbareredirect_uri/redirect_hostfür Proxy-/WAF-Setups - Skills:
security/unbroker(autonome Datenbroker-Entfernung);blender-mcprund um Katalogeintrag überarbeitet;unreal-mcp-Begleit-Skill; Humanizer-Muster-Erweiterung - Browser: vollständige Snapshots bei Trunkierung gespeichert; Eval-Denylist Opt-in
- Kanban: modaler Aufgabenerstellungsdialog + bearbeitbares Board-Projektverzeichnis; Greifen-zum-Schwenken-Board-Scrolling; Attachment-Toolset + CLI mit SSRF-geschütztem URL-Abruf
- Cron: dauerhafte Ausführungsprüfhistorie; One-Shot-Stale-Removal-Race behoben; Run-Claim-TTL von
HERMES_CRON_TIMEOUTabgeleitet
Sessions & Datenexport
# Sessions in mehreren Formaten exportieren
hermes sessions export --format markdown
hermes sessions export --format html
hermes sessions export --format quarto
hermes sessions export --format prompt-only
hermes sessions export --format hf-trace # Hugging Face-kompatibel
# Mit Secret-Redaktion
hermes sessions export --redact
# Nach Alter, Workspace, Plattform filtern
hermes sessions export --older-than 30d --workspace my-project
Dein Konversationsverlauf ist jetzt ein echter Datensatz, keine Blackbox.
Secrets & Konfiguration
- Austauschbares
SecretSource-Interface mit Bitwarden- & 1Password-Providern hermes config get/unset-Befehle für Konfigurationsmanagement- Warnungen bei unbekannten Root-Konfigurationsschlüsseln + Doctor-Berichterstattung für veraltete Schlüssel
- Hilfsmodell-Nutzung pro Aufgabe in der Session-Abrechnung erfasst
- Konversationsbezogene Nous-Portal-Nutzungstags über Aux-/MoA-/Delegate-Aufrufe hinweg
MoA-Verbesserungen
reference_max_tokenszur Begrenzung der Beraterausgabe und Reduzierung der Latenz- Pro-Preset-Fanout-Taktung —
user_turnführt Berater einmal pro Benutzerrunde aus - Veraltete Presets werden ohne Wiederholungsversuche angezeigt; halbgefüllte Preset-Speicherungen werden an der API-Grenze abgelehnt
- Aggregator löst Reasoning wie ein agierendes Modell auf
Sicherheit & Zuverlässigkeit
Härtung der Credential-Oberfläche
- Vertex-Credentials aus der Subprozess-Umgebung heraus und über Profil-Secret-Scopes geleitet
- Sechs P1-Härtungs-PRs in einem Durchgang gerettet — Browser-Guards, MEDIA-Verankerung, .env-Lockdown, Delegate-ACP-Transport
- Media/Vision/Image-Gen lokale Dateizugriffe über einen gemeinsamen Credential-Read-Guard geleitet
- Webhook-Body-Cap-Sweep über jeden aiohttp-Server hinweg
- Bot-Token-Redaktion bei Telegram-Transportfehlern
- Fireworks-Token-Präfixe dem Redactor hinzugefügt
- CI gehärtet gegen Untrusted-Ref-Interpolation
Redaktion & sichere Standardeinstellungen
- Env-Lookup-False-Positives für
KEY=valueund JSON/YAML-Konfigurationsfelder behoben - Bot-Token aus Telegram-Verbindungs-/Sendefehlern entfernt
computer_useSubprozess-Umgebung an allen fünf CUA-Driver-Spawn-Stellen bereinigt
Gateway- & Agent-Zuverlässigkeit
tool_call_iddedupliziert über Pre-API-Sanitizer hinweg- Background Review erbt parent reasoning_config für Anthropic-Cache-Parität
- Anthropic-Request-lokale Clients, damit der Stale/Interrupt-Watchdog niemals SQLite beschädigt
- OAuth-Login-429 behoben — UA darf nicht
claude-code/sein
Dashboard-Sicherheit
- Managed-Files-Credential-Guard über
.envhinaus erweitert + Dir-Tree-Lücke geschlossen - OAuth-Token-TOCTOU durch atomare
0o600-Schreibvorgänge geschlossen - Veraltete Dashboards können keine gelöschten Profile wiederherstellen
In diesem Fenster zurückgesetzt
- iron-proxy Credential-Injection-Egress-Firewall — zurückgesetzt, wird nicht ausgeliefert
- dynamic-workflow Orchestrierungs-Skill — gelandet, dann zurückgesetzt
- memory provider-actions extension point — gelandet, dann zurückgesetzt
- Hinweis: Die Plugin-
pre_tool_call-Genehmigungs-Eskalation wurde mitten im Fenster zurückgesetzt, aber wieder eingebracht und wird in diesem Release ausgeliefert
Upgrade
hermes update
Für Neuinstallationen:
# macOS / Linux / WSL2
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash
# Windows (PowerShell)
iex (irm https://hermes-agent.nousresearch.com/install.ps1)
Vollständiger Changelog auf GitHub
← Hermes Agent Changelog