v0.11.0

Hermes Agent v0.11.0 — La version Interface


Aperçu

v0.11.0 — The Interface Release. Publié le 23 avril 2026. ~1 556 commits · 761 PRs fusionnés · 1 314 fichiers modifiés · ~224 000 insertions · 29 contributeurs communautaires (290 en incluant les co-auteurs).

C’est la version architecturale dont Hermes Agent avait besoin. The Interface Release fait trois choses simultanément : elle réécrit la CLI interactive en une TUI React/Ink avec un backend JSON-RPC, extrait une couche de transport modulaire qui découple chaque fournisseur de la boucle principale de l’agent, et élargit considérablement la surface de plugins pour que le code tiers puisse se brancher sur l’exécution des outils, la sortie du terminal et le tableau de bord. Tout cela en ajoutant cinq nouveaux chemins d’inférence, AWS Bedrock natif et GPT-5.5.

Cette version intègre tous les points forts reportés de v0.10.0 (qui ne contenait que le Nous Tool Gateway), couvrant ainsi environ deux semaines de travail sur l’ensemble de la pile.


Fonctionnalités Majeures

1. Nouvelle TUI basée sur Ink — hermes --tui

La CLI interactive a été entièrement réécrite en interface terminal React/Ink avec un backend Python JSON-RPC (tui_gateway). Ce n’est pas un simple habillage — c’est une reconstruction complète avec ~310 commits dans ui-tui/ et tui_gateway/.

Capacités clés :

  • Compositeur fixe qui se fige pendant le défilement — votre saisie reste ancrée en bas, quel que soit le volume de sortie de l’agent
  • Streaming en direct avec support du presse-papiers OSC-52 — copiez la sortie de l’agent dans le presse-papiers système même via SSH
  • Barre d’état avec chronomètre par tour, étiquette de branche git et indicateurs d’activité
  • Touches de sélection stables — les sélecteurs de modèle et d’outil utilisent des raccourcis déterministes qui ne changent pas
  • Confirmation /clear — plus d’effacements accidentels de session
  • Thème clair prédéfini en plus du thème sombre par défaut
  • Superposition d’observabilité des sous-agents — voyez quand et où les sous-agents sont lancés, en temps réel

Pour les utilisateurs qui vivent dans le terminal :

hermes --tui
# ou définissez-le de façon permanente
export HERMES_TUI=1

La TUI inclut également l’autocomplétion des commandes slash (complete.slash), l’autocomplétion des chemins (complete.path), le rendu virtualisé de l’historique pour les performances, et des dizaines de corrections. En interne, app.tsx a été décomposé en app/event-handler, app/slash-handler, app/stores et app/hooks.

Auteurs principaux : @OutThisLife + Teknium.

2. Transport ABC — Architecture de Fournisseurs Modulaire

C’est le changement architectural le plus important de cette version. Auparavant, chaque fournisseur vivait comme une logique de branchement dans run_agent.py — la conversion de format, le transport HTTP et la forme de l’API étaient tous entremêlés dans le chemin d’inférence principal. Ajouter un nouveau fournisseur signifiait modifier le cœur.

Le Transport ABC extrait tout cela dans agent/transports/, où chaque transport possède sa propre conversion de format et forme d’API :

Transport Fournisseur Objectif
AnthropicTransport Anthropic Chemin Messages API
ChatCompletionsTransport Compatible OpenAI Par défaut pour la plupart des fournisseurs
ResponsesApiTransport OpenAI Responses API + connexion Codex
BedrockTransport AWS Bedrock Transport Converse API

Pourquoi c’est important : Ajouter un nouveau fournisseur est maintenant une opération de plugin plutôt qu’un patch du cœur. C’est la base qui permet à cinq nouveaux chemins d’inférence d’arriver dans une seule version.

3. Support Natif d’AWS Bedrock

AWS Bedrock est maintenant un fournisseur de première classe via l’API Converse, construit sur le nouveau BedrockTransport. Les déploiements AWS d’entreprise n’ont plus besoin d’une passerelle tierce.

# hermes.config.yaml
providers:
  - name: bedrock-claude
    provider: bedrock
    model: us.anthropic.claude-sonnet-4-20250514-v1:0
    region: us-east-1

4. Cinq Nouveaux Chemins d’Inférence

  • NVIDIA NIM — Fournisseur natif pour les microservices d’inférence de NVIDIA
  • Arcee AI — Fournisseur direct pour les modèles spécialisés d’Arcee
  • Step Plan — Fournisseur récupéré du PR communautaire #6005
  • Google Gemini CLI OAuth — Authentifiez-vous avec Gemini via OAuth au lieu de clés API
  • Vercel ai-gateway — Avec découverte dynamique de modèles, métadonnées de prix et suivi d’attribution (@jerilynzheng)

5. GPT-5.5 via Codex OAuth

/hermes model:openai/gpt-5.5

Le modèle de raisonnement GPT-5.5 d’OpenAI est maintenant disponible via vos identifiants ChatGPT Codex OAuth. La découverte de modèles en direct est intégrée au sélecteur de modèles.

6. QQBot — 17ᵉ Plateforme de Messagerie

Adaptateur QQBot natif via QQ Official API v2 :

  • Assistant de configuration par scan QR
  • Curseur de streaming avec réactions emoji
  • Contrôle des politiques DM et groupe — parité avec les adaptateurs WeCom/Weixin

7. Surface de Plugins — Expansion Majeure

Hook / Capacité Description
register_command() Les plugins peuvent ajouter des commandes slash
dispatch_tool() Les plugins peuvent invoquer des outils depuis leur code
Blocage pre_tool_call Les plugins peuvent opposer leur veto à l’exécution d’un outil
transform_tool_result() Les plugins réécrivent les résultats des outils
transform_terminal_output() Les plugins réécrivent la sortie des outils terminal
Backends image_gen modulaires Les plugins peuvent fournir leurs propres fournisseurs d’images
Onglets personnalisés du tableau de bord Les plugins peuvent étendre le tableau de bord web
Shell hooks Connectez n’importe quel script shell comme hook de cycle de vie — sans Python

8. /steer — Correction de Trajectoire en Cours d’Exécution

/steer "Arrête d'utiliser SQLite, passe à PostgreSQL"

/steer <prompt> injecte une note que l’agent voit après son prochain appel d’outil — sans interrompre le tour ni casser le cache de prompts.

9. Délégation Plus Intelligente — Rôle d’Orchestrateur

Les sous-agents ont maintenant un rôle d’orchestrateur explicite qui peut lancer leurs propres travailleurs, avec max_spawn_depth configurable. Les sous-agents frères concurrents partagent l’état du système de fichiers via une couche de coordination de fichiers :

delegate_task:
  max_spawn_depth: 2

10. Modèles Auxiliaires — Interface Configurable

hermes model a maintenant un écran dédié “Configurer les modèles auxiliaires” pour les remplacements par tâche : modèle de compression, modèle de vision, modèle de recherche de session et modèle de génération de titres. Le routage auto utilise désormais le modèle principal pour toutes les tâches auxiliaires.

11. Tableau de Bord Web — Système de Plugins et Changement de Thème en Direct

Le tableau de bord web est maintenant extensible. Les plugins tiers peuvent ajouter des onglets, widgets et vues personnalisés.

Associé à un système de changement de thème en direct — les thèmes contrôlent les couleurs, les polices, la mise en page et la densité.

Améliorations du tableau de bord :

  • i18n (anglais + chinois) avec sélecteur de langue
  • Mise en page react-router avec barre latérale et en-tête fixe
  • Design responsive mobile
  • Support de déploiement Vercel
  • Suivi réel des appels API par session
  • Boutons de mise à jour et de redémarrage du gateway en un clic

12. Shell Hooks

hermes config set hooks.pre_tool_call "./scripts/audit.sh"
hermes config set hooks.on_session_start "./scripts/notify.sh"

Hooks supportés : pre_tool_call, post_tool_call, on_session_start, on_session_end et plus.

13. Mode de Livraison Directe des Webhooks

Les abonnements webhook peuvent maintenant transmettre les données directement à un chat de plateforme sans passer par l’agent — notifications push sans LLM pour les alertes, les vérifications de disponibilité et les flux d’événements.


Plateformes de Messagerie — Mises à Jour Majeures

Telegram

  • Variable d'environnement TELEGRAM_PROXY dédiée + support proxy dans config.yaml
  • Configuration ignored_threads pour les groupes Telegram
  • Option pour désactiver les aperçus de liens
  • Enveloppement automatique des tableaux markdown dans des blocs de code
  • Corrections : réponses dupliquées sur les flux annulés, artefacts du curseur de streaming, normalisation des tirets Unicode

Discord

  • Support des canaux de forum
  • DISCORD_ALLOWED_ROLES — contrôle d’accès basé sur les rôles
  • Option pour désactiver les commandes slash
  • send_animation natif pour la lecture de GIFs
  • Pièces jointes média dans send_message
  • Groupe de commandes /skill avec sous-commandes par catégorie

Feishu

  • Réponse intelligente sur les commentaires de documents avec contrôle d’accès à 3 niveaux
  • Affichage de l’état de traitement via des réactions sur les messages utilisateur
  • Préservation du contexte des @mentions pour l’agent

DingTalk

  • Contrôle require_mention + allowed_users — parité avec Slack/Telegram/Discord
  • Autorisation par flux appareil QR code
  • Streaming AI Cards + réactions emoji + gestion des médias

WhatsApp

  • send_voice — livraison native de messages audio
  • dm_policy et group_policy — parité avec les adaptateurs WeCom/Weixin/QQ

Autres Plateformes

  • WeCom : Création de bot par scan QR + assistant interactif
  • Signal : Support de livraison de médias via send_message
  • Slack : Sessions par fil pour les DMs par défaut
  • BlueBubbles (iMessage) : Séparation des sessions de chat de groupe, corrections webhook

Cœur du Gateway

  • Mode proxy du gateway
  • Prompts éphémères par canal (Discord, Telegram, Slack, Mattermost)
  • Commandes slash des plugins exposées nativement sur toutes les plateformes
  • Drapeau --all pour gateway start et restart
  • Correction : empêcher l’agent de détruire le gateway via le terminal

Outils et Compétences

Nouvelles Compétences

Compétence Description
concept-diagrams Générer des diagrammes de concepts système
architecture-diagram Visualisation d’architecture (portage Cocoon AI)
pixel-art Pixel art avec palettes matérielles et animation vidéo
baoyu-comic Génération d’images style bande dessinée
baoyu-infographic 21 mises en page × 21 styles pour la visualisation de données
page-agent Intégrer l’agent GUI in-page d’Alibaba dans votre webapp
fitness-nutrition Suivi nutritionnel
drug-discovery Intégration ChEMBL, PubChem, OpenFDA, ADMET
touchdesigner-mcp Intégration TouchDesigner pour le codage créatif
adversarial-ux-test Tests UX depuis une perspective adversariale

Améliorations du Système de Compétences

  • Enregistrement de compétences avec espace de noms pour les bundles de plugins
  • hermes skills reset pour débloquer les compétences groupées
  • Skills guard optionnelconfig.skills.guard_agent_created
  • Autocomplétion floue des fichiers @ avec tri par mtime
  • xitter remplacé par xurl — la CLI officielle de l’API X

Extensions d’Outils

  • Navigateur : browser_cdp — accès direct au protocole Chrome DevTools
  • Exécuter du Code : Modes d’exécution projet/strict (par défaut : projet)
  • Génération d’Images : Support FAL multi-modèle, Recraft V3→V4, GPT Image 2, fournisseur xAI
  • TTS/STT : Google Gemini TTS, xAI Grok STT, xAI TTS, KittenTTS local, bip d’enregistrement CLI
  • Cron : Porte wakeAgent pour les jobs sans LLM, enabled_toolsets par job
  • Serveur API : Événements SSE d’outils en streaming /v1/responses, entrées d’image en ligne
  • Docker/Podman : Support Podman de base, synchronisation des fichiers vers l’hôte
  • MCP : 12 améliorations de suivi d’état, gestion des timeouts et transfert d’appels d’outils

Support des Fournisseurs et Modèles

Ajout Détails
Kimi K2.6 OpenRouter, Nous Portal, Kimi natif, HuggingFace
Kimi K2.5 Promu en première position dans les listes de suggestions
Xiaomi MiMo v2.5-pro + v2.5 OpenRouter, Nous Portal et natif
Claude Opus 4.7 Catalogue Nous Portal
GLM-5V-Turbo Pour la planification de code
GPT-5 family Longueurs de contexte corrigées dans les valeurs par défaut
xAI Grok Mis à niveau vers Responses API
Ollama Support fournisseur cloud, continuation GLM, contrôle think=false
minimax-m2.5 Niveau gratuit OpenRouter

request_timeout_seconds configurable par fournisseur et modèle, agent.api_max_retries configurable, et clé de contexte ctx_size pour Lemonade server.


Boucle de l’Agent et Conversations

  • /steer <prompt> — correction de trajectoire sans casser le cache de prompts
  • Rôle d’orchestrateur + profondeur de spawn configurable
  • Coordination d’état de fichiers inter-agents pour les sous-agents concurrents
  • Améliorations du compresseur : collapse intelligent, déduplication, anti-thrashing
  • Les résumés de compression respectent la langue de la conversation
  • Auto-continuation du travail interrompu après redémarrage du gateway
  • Heartbeats d’activité empêchent les faux timeouts d’inactivité
  • PLATFORM_HINTS pour Matrix, Mattermost et Feishu

Sessions et Mémoire

  • Auto-nettoyage des anciennes sessions + VACUUM state.db au démarrage
  • Refonte de Honcho — injection de contexte, 5 outils, sécurité des coûts, isolation des sessions
  • Hindsight : métadonnées de rétention plus riches au niveau session
  • Corrections : dédupliquer les outils des fournisseurs de mémoire, découvrir les fournisseurs installés par l’utilisateur, préserver session_id dans les chaînes previous_response_id

CLI et UX

  • Autocomplétion dynamique du shell pour bash, zsh et fish
  • Thèmes mode clair + menus d’autocomplétion adaptés au thème
  • Raccourcis clavier numérotés sur les invites d’approbation et de clarification
  • Suppression du Markdown + aperçus compacts multilignes
  • Drapeaux --ignore-user-config et --ignore-rules
  • Section des limites de compte dans /usage
  • ESC annule les invites secret/sudo avec des messages plus clairs
  • Doctor : vérification d’installation de commande pour le lien symbolique hermes

Performance

  • Rendu virtualisé de l’historique dans la TUI
  • Exécution concurrente d’outils avec meilleure réponse aux interruptions
  • Auto-nettoyage des sessions + VACUUM garde la base de données légère
  • Changement de session plus rapide avec chargement différé des adaptateurs

Sécurité et Fiabilité

  • Interrupteur global pour autoriser la résolution d’URL privées/internes — désactivé par défaut
  • Empêcher l’agent de détruire le gateway via le terminal
  • Autorisation de callback Telegram sur les invites de mise à jour
  • SECURITY.md ajouté au dépôt
  • Récupération complète des UnicodeEncodeError en locale ASCII
  • Empêcher les fuites d’os.environ obsolètes après clear_session_vars
  • Empêcher le blocage de l’agent lors de la mise en arrière-plan via l’outil terminal
  • Avertir sur les unités hermes.service héritées lors de hermes update

Mise à Niveau

hermes update

C’est une mise à niveau non destructive. Les profils existants continuent de fonctionner tels quels. Si vous passez beaucoup de temps en sessions interactives, essayez la nouvelle TUI avec hermes --tui. Si vous déployez sur AWS, testez le transport Bedrock avec vos prompts existants.

Pour les nouvelles installations, consultez le guide d’installation.


Changelog complet sur GitHub

← Hermes Agent Changelog