v0.8.0

Hermes Agent v0.8.0 — La version Intelligence


Aperçu

v0.8.0 — The Intelligence Release. Publiée le 8 avril 2026. Seulement 5 jours après la v0.7.0 : 209 PRs fusionnées · 82 problèmes résolus · des centaines de fichiers modifiés · des dizaines de contributeurs de la communauté.

Si la v0.7.0 était « la version résilience » (fournisseurs de mémoire interchangeables, navigateur anti-détection Camofox, renforcement profond du Gateway), la v0.8.0 vise un seul objectif — devenir plus intelligent. Hermes a appris à diagnostiquer ses propres modes de défaillance et à s’auto-corriger. Il a appris à vous notifier lorsque les tâches en arrière-plan se terminent. Il a appris à suivre l’activité réelle des outils plutôt que le temps écoulé pour décider s’il doit expirer. Ce ne sont pas de simples ajouts de fonctionnalités. C’est une amélioration systématique de l’intelligence de l’agent.


Fonctionnalités Majeures

1. Notifications Automatiques des Tâches en Arrière-Plan (notify_on_complete) — Fini le Polling

Les tâches en arrière-plan notifient désormais automatiquement l’agent lorsqu’elles se terminent. Lancez un processus long — entraînement de modèle, suites de tests, déploiements, builds — et l’agent récupère les résultats à la fin. Plus besoin de ps, de tail -f, ni de boucles de polling. L’agent vous dit simplement quand c’est terminé.

# Démarrer un job d'entraînement en arrière-plan
hermes run "python train.py --epochs 100" --background

# Continuer à travailler sur autre chose avec l'agent
# Quand l'entraînement se termine, l'agent est notifié et rapporte les résultats

(#5779)

2. Xiaomi MiMo v2 Pro Gratuit sur le Portail Nous

Le niveau gratuit du portail Nous inclut désormais Xiaomi MiMo v2 Pro pour les tâches auxiliaires — compression, vision, résumé. L’interface de sélection de modèle affiche les prix à côté de chaque modèle, et la limitation du niveau gratuit est transparente. Si vous hésitiez à utiliser Hermes parce que votre portefeuille était à sec, cette semaine le niveau gratuit s’est nettement amélioré.

(#6018, #5880)

3. Changement de Modèle en Direct (Commande /model) — Changez de Modèle en Pleine Session

Changez de modèle et de fournisseur en pleine session depuis le CLI, Telegram, Discord, Slack ou toute plateforme Gateway. Le résolveur est conscient de l’agrégateur — si vous êtes sur OpenRouter ou le portail Nous, il vous maintient sur l’agrégateur quand le modèle y est disponible, ne basculant vers les fournisseurs directs qu’en cas de besoin. Telegram et Discord bénéficient de sélecteurs interactifs à boutons — appuyez pour sélectionner, pas besoin de taper.

# Changer à tout moment pendant une session
/model claude-sonnet-4-20250514

# Ou ouvrir le sélecteur interactif
/model

(#5181, #5742)

4. Guidance d’Outils GPT/Codex Auto-Optimisée — L’Agent s’est Auto-Corrigé

C’est la PR la plus fascinante techniquement de la v0.8.0. L’équipe a construit un pipeline automatisé d’analyse comportementale qui a testé systématiquement les modèles GPT et Codex, identifié cinq modes de défaillance spécifiques dans l’appel d’outils, généré des chaînes de guidance ciblées pour les corriger, mesuré l’amélioration, et intégré le résultat dans le prompt système. L’agent s’est diagnostiqué lui-même et s’est auto-corrigé — les humains sont intervenus comme réviseurs, pas comme ingénieurs de prompt.

Associées à cela, des guidances de discipline d’exécution dans les prompts système et une continuation de préremplissage thinking-only pour le raisonnement structuré, le tout améliorant considérablement la fiabilité lors de l’utilisation d’Hermes avec les modèles OpenAI.

(#6120, #5414, #5931)

5. Fournisseur Natif Google AI Studio (Gemini)

Accès direct aux modèles Gemini via l’API Google AI Studio. Intégré au registre models.dev pour la détection automatique en temps réel de la longueur de contexte — plus besoin de spécifier manuellement les limites de tokens.

(#5577)

6. Timeouts Intelligents Basés sur l’Inactivité — Les Agents Actifs ne Sont Jamais Tués

Les timeouts du Gateway et du cron suivent désormais l’activité réelle des outils au lieu du temps écoulé. Les tâches longues qui produisent activement des résultats (exécution de commandes, lecture/écriture de fichiers) ne seront jamais interrompues. Seuls les agents véritablement inactifs expirent.

(#5389, #5440)

7. Boutons d’Approbation sur Slack et Telegram — Dites Adieu à /approve

Les approbations de commandes dangereuses passent désormais par des boutons natifs de la plateforme. Slack préserve le contexte du fil de discussion, Telegram affiche des réactions emoji pour le statut d’approbation. Bien plus rapide que de taper /approve à chaque fois.

(#5890, #5975)

8. MCP OAuth 2.1 PKCE + Analyse de Malwares OSV

Client OAuth 2.1 PKCE entièrement conforme aux standards pour l’authentification des serveurs MCP. De plus, les packages d’extension MCP sont automatiquement analysés contre la base de données de vulnérabilités OSV lors de l’installation — détectant le code malveillant avant qu’il ne s’exécute.

(#5420, #5305)

9. Journalisation Centralisée et Validation de Configuration

Journalisation structurée vers ~/.hermes/logs/ (agent.log + errors.log), avec la nouvelle commande hermes logs pour le suivi et le filtrage. La validation de la structure de configuration détecte les YAML malformés au démarrage avec des messages d’erreur exploitables — fini les « crashs mystérieux ».

# Voir les logs récents
hermes logs

# Erreurs uniquement
hermes logs --level WARNING

(#5430, #5426)

10. Expansion du Système de Plugins

Les plugins peuvent désormais :

  • Enregistrer des sous-commandes CLI autonomes sans toucher au code cœur
  • Recevoir des hooks API à portée de requête avec des identifiants de corrélation
  • Demander les variables d’environnement requises lors de l’installation
  • S’accrocher aux événements du cycle de vie de session (finalisation / réinitialisation)

(#5295, #5427, #5470, #6129)

11. Matrix Promu au Niveau 1

Matrix bénéficie désormais des réactions, des accusés de lecture, du formatage riche et de la gestion des salons — atteignant la parité fonctionnelle avec Telegram et Discord en tant que plateforme de premier niveau.

12. Passage de Renforcement Sécuritaire

Protections SSRF, atténuations des attaques temporelles, prévention de traversée tar, garde-fous contre les fuites d’identifiants, isolation inter-sessions — un audit de sécurité systématique sur l’ensemble du code.

(#5944, #5613, #5629)


Agent Cœur et Architecture

Support des Fournisseurs et Modèles

  • Fournisseur natif Google AI Studio (Gemini) avec détection automatique models.dev de la longueur de contexte
  • Commande /model — refonte complète du système fournisseur+modèle avec changement en direct sur le CLI et tous les Gateways
  • Sélecteur de modèle interactif pour Telegram et Discord avec boutons intégrés
  • Limitation du niveau gratuit du portail Nous avec affichage des prix dans la sélection de modèle
  • Cache de prompt xAI (Grok) via l’en-tête x-grok-conv-id
  • Fournisseur TTS MiniMax (speech-2.8)
  • Avertissement pour modèle non-agentic — alerte lors du chargement de LLMs Hermes non conçus pour l’utilisation d’outils
  • Auth Ollama Cloud, persistance de changement de modèle, complétion par tabulation des alias
  • Affichage des prix des modèles pour OpenRouter et le portail Nous
  • Repli de paiement du client auxiliaire — réessayer avec le fournisseur suivant en cas d’erreur 402
  • Le client auxiliaire résout les fournisseurs personnalisés nommés et l’alias ‘main’
  • Fenêtres de réinitialisation des identifiants fournisseur respectées dans le basculement groupé
  • Synchronisation des tokens OAuth entre le pool d’identifiants et le fichier d’identifiants
  • Les identifiants OAuth périmés ne bloquent plus la détection automatique d’OpenRouter
  • Pool d’identifiants OAuth Codex — corrections de déconnexion et d’import de tokens expirés
  • La détection automatique de vision essaie d’abord le fournisseur principal
  • Longueurs de contexte MiniMax, garde de réflexion, modèle auxiliaire, corrections de base_url de configuration
  • Détection automatique du endpoint Z.AI via sondage et cache
  • Corrections communautaires de résolution fournisseur/modèle — 4 PRs communautaires récupérées

Boucle d’Agent et Conversation

  • Guidance d’outils GPT/Codex auto-optimisée — l’analyse comportementale automatisée a identifié et corrigé 5 modes de défaillance
  • Guidance de discipline d’exécution GPT/Codex dans les prompts système
  • Continuation de préremplissage thinking-only pour le raisonnement structuré
  • Accepter les réponses reasoning-only sans nouvelles tentatives — définit le contenu à “(empty)” au lieu de réessayer indéfiniment
  • Backoff de nouvelle tentative avec gigue — backoff exponentiel avec gigue pour les nouvelles tentatives API
  • Gestion intelligente des signatures de bloc thinking — préserve les signatures thinking d’Anthropic à travers les tours
  • Forcer les arguments d’appel d’outil à correspondre aux types JSON Schema — corrige les modèles qui envoient des chaînes au lieu de nombres/booléens
  • Sauvegarder les résultats d’outils surdimensionnés dans un fichier au lieu d’une troncature destructive
  • Repli de streaming amélioré après les échecs d’édition
  • Lacunes de sortie vide Codex couvertes dans le repli + normalisateur + client auxiliaire
  • Remplissage de la sortie de flux Codex à partir des événements output_item.done
  • Le consommateur de flux crée un nouveau message après les limites d’outil
  • Filtrer les rôles transcript-only du payload chat-completions
  • Assainir tool_calls pour toutes les API strictes (Fireworks, Mistral, etc.)
  • Relier tool-calls dans l’adaptateur copilot-acp

Mémoire et Sessions

  • Fournisseur de mémoire Supermemory — multi-conteneur, search_mode, template d’identité, remplacement par variable d’environnement
  • Sessions de thread partagées par défaut — support multi-utilisateur sur les plateformes Gateway
  • Sessions de sous-agent liées au parent et masquées de la liste des sessions
  • Isolation de mémoire à portée de profil et support de clonage
  • Transmettre le user_id du thread Gateway aux plugins de mémoire pour la portée par utilisateur
  • Refonte du plugin Honcho + système d’enregistrement CLI des plugins
  • Compatibilité API mem0 v2, clôture de contexte de prefetch, masquage des secrets
  • RetainDB — routes API, file d’écriture, dialectique, corrections de modèle d’agent
  • Refonte du plugin de mémoire Hindsight + corrections de l’assistant de configuration mémoire
  • Filet de sécurité atexit OpenViking pour la validation de session, en-têtes de portée de locataire
  • La requête brv de ByteRover s’exécute de manière synchrone avant l’appel LLM
  • Message utilisateur nettoyé utilisé pour toutes les opérations de fournisseur de mémoire

Plateformes de Messagerie (Gateway)

Cœur du Gateway

  • Timeout basé sur l’inactivité remplace le temps écoulé — les tâches actives ne sont jamais tuées
  • Boutons d’approbation pour Slack et Telegram + préservation du contexte de thread Slack
  • Diffusion en direct /update + transmission des prompts interactifs à l’utilisateur
  • Support de timeout infini + notifications périodiques + messages d’erreur exploitables
  • Prévention des messages en double — déduplication Gateway + garde de flux partiel
  • Persistance delivery_info du webhook + identifiant complet de session dans /status
  • Troncature d’aperçu d’outil respecte tool_preview_length dans tous les modes de progression et nouveaux modes
  • Clé de session d’approbation isolée par tour
  • Contournement de la garde de session active pour /approve, /deny, /stop, /new
  • Indicateur de frappe mis en pause pendant les attentes d’approbation
  • Vérification de légende utilise une correspondance exacte ligne par ligne au lieu de sous-chaîne (toutes les plateformes)
  • Balises MEDIA: supprimées des messages Gateway streamés, extraites de la livraison cron
  • Unités de service conscientes du profil + nettoyage de transcription vocale
  • PairingStore thread-safe avec écritures atomiques
  • Wrappers de méthode statique cron pour empêcher l’auto-liaison

Améliorations par Plateforme

Plateforme Changements Clés
Telegram Liaison de compétences aux sujets de groupe, approbations par réaction emoji, prévention des messages en double, assainissement des noms de commande, compétences désactivables par plateforme
Discord Contrôles de canal (ignored_channels / no_thread_channels), compétences en tant que commandes slash natives, /approve enregistré comme commandes slash, intention membres inutile supprimée
Slack Engagement automatique des threads, mrkdwn dans edit_message, réponses aux threads sans @mentions
Matrix Passage au Niveau 1 : réactions, accusés de lecture, formatage riche, gestion des salons, saisie CJK, E2EE, reconnexion
Signal Livraison complète des balises MEDIA:
Mattermost Support des pièces jointes
Feishu Boutons d’approbation par carte interactive, corrections de reconnexion + ACL
Webhooks Token de template {__raw__}, transmission de thread_id pour les sujets de forum

CLI et Expérience Utilisateur

CLI Interactif

  • Différer le contenu de la réponse jusqu’à ce que le bloc de raisonnement soit terminé
  • Lignes fantômes de la barre d’état nettoyées lors du redimensionnement du terminal
  • Normaliser les fins de ligne \r\n et \r dans le texte collé
  • Support natif du collage d’images Windows
  • --yolo et autres flags ne sont plus silencieusement ignorés lorsqu’ils sont placés avant la sous-commande ‘chat’
  • Erreurs ChatConsole, défilement curses, bannière sensible au skin, corrections d’état git

Installation et Configuration

  • Validation de la structure de configuration — détecte les YAML malformés au démarrage avec des messages exploitables
  • Journalisation centralisée vers ~/.hermes/logs/ (agent.log + errors.log) avec la commande hermes logs
  • Diagnostics Doctor — vérifications synchronisées des fournisseurs, migration de configuration, diagnostics WAL et mem0
  • Journalisation de débogage des timeouts et diagnostics utilisateur améliorés
  • Effort de raisonnement unifié dans config.yaml uniquement
  • Liste blanche permanente des commandes chargée au démarrage
  • hermes auth remove efface désormais définitivement les identifiants issus de l’environnement
  • Compétences groupées synchronisées sur tous les profils lors de la mise à jour
  • hermes update ne tue plus le service Gateway fraîchement redémarré
  • Timeouts Subprocess.run() ajoutés à toutes les commandes CLI du Gateway
  • Liens de documentation ajoutés aux sections de l’assistant de configuration

Système Cron

  • Timeout cron basé sur l’inactivité — les tâches actives s’exécutent indéfiniment
  • Injection de script pré-exécution pour la collecte de données et la détection de changements
  • Suivi des échecs de livraison dans le statut du job
  • Guidance de livraison dans les prompts cron — empêche le thrashing de send_message
  • Fichiers MEDIA livrés en tant que pièces jointes natives de la plateforme
  • Suppression [SILENT] fonctionne n’importe où dans la réponse
  • Renforcement contre la traversée de chemin cron

Système d’Outils

Terminal et Exécution

  • Execute_code sur des backends distants — Docker, SSH, Modal et autres backends de terminal distants
  • Contexte de code de sortie pour les outils CLI courants — aide l’agent à comprendre ce qui a échoué
  • Découverte progressive d’indices de sous-répertoires — l’agent apprend la structure du projet en naviguant
  • notify_on_complete pour les processus en arrière-plan
  • Configuration Docker env — variables d’environnement de conteneur explicites via docker_env
  • Métadonnées d’approbation incluses dans les résultats des outils de terminal
  • Paramètre workdir assaini sur tous les backends
  • Changement de fournisseur de navigateur géré de Browserbase à Browser Use
  • Fournisseur de navigateur cloud Firecrawl
  • Évaluation JS via le paramètre d’expression browser_console
  • Corrections du navigateur Windows

MCP

  • MCP OAuth 2.1 PKCE — client OAuth entièrement conforme aux standards
  • Vérification de malwares OSV pour les packages d’extension MCP
  • Préférer structuredContent à text + sentinelle no_mcp
  • Avertissement de jeux d’outils inconnus supprimé pour les noms de serveur MCP

Web et Fichiers

  • Support des documents .zip + montage automatique des répertoires de cache dans les backends distants
  • Masquage des secrets de requête dans les erreurs send_message

Délégation

  • Partage de pool d’identifiants + indices de chemin workspace pour les sous-agents

ACP (VS Code / Zed / JetBrains)

  • Améliorations ACP agrégées — compatibilité auth, corrections de protocole, annonces de commande, délégation, événements SSE

Écosystème de Compétences

Système de Compétences

  • Interface de configuration des compétences — les compétences peuvent déclarer des paramètres config.yaml requis, demandés lors de l’installation, injectés au chargement
  • Système d’enregistrement CLI des plugins — les plugins enregistrent leurs propres sous-commandes CLI sans toucher à main.py
  • Hooks API à portée de requête avec identifiants de corrélation d’appel d’outil pour les plugins
  • Hooks de cycle de vie de session — on_session_finalize et on_session_reset pour CLI + Gateway
  • Demande des variables d’environnement requises lors de l’installation du plugin
  • Validation du nom des plugins — rejette les noms qui résolvent vers la racine des plugins
  • Contexte de plugin pre_llm_call déplacé vers le message utilisateur pour préserver le cache de prompt

Compétences Nouvelles et Mises à Jour

  • popular-web-designs — 54 systèmes de design de sites web en production
  • p5js creative coding
  • manim-video — animations mathématiques et techniques
  • llm-wiki — LLM Wiki de Karpathy
  • gitnexus-explorer — indexation de codebase et diffusion de connaissances
  • research-paper-writing — patterns AI-Scientist et GPT-Researcher
  • blogwatcher mis à jour vers le fork JulienTant
  • Compétence Claude Code réécriture complète v2.0 + v2.2
  • Documents de référence Manim CE étendus — géométrie, animations, LaTeX
  • Compétences de vérification de code consolidées en une seule

Sécurité et Fiabilité

Renforcement de la Sécurité

  • Sécurité consolidée — protections SSRF, atténuations des attaques temporelles, prévention de traversée tar, garde-fous contre les fuites d’identifiants
  • Isolation inter-sessions + renforcement contre la traversée de chemin cron
  • Paramètre workdir assaini dans l’outil terminal sur tous les backends
  • Escalade de session d’approbation ‘once’ empêchée + validation de la plateforme de livraison cron
  • Tokens OAuth Google Workspace à portée de profil protégés

Fiabilité

  • Nettoyage agressif des worktrees et branches pour empêcher l’accumulation
  • Backtracking catastrophique O(n²) dans la regex de masquage corrigé — amélioration de 100x sur les grandes sorties
  • Corrections de stabilité d’exécution dans les outils cœur, web, délégation et navigateur
  • Correction de streaming du serveur API + support de l’historique de conversation
  • Chemins de endpoints API OpenViking et analyse des réponses corrigés

Corrections de Bugs Notables

  • 9 corrections de bugs communautaires récupérées — Gateway, cron, dépendances, launchd macOS en un seul lot
  • Lot de corrections cœur — config de modèle, réinitialisation de session, repli d’alias, launchctl, délégation, écritures atomiques
  • Lot de corrections Gateway/plateforme — E2EE Matrix, saisie CJK, navigateur Windows, reconnexion Feishu + ACL
  • Suppression des sauts de tests obsolètes, backtracking regex, bug de recherche de fichiers et fragilité des tests
  • Nix flake — lecture de version, regénération de uv.lock, ajout de hermes_logging
  • Tests de régression de masquage de variables en minuscules

Tests

  • 57 tests CI défaillants réparés dans 14 fichiers
  • Réarchitecture de la suite de tests + corrections des échecs CI
  • Nettoyage du lint à l’échelle du code — imports inutilisés, code mort et patterns inefficaces
  • Outil browser_close supprimé — le nettoyage automatique le gère

Documentation

  • Audit complet de la documentation — correction des informations obsolètes, étoffement des pages légères, ajout de profondeur
  • Plus de 40 divergences corrigées entre la documentation et le code
  • 13 fonctionnalités documentées issues des PRs de la semaine dernière
  • Refonte de la section Guides — correction des guides existants + ajout de 3 nouveaux tutoriels
  • 4 PRs de documentation récupérées — configuration Docker, validation post-mise à jour, guide LLM local, installation signal-cli
  • Référence de configuration Discord
  • Entrées FAQ communautaires pour les workflows courants et le dépannage
  • Guide réseau WSL2 pour les serveurs de modèles locaux
  • Référence CLI Honcho + documentation d’enregistrement CLI des plugins
  • Configuration Obsidian Headless pour les serveurs dans llm-wiki
  • Éditeur visuel de skin Hermes Mod ajouté à la page des skins

Mise à Niveau

hermes update

Pour les nouvelles installations, consultez le guide d’installation.


Changelog complet sur GitHub

← Hermes Agent Changelog