Reddit et RSS sans navigateur : Hermes lit les communautés et les flux depuis n'importe quel serveur

C’est mercredi soir et vous rédigez votre rapport hebdomadaire. « Que dit vraiment la communauté de ce nouveau framework ? » — vous aimeriez bien le savoir. Puis la réalité vous rattrape : si Hermes tourne sur un serveur, Reddit est de fait inutilisable depuis cette IP — le site affiche un mur « Prouvez que vous êtes humain », les endpoints .json répondent 403, et chaque contournement revient au même cul-de-sac. RSS ne fait guère mieux : il faut soit installer un lecteur, soit bricoler son propre analyseur pour une dizaine de dialectes XML. Tout ce canal d’information reste dans le noir, et la « recherche » devient un exercice de devinettes. Deux skills incluses sont arrivées sur la branche main de Hermes le 5 septembre 2026 et règlent exactement ce problème : rss-feeds transforme les flux RSS / Atom / JSON en une liste propre et triée par date, et reddit-reading lit Reddit sans navigateur ni compte — les deux sont livrées avec l’agent, zéro installation, zéro configuration.
Que font ces deux skills, en clair
Dans Hermes, les skills sont des manuels d’utilisation logés dans la tête de l’agent : quand une situation pertinente se présente, l’agent charge le manuel et en suit les étapes. Ces deux nouvelles venues sont des skills incluses — elles sont livrées avec Hermes et fonctionnent immédiatement, contrairement aux skills optionnelles qui exigent d’abord une commande d’installation.
- rss-feeds : lit les formats RSS 2.0, RSS 1.0/RDF, Atom et JSON Feed, et renvoie une liste propre, des plus récentes aux plus anciennes (titre, lien, heure de publication UTC, auteur, résumé). Bibliothèque standard uniquement — rien à installer. Donnez-lui l’URL d’une page ordinaire et elle peut même découvrir le flux caché derrière cette page.
- reddit-reading : lit les listes de subreddits, la recherche sur tout le site ou dans un subreddit, les threads complets avec leurs commentaires, et l’activité des utilisateurs. Elle ne publie pas, ne vote pas et ne se connecte pas à votre place — strictement en lecture seule.
Les cas d’usage s’écrivent d’eux-mêmes : le pouls de la communauté (« que dit r/LocalLLaMA de ce modèle ? »), la surveillance des releases via le releases.atom de GitHub, ou la transformation des dix sites que vous « consultez chaque jour » en un digest programmé.
RSS : de « installer un lecteur » à « il suffit de demander »
Vous parlez à Hermes en langage naturel — aucune syntaxe de commande à mémoriser :
« Quelles versions ce dépôt GitHub a-t-il publiées récemment ? » « Résume-moi les derniers articles publiés sur https://simonwillison.net/ » « Envoie-moi chaque matin à 9 h les nouveaux articles arXiv cs.CL. »
Sous le capot, la skill exécute un petit script compagnon. Pointez-le vers n’importe quel flux RSS/Atom/JSON — ou vers une simple page d’accueil, et il découvre le flux pour vous :
python3 scripts/feed.py read https://github.com/NousResearch/hermes-agent/releases.atom --limit 5
python3 scripts/feed.py read https://simonwillison.net/ # page URL → feed auto-discovered
python3 scripts/feed.py read URL --since 2026-09-01 --json # only entries newer than a date
python3 scripts/feed.py discover https://example.com/ # list candidate feed URLs on a page
Chaque entrée revient avec title / link / published (UTC) / author / summary — HTML retiré, résumés plafonnés à 2 000 caractères, tri des plus récentes aux plus anciennes. Le script connaît par cœur les motifs d’URL de flux les plus courants :
| Ce que vous voulez | URL du flux |
|---|---|
| Releases / commits / tags GitHub | https://github.com/OWNER/REPO/releases.atom, …/commits/BRANCH.atom |
| Un subreddit | https://www.reddit.com/r/NAME/.rss |
| Une chaîne YouTube | https://www.youtube.com/feeds/videos.xml?channel_id=UC… |
| Hacker News | https://hnrss.org/frontpage, https://hnrss.org/newest?q=term |
| Articles arXiv | https://rss.arxiv.org/rss/cs.CL |
| Substack / Medium / WordPress / Ghost | /feed du site, medium.com/feed/@user, etc. |
Deux détails méritent qu’on s’y attarde. D’abord, pour les digests programmés, utilisez --since pour ne récupérer que ce qui est plus récent que votre dernier passage — conservez la valeur published la plus récente de la passe précédente et repassez-la la fois suivante : vous obtenez une déduplication naturelle sans rescanner toute la page d’accueil (ça s’associe très bien à l’automatisation cron de Hermes). Ensuite, les résumés de flux sont souvent tronqués ou limités au premier paragraphe — pour l’article complet, confiez le link d’une entrée à web_extract.
Reddit : lisible depuis une IP de serveur, sans connexion
Vous avez sans doute essayé : depuis un VPS, reddit.com/…/.json répond 403, tout comme api.reddit.com et old.reddit.com ; imiter un User-Agent de navigateur donne toujours 403 ; même les proxys façon r.jina.ai et les outils de navigateur butent sur un mur « bloqué par la sécurité réseau » façon test anti-humain. Reddit ferme presque toutes les portes non authentifiées aux IP de datacenter — sauf ses propres flux Atom publics. C’est le backend par défaut de reddit-reading : les endpoints .rss de Reddit, anonymes et sans connexion, au prix d’un fort bridage (environ une requête par minute et par IP) et de données plus minces (publication + commentaires de premier niveau, sans les scores).
Besoin de lectures plus fréquentes ou plus complètes (une surveillance soutenue d’un subreddit, par exemple) ? Il existe une mise à niveau optionnelle gratuite : enregistrez une application de type « script » dans la page de paramètres des applications de Reddit, puis placez ses deux valeurs dans ~/.hermes/.env :
REDDIT_CLIENT_ID=...
REDDIT_CLIENT_SECRET=...
Un malentendu courant mérite d’être levé : il s’agit d’un enregistrement d’application, pas d’une connexion utilisateur. Le script n’utilise que la subvention client_credentials, réservée aux applications — jamais votre nom d’utilisateur, votre mot de passe ni les cookies de votre navigateur, et il n’agit jamais à votre place. Une fois les deux valeurs renseignées, il bascule automatiquement sur l’API OAuth (~100 requêtes par minute, commentaires imbriqués, scores, nombres de commentaires) ; si elles manquent ou sont rejetées, il retombe sur les flux anonymes. Comparaison côte à côte :
| Anonyme (par défaut) | Identifiants d’application OAuth | |
|---|---|---|
| Mise en place | rien | enregistrement d’application gratuit, deux valeurs dans .env |
| Limite de débit | ~1 requête / minute / IP | ~100 requêtes / minute |
| Données des threads | publication + commentaires de premier niveau, sans scores | commentaires imbriqués, scores, nombres de commentaires |
| Agit comme un utilisateur | non | non |
Là encore, le langage naturel est l’interface principale (« de quoi parle r/LocalLLaMA en ce moment ? ») ; les commandes sous-jacentes ressemblent à ceci :
python3 scripts/reddit.py doctor # active backend + rate-limit window
python3 scripts/reddit.py sub LocalLLaMA --sort hot --limit 15
python3 scripts/reddit.py search "hermes agent" --sub LocalLLaMA --sort new
python3 scripts/reddit.py thread <post-url> --limit 40 # post + comment tree
python3 scripts/reddit.py user spez --limit 10
Si vous n’avez pas lancé doctor dans cette session, faites-le d’abord : il vous dit quel backend est actif et combien de secondes restent dans la fenêtre anonyme, pour ne pas planifier une campagne de recherche en cinq appels qui viendrait heurter le bridage (le mode anonyme autorise environ une requête par minute ; sur un 429, le script attend la fin de la fenêtre puis réessaie une fois).
« Que disent les gens de X ? » : une question, cinq pistes
Chaque skill est utile seule ; la chimie naît de la combinaison. Les deux ont été câblées dans la chaîne de recherche de Hermes — grounded-citations et competitor-news-monitor les listent désormais parmi leurs skills apparentées. Résultat : quand vous demandez « que disent les gens de X en ce moment ? », Hermes éventaille la question sur plusieurs pistes — recherche web, discussion Reddit, flux, vidéo, code — et cite chaque affirmation en la ramenant à son lien d’origine (le permalien du thread, pas la page de liste), pour que vous puissiez cliquer et vérifier. Comparé à une recherche limitée au web, ce balayage multiplateforme a bien moins de chances de manquer ce qu’une communauté dit vraiment.
Les limites à connaître avant de s’y fier
- Strictement en lecture seule : reddit-reading ne publie pas, ne vote pas, n’envoie pas de message et ne fait rien qui exige une connexion utilisateur. Faire écrire Hermes sur Reddit est une autre histoire, hors du périmètre de cette skill.
- Ne vous battez pas contre les 403 : depuis des IP de datacenter,
.json,api.reddit.cometold.reddit.comsont des impasses, et l’usurpation de User-Agent ne vous sauvera pas ;r.jina.aiest bloqué lui aussi. Restez sur le canal par défaut de la skill. La voie Wayback deblocked-page-recoveryne peut sauver que les vieux threads archivés — elle ne peut pas récupérer les frais. - Le bridage est voulu : la limite d’environ 1 requête/min en mode anonyme est une règle de Reddit ; le script attend la fin de la fenêtre. Mais si vous avez besoin de lectures soutenues à fort volume (surveillance, dizaines d’appels), enregistrez plutôt les identifiants d’application gratuits que d’empiler les nouvelles tentatives.
- Gardez le secret hors des discussions :
REDDIT_CLIENT_SECRETne vit que dans.env, lu depuis l’environnement — ne le collez jamais dans une conversation ni dans un journal. - Statut de publication : les deux skills ont été fusionnées sur
mainle 5 septembre 2026 — après v0.21.0 (publié le 31 août) — elles ne sont donc disponibles que surmainpour l’instant et voyageront avec la prochaine release ; le programme de mise à jour de Hermes embarque les skills incluses avec lui. Pour les essayer dès aujourd’hui, lancez une installation qui suit lamainla plus récente.
Pour conclure
« Lire la communauté » était l’une des choses les plus malcommodes à faire depuis un agent hébergé sur serveur — Reddit dresse des murs à chaque tournant, et RSS imposait de réinventer la roue. Désormais, ce sont deux skills zéro installation qui voyagent avec l’agent : RSS couvre la largeur (GitHub, HN, arXiv, blogs, podcasts), Reddit couvre la profondeur (subreddits, recherche, threads, utilisateurs), et le balayage de recherche auto-éventail avec citation de chaque affirmation permet enfin de confier entièrement le suivi du pouls de l’industrie. Et si vous vous appuyez déjà sur les canaux de recherche gratuits de Hermes, cette combinaison web + communautés + flux boucle la boucle de la veille quotidienne.