Hermes Agent Lab

Blog Hermes Agent — Guides Pratiques et Analyses

Derniers articles et perspectives.

Hermes réinvente l'automatisation du navigateur : un seul browser_exec remplace 12 outils et divise par deux la consommation de tokens

Hermes intègre désormais un mode Browser Use CLI 3.0 : réglez browser.backend sur browser-use dans votre config et la douzaine de micro-outils browser_* se fond en un seul outil browser_exec qui exécute du code Python directement dans le navigateur. Les benchmarks officiels affichent une consommation totale de tokens réduite de 48 % à 66 % sur les tâches web multi-étapes, à précision égale. Voici comment le configurer, comment écrire du code pour lui, et comment il s'articule avec vos backends navigateur existants.

Lire la suite

Les images Hermes ne sont plus floues : le guide complet de la mise à l'échelle automatique dans image_generate et video_generate

Les fonctions image_generate et video_generate d'Hermes disposent désormais d'une mise à l'échelle intégrée : les modèles d'images FAL sous 2MP sont agrandis par défaut, Krea enchaîne Enhance, et la vidéo peut opter pour SeedVR2 en 2×. Voici comment fonctionnent les valeurs par défaut, comment utiliser le paramètre upscale et ce que cela coûte.

Lire la suite

Surveillez vos concurrents en pilote automatique avec Hermes : lancements, tarifs, levées de fonds — plus rien ne vous échappe

Hermes intègre désormais un skill `competitor-news-monitor` qui surveille les newsrooms, les pages tarifaires, les dépôts réglementaires et les pages de statut, déduplique par événement sous-jacent, évalue la matérialité et livre un digest sourcé selon un planning. Voici comment il fonctionne et comment le configurer de zéro.

Lire la suite

Hermes a « oublié » 798 messages après un crash — le bug d'amnésie de session, expliqué et corrigé

Le DM Telegram de Teknium lui-même a remonté le temps de 2,7 jours après un redémarrage du gateway : 798 messages réels ont fini dans une orphan session sans identité. Cause racine, correctif et comment récupérer vos données.

Lire la suite

Hermes Agent : chaîne de répertoires des fichiers de contexte — tous les AGENTS.md de la racine git au CWD, fusionnés automatiquement

Hermes Agent fusionne désormais chaque AGENTS.md, de la racine du dépôt git en passant par tous les répertoires intermédiaires jusqu'à votre répertoire de travail, dans le prompt système au démarrage de la session : les conventions de tout le dépôt d'abord, les spécificités des répertoires profonds en dernier (priorité la plus haute), avec des labels de provenance, la déduplication du contenu et des plafonds de budget. Comment fonctionne la chaîne, le système de priorité des fichiers de contexte, et comment structurer AGENTS.md dans un monorepo.

Lire la suite

Hermes a corrigé 4 bugs sournois en une journée : pièces jointes, API Keys, mises à jour, recherche

Le 9 août 2026, Hermes Agent a corrigé quatre bugs profonds et difficiles à repérer en une seule journée de merge : des pièces jointes disparaissant silencieusement des réponses gateway en file d'attente, un changement de modèle qui lisait la clé API d'un autre profile, des processus backend orphelins bloquant les mises à jour du desktop Windows, et une recherche de sessions renvoyant des résultats vides pour des requêtes courantes avec caractères spéciaux. Chaque correctif est expliqué avec un cas réel.

Lire la suite

Variables de contexte de configuration MCP de Hermes Agent : ${userHome}, ${workspaceFolder} et 3 autres variables de style Cursor

Les configurations de serveurs MCP de Hermes Agent interpolent désormais les variables de contexte de style Cursor — ${userHome}, ${workspaceFolder}, ${workspaceFolderBasename}, ${pathSeparator} et ${/}. Les configurations MCP copiées depuis Cursor fonctionnent sans modification, et vous n'aurez plus jamais à coder en dur des chemins absolus. Exemples complets et règles de résolution à l'intérieur.

Lire la suite

Mise à niveau du cron de Hermes Agent : monitor-mode, notepad et validation preflight

Le cron de Hermes Agent s'enrichit de trois nouveaux outils : monitor-mode supprime les exécutions planifiées inchangées (même hash) pour un coût LLM de zéro ; notepad offre à chaque tâche un bloc-notes clé/valeur durable entre les exécutions ; preflight valide la configuration de la tâche avant toute construction de l'agent — une tâche cassée prévient une seule fois et ne brûle jamais de tokens. Exemples CLI réels et clés de configuration inclus.

Lire la suite

Hermes sait désormais lire les documents PDF, Word, Excel, EPUB et RTF : guide pratique

Des notebooks Jupyter aux contrats Word, en passant par les rapports Excel, les ebooks EPUB et les fichiers RTF hérités — le read_file d'Hermes les convertit désormais tous en Markdown propre, lisible directement. Cet article explique la répartition entre les extracteurs intégrés et l'extension optionnelle anydoc, le mécanisme d'installation paresseuse (lazy install), le chemin OCR pour les documents scannés, la gestion des URLs et des scénarios concrets pour chaque type de document.

Lire la suite

hermes verify : la commande qui répond à « est-ce que ce projet tourne vraiment ? »

Le nouveau sous-commande hermes verify de Hermes Agent détecte automatiquement le type de votre projet (Node/Python/Go/Rust/Java/Make/docker-compose), enchaîne bootstrap → build → test → start → sondage de readiness, et renvoie un verdict structuré de réussite ou d'échec. Il peut aussi sauvegarder la recette détectée dans .hermes/environment.json pour des vérifications reproductibles. Flags complets et exemples d'utilisation réels inclus.

Lire la suite

10 astuces cachées d'Hermes que même les vétérans ignorent peut-être : du /goal aux pets, en passant par un serveur API

Des objectifs persistants /goal, de la migration en une commande hermes import-agent et des cartes stellaires de la mémoire journey aux analytics d'usage insights, au serveur API proxy, aux pets du bureau, aux skins, à la mémoire externe, à la synchro des skills et au pare-feu egress iron-proxy — 10 pépites cachées d'Hermes Agent, chacune vérifiée sur une installation réelle.

Lire la suite

Hermes mains libres : /heartbeat, /refine et les /goal gates pour des agents autonomes

Trois nouvelles commandes fusionnées dans la branche main d'Hermes Agent le 2026-08-06 : /heartbeat pour les heartbeats de session, /refine pour les revues d'auto-amélioration à la demande, et /goal gate pour des quality gates déterministes. Des exemples CLI concrets montrent comment les combiner en un workflow mains libres et autonome — et où se situent les frontières avec cron et les Completion Contracts.

Lire la suite

Donnez une mémoire sémantique à Hermes Agent avec LanceDB : installation, configuration, benchmark

La mémoire intégrée d'Hermes fonctionne par mots-clés, et les paraphrases passent à la trappe. Le plugin mémoire officiel de LanceDB ajoute le rappel vectoriel et la recherche hybride : précision LongMemEval de 0.661 contre 0.533 pour la baseline FTS5 intégrée. Installation complète, configuration, les quatre outils mémoire, et une lecture attentive des chiffres du benchmark.

Lire la suite

Arrêtez de payer pour le silence : silence trim cloud et idle unload du Whisper local dans Hermes Agent

Les messages vocaux sont le moyen le plus naturel de parler à Hermes Agent — mais avec le STT cloud, chaque pause dans votre note vocale coûte de l'argent et invite des déchets de transcription hallucinés. Deux nouvelles fonctionnalités règlent les deux problèmes : le silence trim avant upload pour les providers cloud (mesuré 13.2s → 6.2s, -53%, transcription identique) et l'idle unload pour le modèle Whisper local (libère ~370MB de RAM/VRAM, recharge transparente au message suivant). Ce post couvre la vraie config, les chiffres mémoire honnêtes GPU vs CPU, quand désactiver le trim et les réglages recommandés par cas d'usage.

Lire la suite

Hermes Desktop referme la boucle : le navigateur intégré débarque et l'agent peut enfin lire la page qu'il a ouverte

Hermes Agent a fusionné deux mises à jour coup sur coup : le navigateur intégré et le rail d'aperçu sont devenus de véritables onglets du layout tree, et un nouvel outil read_preview permet à l'agent de lire le texte visible de la page courante. D'open_preview à read_preview, la boucle « ouvrir puis lire » du desktop est complète.

Lire la suite

Branchez les webhooks Hermes : laissez vos systèmes métier pousser des alertes vers Telegram, Discord et Slack

Le polling gaspille votre quota API et ajoute de la latence. La plateforme webhook de Hermes Agent transforme les événements de commandes, de paiements, de monitoring et de CI/CD en notifications de chat instantanées, avec le mode Direct Delivery pour des envois en moins d'une seconde et zéro token.

Lire la suite