
Les sessions de longue durée rattrapent enfin leur retard : la compaction reconstruit désormais toujours le prompt système
Hermes restaurait autrefois le prompt système d'une session de longue durée octet pour octet depuis son snapshot à chaque compaction — si bien que les améliorations de guidance, les nouveaux blocs de prompt et les renommages d'outils n'atteignaient jamais une session qui tournait depuis des mois. Un changement fusionné le 30 août (PR #98426) fait en sorte que le commit de compaction exécute toujours le builder de prompt vivant : une sortie identique octet pour octet conserve l'objet d'origine (caches de préfixe intacts), une sortie divergente gagne et journalise le diff.
Lire la suite
La compression de contexte devient 5× plus rapide : une requête auxiliaire au lieu de 19
L'ancienne compaction lean appelait le modèle auxiliaire une fois par morceau d'historique pour construire des digests — jusqu'à 28 appels séquentiels sur une grosse session, transformant la compaction en blocages de 7 à 11 minutes sur les routes auxiliaires lentes. Un changement fusionné le 30 août (PR #98628) supprime la boucle de digests : une requête auxiliaire par tentative de compaction. Mesuré sur un vrai transcript de 500K tokens : de 196,5 s à 39,6 s, et ~11K tokens de moins après compaction.
Lire la suite
Offrez à Hermes une machine à remonter le temps : cherchez le web tel qu'il était avec BackSearch
Vous demandez à un LLM de prédire les gros titres du mois prochain… et il a discrètement lu ceux d'aujourd'hui : la prédiction est contaminée par de l'information a posteriori. BackSearch (de General Reasoning) fige les archives de presse : chaque requête porte une date as_of, la recherche ne renvoie que des documents crawls à cette date ou avant, et même requête + même date = toujours les mêmes résultats. Le plugin officiel autonome hermes-plugin-backsearch (v1.0.0, annoncé le 29 août) ajoute à Hermes deux outils — backsearch et backfetch — activés par OPENREWARD_API_KEY, avec une empreinte nulle sans clé. Cet article couvre le concept, l'installation, la référence des paramètres et les cas d'usage pour des backtests de prédiction sans fuite.
Lire la suite
Trois nouveaux fournisseurs de modèles : Ramp Router, Nebius Token Factory et Tencent TokenPlan
Le 29 août, Hermes a fusionné trois nouveaux fournisseurs de modèles : Ramp Router (router.com) — un endpoint unique compatible OpenAI Responses qui route vers de nombreux upstreams avec fallbacks côté serveur et contrôles de dépenses ; Nebius Token Factory — l'inférence pay-as-you-go de Nebius ; et Tencent TokenPlan — l'abonnement token-plan de Tencent Cloud Hunyuan sur un endpoint compatible Anthropic, qui amène aussi le modèle hy4-preview dans le catalogue officiel. Les PR #97915/#97916/#97917 sont sur main, pas encore dans une release.
Lire la suite
Trois nouvelles compétences optionnelles officielles : questionnaires, assistants de configuration et interrogatoire de plan
Le 29 août, Hermes a lancé d'un coup trois nouvelles compétences optionnelles : decision-questionnaire transforme une décision que seule une personne peut prendre en questionnaire asynchrone, setup-wizard-generator produit des assistants bash interactifs pour les étapes de configuration réservées aux humains, et grill-me v2.0.0 passe à des entretiens en rounds frontière qui passent au crible chaque hypothèse non examinée de votre plan. Les trois sont des ports natifs Hermes du dépôt mattpocock/skills (240k étoiles), installables avec une seule commande hermes skills install.
Lire la suite
Les listes de tâches peuvent désormais s'imbriquer : le todo de Hermes gagne les sous-tâches
Lorsque vous confiez un travail complexe à Hermes, il tient une liste de tâches (todo) dans la session pour suivre sa propre progression. Cette liste était plate : « préparer la release » et « s'assurer que les tests passent » ne pouvaient que se côtoyer. La PR #97921 (fusionnée le 29 août) ajoute un champ parent aux éléments todo : les tâches peuvent s'imbriquer en arborescences, les surfaces affichent automatiquement l'indentation, et toute la fonctionnalité ne coûte qu'environ 45 tokens sur le schéma d'outil mis en cache.
Lire la suite
Besoin de poser une question en pleine tâche ? /btw y répond immédiatement, sans interrompre
Avant, quand une question surgissait en plein travail, vous n'aviez que deux mauvaises options : interrompre l'agent, ou ouvrir une nouvelle session qui ignore tout de la conversation. Les PR #97937/#97974 (fusionnées le 29 août) font de /btw une véritable commande de question annexe : elle répond depuis la conversation en cours, avec tout le contexte, au prix de lecture du cache — sans interruption, sans pollution, sans dépense supplémentaire. /background prend sa retraite dans la même modification ; /bg devient la commande canonique des tâches en arrière-plan.
Lire la suite
Une seule commande ouvre toute une session : hermes chat -q reste désormais interactif sur un TTY
hermes chat -q "question" répondait une fois puis sortait ; obtenir une session interactive imposait de l'exécuter, de sauvegarder le fichier de session, puis de la reprendre — une manœuvre en deux temps bien peu pratique. Le changement fusionné le 28 août (PR #97121) fait de -q le point de départ d'une session interactive vivante sur un vrai TTY, le premier message étant soumis littéralement — jamais interprété comme une commande slash ni comme une séquence d'échappement shell.
Lire la suite
Hermes cesse de deviner la taille de votre contexte : l'ancrage sur l'usage aligne les seuils de compression sur les chiffres réels
Hermes réestimait auparavant à chaque tour le nombre de tokens de toute la conversation avec des heuristiques (chars/4, images à 1 500 tokens fixes), une erreur qui se cumulait à mesure que l'historique grandissait — d'où des compressions surprises et des erreurs 413 payload-too-large. Le changement fusionné le 28 août (PR #97206) ancre le comptage du contexte sur l'usage rapporté par le provider, réduisant la fenêtre d'estimation de l'intégralité du transcript à un seul tour.
Lire la suite
Fini le disque RAM saturé par les fichiers temporaires de session : terminal.temp_dir et le nettoyage automatique de 72 heures
De nombreuses distributions Linux montent /tmp en tmpfs adossé à la RAM, et les sessions Hermes intensives finissent par le saturer. Le correctif fusionné le 28 août déplace par défaut les fichiers temporaires de session vers un stockage réel dans ~/.hermes/cache/terminal, ajoute la clé de config terminal.temp_dir et la variable d'environnement TERMINAL_TEMP_DIR, et purge automatiquement les fichiers de plus de 72 heures.
Lire la suite
Un « régime d'outils » en toute discrétion : 6 définitions d'outils allégées, de 17 % à 44 % de tokens économisés par appel
Chaque fois qu'Hermes appelle un outil, le modèle doit relire la définition JSON des paramètres (le schema) de cet outil avec la requête — plus la définition est grosse, plus le coût fixe par tour est élevé. Entre le 27 et le 28 août, les mainteneurs ont fusionné une vague de changements de « régime de schema » : process, todo, read_file, skill_manage, video_generate et browser_exec ont tous été allégés, soit 17 % à 44 % de tokens en moins par appel, sans aucun changement de comportement.
Lire la suite
Cherchez une fois, posez trois questions : tool_search multi-requêtes avec racinisation
Le tool_search de Hermes vient de recevoir une sérieuse mise à niveau : il accepte désormais un tableau de requêtes cherchées en parallèle, renvoie des résultats groupés par requête avec une carte d'outils partagée unique, et la racinisation Snowball fait correspondre « browsing » à « browser » et « issues » à « create_issue ». tool_describe regroupe aussi les noms, si bien qu'un seul mauvais nom ne fait plus échouer tout l'appel. Moins d'allers-retours, découverte moins coûteuse, meilleur rappel.
Lire la suite
Fini le harcèlement du keychain : le chiffrement opt-in via le keychain de l'OS pour les secrets stockés
Le safeStorage d'Electron déposait autrefois une clé par application dans le keychain de connexion de macOS — et sur les machines avec un keychain verrouillé ou manquant, chaque lancement de Hermes Desktop se transformait en invite de mot de passe bloquante « Keychain Not Found ». La v0.20.6 fait du chiffrement adossé au keychain un opt-in explicite : le chemin par défaut ne touche jamais à safeStorage, une migration en un seul passage convertit les anciens blobs chiffrés en fichiers 0600 en clair, et activer l'option ré-encode chaque secret stocké sur place.
Lire la suite
Naviguez comme vous : la navigation avec profil réel dans Hermes Agent
Le browser de Hermes démarrait autrefois chaque session déconnecté — un mur dès qu'une tâche avait besoin de vos identifiants. La navigation avec profil réel sous consentement explicite copie le profil actif de votre browser par défaut dans un snapshot managé et le pilote avec le Chromium intégré de Hermes : l'agent navigue comme vous, avec vos cookies et identifiants enregistrés, toujours sous consentement explicite et désactivée par défaut. Voici comment cela fonctionne, comment l'activer, et les mises en garde pour Windows.
Lire la suite
Lancez-le avec une seule commande : le skill publish-site pour les déploiements de sites versionnés
Le nouveau skill publish-site transforme « mettre ce site en ligne » en un pipeline discipliné en cinq étapes : build, aperçu local (ou via un tunnel partageable), versionnement de chaque deploy avec un tag git, deploy via une échelle de providers (GitHub Pages → Cloudflare Pages → Netlify), et vérification que l'URL en ligne renvoie HTTP 200 avant de déclarer le succès. Le rollback est à une commande.
Lire la suite
Hermes v0.20.6 : l'agent apprend à naviguer comme vous, un catalogue MCP de plus de 50 serveurs, et des secrets sans le harcèlement du keychain
La v0.20.6 est une avancée régulière de substance : la navigation avec profil réel sous consentement explicite permet à l'agent d'utiliser vos identifiants de browser réels, le Browser de bureau gagne sa propre fenêtre système ainsi qu'un moteur de mise à jour distante managé par SSH, le catalogue MCP distant dépasse les 50 serveurs d'éditeurs vérifiés en conditions réelles, web_search/web_extract gagnent la mise en cache TTL des résultats, la compression lean-tail devient le mode par défaut, tool_search apprend les recherches multi-requêtes avec racinisation, et les secrets stockés peuvent opter pour le chiffrement via le keychain de l'OS — fini les invites Keychain à chaque lancement.
Lire la suite