
Le Régime Contexte de Hermes : Réduisez la Facture de Tokens par Tour, à l'Officielle
Chaque tour renvoie toute la conversation au modèle — et vous payez tout. Ce guide pratique parcourt les quatre couches que Hermes offre pour alléger le contexte : double compression automatique, la refonte de la compression en v0.20 (micro-compaction, file de N messages utilisateur, défense ghost-skill, lean tail), des seuils par modèle et l'hygiène quotidienne avec /context, /usage et /compress.
Lire la suite
La compaction de Hermes a un défaut lean : les modèles à grande fenêtre cessent d'accumuler des tails de 170K tokens
compression.tail_mode est désormais lean par défaut : la compaction conserve une queue verbatim bornée à 2,5 % de la fenêtre (10K–25K tokens) au lieu de l'accumulation de 100K–240K de l'ancienne formule sur les modèles à grande fenêtre.
Lire la suite
GLM-5.3-Flash débarque dans Hermes : une option à contexte 1M dans le sélecteur de modèles
z-ai/glm-5.3-flash rejoint les catalogues de modèles de Hermes pour OpenRouter (43 modèles) et Nous Portal (32 modèles) : une fenêtre de contexte de 1 048 576 tokens à 0,075 $/M en entrée et 0,25 $/M en sortie — conçu pour les sessions marathon et les gros codebases.
Lire la suite
Une installation MCP pouvait écrire HERMES_YOLO_MODE : les identifiants du catalogue suivent désormais un schéma fermé
Avant le correctif, l'endpoint d'installation du catalogue MCP acceptait des variables d'environnement arbitraires et les persistait dans .env — une entrée de catalogue malveillante ou mal formée pouvait basculer des interrupteurs de sécurité comme HERMES_YOLO_MODE. Les identifiants du catalogue suivent désormais un schéma fermé ; les noms non déclarés reçoivent un HTTP 400.
Lire la suite
hermes update ne sabote plus votre travail : gateways vidées en douceur, backends survivants, kills Windows ciblés
Le pipeline de mise à jour de Hermes a été entièrement refondu : les gateways se vident proprement via le socket de contrôle au lieu d'être tuées en bloc, les backends serve distants survivent aux mises à jour, le programme de mise à jour Windows ne tue que le hermes.exe de cette installation, et les installations gérées par image refusent les mises à jour en place.
Lire la suite
Snapshots navigateur plafonnés à 15 000 caractères ? Hermes rend le budget configurable — et supprime le coût caché des résumés LLM
Hermes ajoute browser.snapshot_threshold (défaut 15000 caractères, min 1000), et les snapshots navigateur ne paient plus pour des résumés via un LLM auxiliaire — les snapshots trop grands sont tronqués puis stockés, l'arbre complet étant conservé sur le disque pour le paginage via read_file.
Lire la suite
Plusieurs Profiles Hermes, donc plusieurs conteneurs Docker ? Une clé de configuration leur permet d'en partager un seul
Hermes ajoute l'option terminal.docker_shared_container_key : les Profiles de confiance peuvent opter pour un conteneur Docker persistant partagé — définissez la même clé et réduisez le gaspillage de ressources sans fusionner les environnements.
Lire la suite
Besoin de Canva, Dropbox ou GitLab mais bloqué par OAuth ? Hermes installe désormais 44 MCP distants officiels en une seule commande
Le catalogue MCP de Hermes s'enrichit de 44 MCP distants officiels — Canva, Dropbox, GitLab, Strava, Cloudflare et bien d'autres — installables via une simple commande hermes mcp install, avec chaque surface d'outils auditée et allégée.
Lire la suite
Vous voulez qu'Hermes utilise un sandbox cloud spécifique comme terminal ? Désormais, vous écrivez un plugin — sans attendre de changements dans le core
Hermes fait des backends terminal un sous-système à plugins : un sandbox cloud tiers peut s'enregistrer comme valeur terminal.backend via un plugin autonome, sans fork nécessaire.
Lire la suite
Vous avez demandé à Hermes de chercher la même requête quatre fois ? Un cache de résultats de 20 minutes empêche les recherches répétées de refacturer le fournisseur
Hermes ajoute web.cache_enabled et web.cache_ttl_minutes : les résultats de web_search et web_extract sont mis en cache pendant 20 minutes, si bien que des subagents parallèles recherchant la même requête paient pour un appel fournisseur au lieu de N.
Lire la suite
Hermes prend en charge Lightpanda nativement : 9x plus rapide, 16x moins de mémoire, avec repli automatique sur Chrome
Votre agent vit sur un petit VPS et chaque action navigateur démarre un Chrome de 200 Mo qui met des secondes à se lancer. Hermes intègre désormais Lightpanda nativement : un navigateur headless écrit en Zig, 9x plus rapide, 16x plus économe en mémoire, avec repli automatique sur Chrome pour tout ce qu'il ne sait pas encore faire.
Lire la suite
MCP dévoile une nouvelle feuille de route — et Hermes est déjà sur la nouvelle spécification
MCP a publié sa nouvelle feuille de route le 22 août : noyau sans état, Multi Round-Trip Requests, Tasks qui entrent dans la spécification, identité d'agent avec DPoP — cinq axes prioritaires fixent la direction des prochains mois. Hermes tourne déjà avec mcp 2.0.0, qui implémente la révision 2026-07-28, avec MRTR, server/discover et elicitation en place.
Lire la suite
« La connexion semble vivante, mais il n'y a personne » : comment les heartbeats de Hermes réparent les silent disconnects
Fermez votre MacBook pour aller déjeuner, changez de Wi-Fi ou laissez votre VPN se reconnecter — et Hermes continue d'afficher une interface qui, discrètement, cesse de répondre. Un mécanisme de heartbeat fraîchement fusionné permet au TUI et au Desktop de détecter les connexions mortes et de les reconstruire automatiquement.
Lire la suite
J'ai fait tourner Hermes dans Obsidian pendant une semaine : le duo officiel skill + plugin a donné vie à mon vault
Une semaine après avoir branché Hermes Agent sur mon vault Obsidian, il a cessé d'être un endroit où l'on range des notes pour devenir une base de connaissances qui se développe toute seule : le skill obsidian officiel intégré lit et écrit les notes, le plugin communautaire transforme le vault en répertoire de travail de l'agent, et Smart Graph met au jour des connexions semantic que je n'ai jamais explicitées. Journal complet de la semaine, les deux chemins officiels et les pièges rencontrés.
Lire la suite
Vos commandes tournent-elles sur le mauvais serveur ? Hermes corrige la fuite d'environnement SSH entre Profiles
Si vous exécutez plusieurs Profiles Hermes — l'un pour le serveur de l'entreprise, l'autre pour votre NAS domestique — méfiez-vous : après un changement de Profile, les commandes du terminal peuvent silencieusement réutiliser l'environnement SSH mis en cache du Profile précédent et s'exécuter sur le mauvais hôte distant. La PR #92156 (fusionnée le 22 août) limite le cache d'environnement du terminal à chaque session, colmatant ainsi la fuite.
Lire la suite
Pourquoi votre abonnement s'est vidé en quelques heures : les defaults de context window Codex, expliqués
Une context window plus grande semble séduisante, mais sur ChatGPT Codex OAuth elle a silencieusement brûlé l'usage de votre abonnement. Hermes ramène désormais les slugs Codex par défaut aux 272K annoncés et transforme la fenêtre vérifiée de 900K en un opt-in explicite via les variantes -900k du picker. Voici comment la context window est décidée, pourquoi la compaction suit la fenêtre et comment reprendre la main.
Lire la suite