
Langzeit-Sessions holen endlich auf: Compaction baut den System-Prompt jetzt immer neu
Hermes stellte den System-Prompt einer langlaufenden Session bei jeder Compaction bisher byte-for-byte aus dem Snapshot wieder her – Leitlinien-Verbesserungen, neue Prompt-Blöcke und umbenannte Tool-Beschreibungen erreichten eine über Monate laufende Session also nie. Eine am 30. August gemergte Änderung (PR #98426) lässt den Compaction-Commit jetzt immer den Live-Prompt-Builder ausführen: byte-gleiche Ausgabe behält das ursprüngliche Objekt (Präfix-Caches bleiben intakt), eine abweichende Ausgabe gewinnt und loggt den Diff.
Weiterlesen
Kontext-Kompression wird 5x schneller: Ein Auxiliary-Request statt 19
Die alte Lean-Compaction rief das Auxiliary-Modell pro History-Chunk auf, um Digests zu bauen – bei einer großen Session bis zu 28 sequenzielle Calls, was Compaction auf langsamen Auxiliary-Routen zu 7-11-minütigen Staus machte. Eine am 30. August gemergte Änderung (PR #98628) löscht die Digest-Schleife: ein Auxiliary-Request pro Compaction-Versuch. Gemessen an einem echten 500K-Token-Transkript: 196,5 s auf 39,6 s, und ~11K weniger Tokens nach der Compaction.
Weiterlesen
Schenk Hermes eine Zeitmaschine: Suche das Web, wie es war, mit BackSearch
Du bittest ein LLM, die Schlagzeilen des nächsten Monats vorherzusagen – und es hat heimlich die heutigen News gelesen: Die Prognose ist durch nachträgliche Informationen verunreinigt. BackSearch (von General Reasoning) friert das Nachrichtenarchiv ein: Jede Anfrage trägt ein as_of-Datum, die Suche liefert nur Dokumente, die an oder vor diesem Datum gecrawlt wurden, und gleiche Abfrage + gleiches Datum = immer dieselben Ergebnisse. Das offizielle Standalone-Plugin hermes-plugin-backsearch (v1.0.0, angekündigt am 29. August) gibt Hermes zwei Werkzeuge – backsearch und backfetch – gesteuert über OPENREWARD_API_KEY, mit null Footprint ohne Schlüssel. Dieser Artikel erklärt das Konzept, die Installation, die Parameter und Anwendungsfälle für leckfreie Prognose-Backtests.
Weiterlesen
Drei neue Modell-Provider: Ramp Router, Nebius Token Factory und Tencent TokenPlan
Am 29. August hat Hermes drei neue Modell-Provider gemerged: Ramp Router (router.com) – ein OpenAI-Responses-kompatibler Endpoint, der mit serverseitigen Fallbacks und Ausgabenkontrollen an viele Upstreams weiterleitet; Nebius Token Factory – Nebius Pay-as-you-go-Inference; und Tencent TokenPlan – das Hunyuan-Token-Plan-Abo von Tencent Cloud auf einem Anthropic-kompatiblen Endpoint, das zugleich das Modell hy4-preview in den offiziellen Katalog bringt. Die PRs #97915/#97916/#97917 liegen auf main, noch nicht in einem Release.
Weiterlesen
Drei neue offizielle optionale Skills: Fragebögen, Setup-Wizards und ein Plan-Verhör
Am 29. August kamen gleich drei neue optionale Skills zu Hermes: decision-questionnaire verwandelt eine Entscheidung, die nur eine Person treffen kann, in einen asynchronen Fragebogen; setup-wizard-generator erzeugt interaktive bash-Wizards für Schritte, die nur Menschen ausführen können; und grill-me v2.0.0 wurde auf Frontier-Rounds-Interviews aufgerüstet, die jede ungeprüfte Annahme in deinem Plan hinterfragen. Alle drei sind Hermes-native Ports aus dem 240k-Sterne-Repo mattpocock/skills und mit einem einzigen hermes skills install installierbar.
Weiterlesen
Aufgabenlisten können jetzt verschachtelt werden: Hermes todo bekommt Subtasks
Wenn du Hermes einen komplexen Auftrag gibst, führt es in der Session eine todo-Liste, um den eigenen Fortschritt zu verfolgen. Bisher war diese Liste flach – "Release verpacken" und "Sicherstellen, dass Tests laufen" konnten nur nebeneinanderstehen. PR #97921 (am 29. August gemerged) ergänzt ein parent-Feld für todo-Einträge: Aufgaben können sich zu Bäumen verschachteln, alle Oberflächen rendern die Einrückung automatisch, und das ganze Feature kostet nur rund 45 Tokens im gecachten Tool-Schema.
Weiterlesen
Mitten in der Aufgabe eine Frage stellen? /btw beantwortet sie sofort, ohne zu unterbrechen
Bisher hattest du zwei schlechte Optionen, wenn mitten im Lauf eine Frage auftauchte: den Agenten unterbrechen oder eine neue Session öffnen, die nichts über die Konversation weiß. PR #97937/#97974 (am 29. August gemerged) macht /btw zu einem echten Side-Question-Command: Er antwortet aus der aktuellen Konversation mit vollem Kontext zu Cache-Read-Preisen – ohne Unterbrechung, ohne Verschmutzung, ohne Mehrkosten. /background geht in derselben Änderung in Rente; /bg wird zum kanonischen Command für Hintergrundaufgaben.
Weiterlesen
Ein Befehl öffnet eine ganze Session: hermes chat -q bleibt jetzt auf einem TTY interaktiv
hermes chat -q "question" antwortete früher einmal und beendete sich; für eine interaktive Session musste man den Befehl ausführen, die Session-Datei speichern und dann fortsetzen – ein umständlicher Zwei-Schritte-Tanz. Die am 28. August gemergte Änderung (PR #97121) lässt -q auf einem echten TTY eine Live-Session starten, wobei die erste Nachricht wörtlich übergeben wird – nie als Slash-Befehl oder Shell-Escape geparst.
Weiterlesen
Hermes hört auf, deine Context-Größe zu raten: Usage Anchoring richtet Kompressions-Schwellen an echten Zahlen aus
Hermes schätzte bisher jede Turn den Token-Verbrauch der gesamten Konversation neu mit Heuristiken (chars/4, pauschale 1500 Tokens pro Bild), wobei sich der Fehler mit wachsender Historie aufsummierte – das führte zu Überraschungskompressionen und 413-Payload-too-large-Fehlern. Die am 28. August gemergte Änderung (PR #97206) verankert die Context-Abrechnung am vom Provider gemeldeten Usage und schrumpft das Schätzfenster vom ganzen Transkript auf einen einzelnen Turn.
Weiterlesen
Session-Temp-Dateien sprengen nicht mehr deine RAM-Disk: terminal.temp_dir und 72-Stunden-Auto-Cleanup
Viele Linux-Distributionen mounten /tmp als RAM-gestützte tmpfs, und schwere Hermes-Sessions füllen sie auf. Der am 28. August gemergte Fix verschiebt Session-Temp-Dateien standardmäßig in echten Speicher unter ~/.hermes/cache/terminal, führt den Config-Key terminal.temp_dir und die Umgebungsvariable TERMINAL_TEMP_DIR ein und räumt Dateien, die älter als 72 Stunden sind, automatisch auf.
Weiterlesen
Eine leise Tool-Diät: 6 Tool-Definitionen verschlankt, 17–44 % Tokens pro Call gespart
Jedes Mal, wenn Hermes ein Tool aufruft, muss das Modell die JSON-Parameterdefinition (das Schema) des Tools zusammen mit dem Request neu lesen – je größer die Definition, desto höher der fixe Overhead pro Turn. Zwischen dem 27. und 28. August haben die Maintainer eine Welle von Schema-Diät-Änderungen gemergt: process, todo, read_file, skill_manage, video_generate und browser_exec wurden alle verschlankt und sparen 17–44 % Tokens pro Call – ohne jede Verhaltensänderung.
Weiterlesen
Einmal suchen, dreimal fragen: Multi-Query-tool_search mit Stemming
Hermes' tool_search hat gerade ein ernsthaftes Upgrade bekommen: Es nimmt jetzt ein Array von Queries entgegen, die parallel gesucht werden, liefert pro Query gruppierte Ergebnisse mit einer gemeinsamen Tools-Map, und Snowball-Stemming matcht 'browsing' auf 'browser' und 'issues' auf 'create_issue'. Auch tool_describe bündelt Namen, sodass ein einzelner falscher Name nicht mehr den ganzen Aufruf scheitern lässt. Weniger Round-Trips, günstigere Discovery, bessere Recall.
Weiterlesen
Schluss mit dem Keychain-Gefrage: Opt-in-OS-Keychain-Verschlüsselung für gespeicherte Secrets
Electrons safeStorage hat früher einen App-spezifischen Schlüssel in der macOS-Login-Keychain abgelegt – und auf Maschinen mit gesperrter oder fehlender Keychain wurde aus jedem Hermes-Desktop-Start ein blockierender Passwort-Prompt (Keychain Not Found). v0.20.6 macht die Keychain-gestützte Verschlüsselung zu einem expliziten Opt-in: Der Standardpfad fasst safeStorage gar nicht mehr an, eine Einmal-Migration wandelt alte verschlüsselte Blobs in einfache 0600-Dateien um, und das Umlegen des Schalters kodiert jeden gespeicherten Secret-Store an Ort und Stelle neu.
Weiterlesen
Als du browsen: Real-Profile-Browsing in Hermes Agent
Hermes' Browser startete früher jede Session ausgeloggt – eine Wand, sobald eine Aufgabe deine Logins brauchte. Consent-gesteuertes Real-Profile-Browsing kopiert das aktive Profil deines Standard-Browsers in einen verwalteten Snapshot und steuert ihn mit Hermes' gebündeltem Chromium: Der Agent browst als du, mit deinen Cookies und gespeicherten Logins, immer unter ausdrücklicher Zustimmung und standardmäßig deaktiviert. So funktioniert es, so aktivierst du es – und so die Windows-Eigenheiten.
Weiterlesen
Mit einem Befehl live: die publish-site-Skill für versionierte Website-Deploys
Die neue publish-site-Skill verwandelt die Aufgabe, eine Website online zu bringen, in eine disziplinierte Fünf-Schritte-Pipeline: bauen, lokal vorschauen (oder über einen teilbaren Tunnel), jeden Deploy mit einem Git-Tag versionieren, über eine Provider-Leiter deployen (GitHub Pages → Cloudflare Pages → Netlify) und die Live-URL verifizieren, bevor Erfolg gemeldet wird. Rollback ist einen Befehl entfernt.
Weiterlesen
Hermes v0.20.6: Der Agent lernt, als du zu browsen – ein MCP-Katalog mit 50+ Servern und Secrets ohne Keychain-Gefrage
v0.20.6 ist ein stetiger Strom an Substanz: Consent-gesteuertes Real-Profile-Browsing lässt den Agenten deine echten Browser-Logins nutzen, der Desktop-Browser bekommt ein eigenes OS-Fenster plus eine verwaltete SSH-Remote-Update-Engine, der Remote-MCP-Katalog überschreitet 50 live-verifizierte Vendor-Server, web_search/web_extract erhalten TTL-Ergebnis-Caching, Lean-Tail-Kompression wird Standard, tool_search lernt Multi-Query-Suchen mit Stemming, und gespeicherte Secrets können sich für die OS-Keychain-Verschlüsselung entscheiden – keine Keychain-Abfragen mehr pro Start.
Weiterlesen