
Sessões de longa duração finalmente se atualizam: a compaction agora sempre reconstrói o system prompt
O Hermes costumava restaurar o system prompt de uma sessão de longa duração byte por byte a partir do snapshot a cada compaction — então melhorias de orientação, novos blocos de prompt e renomes de tools nunca chegavam a uma sessão que rodava há meses. Uma mudança mesclada em 30 de agosto (PR #98426) faz o commit da compaction sempre rodar o builder de prompt ao vivo: saída byte a byte idêntica mantém o objeto original (prefix caches intactos); saída divergente vence e registra o diff.
Ler mais
Compressão de contexto 5x mais rápida: uma requisição auxiliar em vez de 19
A lean compaction antiga chamava o modelo auxiliar uma vez por bloco de histórico para construir digests — até 28 chamadas sequenciais numa sessão grande, transformando a compaction em travadas de 7 a 11 minutos em rotas auxiliares lentas. Uma mudança mesclada em 30 de agosto (PR #98628) elimina o loop de digests: uma requisição auxiliar por tentativa de compaction. Medido numa transcrição real de 500K tokens: de 196,5s para 39,6s, e ~11K tokens a menos depois da compaction.
Ler mais
Dê ao Hermes uma máquina do tempo: pesquise a web como ela era com o BackSearch
Você pede a um LLM que preveja as manchetes do próximo mês — e ele leu sorrateiramente as de hoje: a previsão fica contaminada por informação posterior. O BackSearch (da General Reasoning) congela o arquivo de notícias: cada requisição carrega uma data as_of, a busca só retorna documentos rastreados até essa data, e mesma consulta + mesma data = sempre os mesmos resultados. O plugin oficial autônomo hermes-plugin-backsearch (v1.0.0, anunciado em 29 de agosto) dá ao Hermes duas ferramentas — backsearch e backfetch — controladas por OPENREWARD_API_KEY, com pegada zero sem a chave. Este artigo cobre o conceito, a instalação, a referência de parâmetros e os usos para backtests de previsão sem vazamento.
Ler mais
Três novos providers de modelo: Ramp Router, Nebius Token Factory e Tencent TokenPlan
Em 29 de agosto, o Hermes mesclou três novos providers de modelo: Ramp Router (router.com) — um único endpoint compatível com OpenAI Responses que roteia para muitos upstreams com fallbacks no servidor e controles de gasto; Nebius Token Factory — inferência pay-as-you-go da Nebius; e Tencent TokenPlan — a assinatura token-plan do Tencent Cloud Hunyuan num endpoint compatível com Anthropic, que também traz o modelo hy4-preview para o catálogo oficial. As PRs #97915/#97916/#97917 estão na main, ainda sem release.
Ler mais
Três novas skills opcionais oficiais: questionários de decisão, wizards de setup e uma sabatina de planos
Em 29 de agosto, o Hermes lançou três novas skills opcionais de uma vez: decision-questionnaire transforma uma decisão que só uma pessoa pode tomar em um questionário assíncrono, setup-wizard-generator produz wizards bash interativos para etapas de setup que só humanos fazem, e grill-me v2.0.0 sobe para entrevistas em frontier rounds que interrogam cada premissa não examinada do seu plano. As três são ports nativos do Hermes do repositório mattpocock/skills (240 mil estrelas), instaláveis com um único hermes skills install.
Ler mais
Listas de tarefas agora aninham: o todo do Hermes ganha subtarefas
Quando você entrega uma tarefa complexa ao Hermes, ele mantém uma lista de tarefas (todo) na sessão para acompanhar o próprio progresso. Essa lista costumava ser plana — "empacotar a release" e "garantir que os testes passem" só podiam ficar lado a lado. A PR #97921 (mesclada em 29 de agosto) adiciona um campo parent aos itens de todo: as tarefas podem se aninhar em árvores, as superfícies renderizam a indentação automaticamente e o recurso inteiro custa apenas ~45 tokens no schema de tool em cache.
Ler mais
Precisa perguntar algo no meio da tarefa? O /btw responde na hora, sem interromper nada
Antes, quando surgia uma dúvida durante uma execução, sobravam duas opções ruins: interromper o agente ou abrir uma sessão nova que não sabe nada da conversa. A PR #97937/#97974 (mesclada em 29 de agosto) transforma o /btw em um comando real de pergunta paralela: ele responde a partir da conversa atual, com contexto completo, pelo preço de leitura de cache — sem interrupção, sem poluição, sem gasto extra. O /background se aposenta na mesma mudança; o /bg vira o comando canônico de tarefas em segundo plano.
Ler mais
Um único comando abre uma sessão inteira: hermes chat -q agora permanece interativo em um TTY
hermes chat -q "pergunta" costumava responder uma vez e sair; ter uma sessão interativa exigia rodar o comando, salvar o arquivo de sessão e depois retomar — uma dança clunky de dois passos. A mudança mesclada em 28 de agosto (PR #97121) faz o -q semear uma sessão interativa ao vivo em um TTY real, com a primeira mensagem enviada literalmente — nunca interpretada como comando slash ou escape de shell.
Ler mais
O Hermes para de adivinhar o tamanho do seu contexto: ancoragem de usage alinha os limiares de compressão com números reais
O Hermes costumava reestimar a contagem de tokens da conversa inteira a cada turno com heurísticas (chars/4, imagens fixas de 1500 tokens), acumulando erro conforme o histórico crescia — causando compressões surpresa e erros 413 de payload muito grande. A mudança mesclada em 28 de agosto (PR #97206) ancora a contabilização de contexto no usage reportado pelo provider, encolhendo a janela de estimativa do transcript inteiro para um único turno.
Ler mais
Arquivos temporários de sessão não estouram mais o seu RAM disk: terminal.temp_dir e limpeza automática de 72 horas
Muitas distros Linux montam /tmp como um tmpfs apoiado em RAM, e sessões pesadas do Hermes o enchem. A correção mesclada em 28 de agosto move os arquivos temporários de sessão para armazenamento real em ~/.hermes/cache/terminal por padrão, adiciona a chave de config terminal.temp_dir e a variável de ambiente TERMINAL_TEMP_DIR, e remove automaticamente arquivos com mais de 72 horas.
Ler mais
Uma "dieta de ferramentas" silenciosa: 6 definições de ferramentas emagrecidas, economizando 17%–44% de tokens por chamada
Toda vez que o Hermes chama uma ferramenta, o modelo precisa reler a definição JSON de parâmetros (schema) da ferramenta junto com a requisição — quanto maior a definição, maior o overhead fixo por turno. Entre 27 e 28 de agosto, os mantenedores mesclaram uma onda de mudanças de "schema diet": process, todo, read_file, skill_manage, video_generate e browser_exec emagreceram, cortando 17%–44% dos tokens por chamada com zero mudança de comportamento.
Ler mais
Busque Uma Vez, Pergunte Três: tool_search Multi-Query com Stemming
O tool_search do Hermes acabou de ganhar uma atualização séria: agora ele aceita um array de queries pesquisadas em paralelo, retorna resultados agrupados por query com um único mapa compartilhado de tools, e o stemming Snowball faz 'browsing' casar com 'browser' e 'issues' com 'create_issue'. O tool_describe também processa nomes em lote, então um nome errado não derruba mais a chamada inteira. Menos round-trips, descoberta mais barata, melhor recall.
Ler mais
Chega de Chatice do Keychain: Criptografia Opcional no Keychain do SO para Segredos Armazenados
O safeStorage do Electron costumava estacionar uma chave por app no keychain de login do macOS — e em máquinas com keychain bloqueado ou ausente, toda inicialização do Hermes Desktop virava um prompt de senha bloqueante de 'Keychain Not Found'. A v0.20.6 torna a criptografia com keychain um opt-in explícito: o caminho padrão nunca toca no safeStorage, uma migração única converte blobs criptografados antigos em arquivos simples 0600, e ligar o toggle recodifica cada segredo armazenado no lugar.
Ler mais
Navegue como Você: Navegação com Perfil Real no Hermes Agent
O browser do Hermes costumava iniciar toda sessão deslogado — uma parede no momento em que uma tarefa precisava dos seus logins. A navegação com perfil real sob consentimento copia o perfil ativo do seu browser padrão para um snapshot gerenciado e o dirige com o Chromium empacotado do Hermes: o agente navega como você, com seus cookies e logins salvos, sempre sob consentimento explícito e desativado por padrão. Veja como funciona, como ativar e os cuidados com o Windows.
Ler mais
Publique com Um Comando: a skill publish-site para deploys versionados de sites
A nova skill publish-site transforma 'colocar este site no ar' num pipeline disciplinado de cinco etapas: build, pré-visualização local (ou via um túnel compartilhável), versionamento de cada deploy com uma git tag, deploy através de uma escada de providers (GitHub Pages → Cloudflare Pages → Netlify) e verificação de que a URL ao vivo retorna HTTP 200 antes de reportar sucesso. O rollback está a um comando de distância.
Ler mais
Hermes v0.20.6: o agente aprende a navegar como você, um catálogo de MCP com 50+ servidores e segredos sem a chatice do keychain
A v0.20.6 é um rolamento constante de substância: a navegação com perfil real sob consentimento deixa o agente usar seus logins reais de browser, o Browser do desktop ganha janela própria do SO e um mecanismo gerenciado de atualização remota via SSH, o catálogo remoto de MCP passa de 50 servidores de fornecedores verificados ao vivo, web_search/web_extract ganham cache de resultados com TTL, a compactação lean-tail vira o padrão, o tool_search aprende buscas multi-query com stemming e segredos armazenados podem optar pela criptografia no keychain do SO — chega de prompts do Keychain a cada inicialização.
Ler mais