01 / HERMES AGENTPRESENTE APENAS NO MAIN
O lote funcional mais importante do corte trata “entrega concluída” como estado verificável e impede que a multiplicação de perfis locais degrade o Desktop.
- Entrega de cron: a fila passa a ser indexada pela tentativa do próprio job; um job aninhado não herda a execução externa. Uma entrega ainda
pending no timeout fica enfileirada para o próximo gateway; somente uma entrega capturada no meio do envio vira unknown.
- Pool local: o Hermes limita backends de perfis que estão iniciando ou rodando, evita prewarm especulativo quando os slots estão ocupados, torna máximo/ociosidade uma preferência viva em Settings e limita a espera de slot abaixo do orçamento de boot do renderer.
- Correção imediata: o commit de 05:14 BRT move a declaração de
rememberLog antes da leitura de limites do pool; sem ele, o Desktop empacotado podia falhar na inicialização.
Impacto prático: menor risco de notificação perdida durante restart/update e menor chance de uma atualização da roster criar uma onda de processos Hermes. São mudanças no main, não uma garantia de compatibilidade do release estável.
TESTAR ISOLADOPrioridade para cron, gateway e perfis locais
02 / HERMES + MODELOSPRESENTE APENAS NO MAIN
O Hermes adicionou a família Meta Muse Spark 1.3 às listas OpenRouter, Meta AI, OpenCode e ao catálogo hospedado; correções adjacentes evitam que o harness trate o modelo como um LLM genérico sem tool use.
- Disponibilidade: a Meta informa que Muse Spark 1.3 está sendo disponibilizado no Muse Code e na Meta Model API. No Hermes, os IDs
meta/muse-spark-1.3 e meta/muse-spark-1.3-contributor estão apenas no main observado.
- Contexto e prompt: commits do Hermes fixam a família em 1M de contexto no catálogo e adicionam enforcement de tool use/execution guidance aos defaults.
- Mídia: a integração declara que imagens em mensagens do usuário são aceitas, mas imagens em resultado de ferramenta podem gerar HTTP 400; o caminho seguro é tratar mídia de tool-result fora do envelope nativo.
A Meta reporta melhora em tarefas agentic/coding e aproximadamente 20% menos tool calls e 25% menos tokens em comparação interna com Muse Spark 1.2. São números do fornecedor, não benchmark independente; valide acesso, preço, tool calling e comportamento de contexto no fluxo real.
ACOMPANHAR / SANDBOXNão pinçar em produção antes de release e smoke test
03 / CLINELANÇADO · 02/09
O SDK v0.0.82 e o bundle v4.1.17 corrigem drift de capacidades entre produtores de modelos; o Desktop beta acrescenta imagem gerada e separação de agendas por runtime.
- Tools: modelos de gateway cuja entrada do catálogo não declara capacidades não perdem mais todas as tools por uma lista vazia interpretada como negação explícita. O mesmo ajuste cobre Dify, SAP AI Core, opencode e Codex CLI.
- Interoperabilidade: o
SessionImportService importa históricos de Claude Code, Codex e opencode como sessões Cline transacionais, idempotentes e retomáveis.
- MCP e operação: servidor remoto SSE/streamable HTTP agora tem orçamento de conexão de 10 s; Hub incompatível não é substituído sem barreira de drain; o Desktop reduz cópias de transcript que inflavam memória em sessões longas.
- Beta: Desktop v0.0.23-beta.1 permite optar por geração de imagens com credenciais mantidas no servidor e agrupa execuções agendadas pelo ambiente de runtime.
É a atualização externa mais prática para quem mantém mais de um harness: reduz lock-in do histórico e falhas silenciosas de tool/vision. O beta deve ficar fora do caminho crítico.
TESTAR AGORABETA EM PERFIL SEPARADO
04 / CLAUDE CODELANÇADO · 02/09
O release adiciona controles para organizações distribuírem MCP por HTTP/SSE e para hosts não interativos negarem qualquer ação que exigiria prompt.
managedMcpServers permite oferecer servidores HTTP/SSE gerenciados a todos os usuários, com formato equivalente ao .mcp.json; entradas que pedem comando local são ignoradas.
--permission-prompts none torna o comportamento de unattended/headless determinístico: tudo que tentaria abrir prompt é negado automaticamente, sem substituir o modo de permissão ativo para decisões que não exigem prompt.
- Comandos
glab mr create/merge/close/reopen/note/update passam a ser reconhecidos como merge requests no histórico.
Impacto: melhor separação entre conectividade organizacional e execução local, além de um fail-closed claro para automações sem operador. Validar políticas antes de habilitar MCP gerenciado em escopo amplo.
ADOTAR COM GOVERNANÇATestar em host headless e revisar allowlist
05 / OPENAI CODEX CLILANÇADO · 02/09
O release estável 0.153.0 leva extensões externas para o CLI e melhora a recuperação de sessões, o histórico e o escopo de aprovações.
- O plugin CLI agora lista, instala e remove plugins de marketplaces remotos; para operação corporativa, a origem do marketplace passa a ser parte do controle de supply chain.
- Aprovações lembradas de tools MCP ficam vinculadas à conta de aplicativo selecionada, evitando transportar autorização entre identidades.
- Sessões TUI reconectam após queda do app-server preservando rascunhos/transcripts; submissões incertas ou enfileiradas permanecem pausadas para revisão.
- O app-server expõe metadados de modelo/esforço e suporta perguntas assíncronas estruturadas quando o catálogo permite.
Recomendação: testar o fluxo de plugins com marketplace controlado e exigir pinagem/revisão antes de permitir instalação automática. O alpha 0.154.0-alpha.1 apareceu no corte sem changelog funcional; não foi tratado como recurso.
TESTAR EM SANDBOXMarketplace e aprovações exigem governança
06 / PYDANTIC AILANÇADO · 03/09
A release adiciona medição de janela de contexto, eventos tipados e provider vLLM, além de correções que afetam tool calls e retomada de execuções.
context_window em ModelProfile e context_window_used em RunContext permitem instrumentar orçamento de contexto por execução, em vez de inferir pelo tamanho do prompt.
- Código da aplicação e capabilities podem emitir
CustomEvent/CapabilityEvent e assinar com @on_event; isso facilita telemetria de etapas internas sem misturar tudo ao texto final.
VLLMProvider formaliza integração com servidores locais; a release também cobre finish_reason, cancelamento, tool choice em DeepSeek/Together e retomada após cancelamento durante o primeiro tool call.
É um ganho de engenharia de runtime: contexto consumido, eventos e provider deixam de ser detalhes implícitos. Vale testar em um harness Python local para estabelecer limites e alertas antes de tarefas longas.
TESTAR AGORAPrioridade para observabilidade e inferência local