# NVIDIA Dynamo adiciona roteamento por sessão para IA agêntica

> O novo recurso do Dynamo usa um ID de sessão estável para manter o contexto em cache entre várias interações, acelerando assistentes de programação e agentes que usam ferramentas.

Oossa · 2026-10-08 · https://oossa.com/pt/nvidia-dynamo-adds-session-aware-routing-for-agentic-ai-workloads

O NVIDIA Dynamo agora é compatível com um identificador de sessão que permite aos servidores de inferência tratar uma sequência de chamadas a LLMs como um único programa. O ID é lido em cabeçalhos já existentes de agentes de programação populares, como Claude Code, Codex e OpenCode, e pode ser adicionado a estruturas personalizadas com um único cabeçalho X‑Dynamo‑Session‑ID. Com esse identificador, o Dynamo pode encaminhar solicitações, compartilhar o cache KV e pausar sessões nos pontos em que os agentes usam ferramentas, reduzindo a necessidade de pré-carregar novamente contextos extensos.

## Os fatos

- Os agentes compatíveis incluem Claude Code, Codex e OpenCode.
- Estruturas personalizadas usam o cabeçalho X‑Dynamo‑Session‑ID.

## Por que importa

Desenvolvedores de assistentes de programação com IA podem reduzir a latência porque o sistema reutiliza o contexto em cache, em vez de carregá-lo repetidamente.

## Fontes e referências

1. [Session-Aware Agentic Inference with NVIDIA Dynamo](https://pytorch.org/blog/session-aware-agentic-inference-with-nvidia-dynamo/) – PyTorch

Última atualização: 2026-10-08
