# NVIDIA Dynamo ajoute le routage par session pour les agents IA

> La nouvelle fonctionnalité de Dynamo s’appuie sur un identifiant de session stable pour conserver le contexte en cache d’un tour à l’autre, accélérant ainsi les assistants de programmation et les agents qui utilisent des outils.

Oossa · 2026-10-08 · https://oossa.com/fr/nvidia-dynamo-adds-session-aware-routing-for-agentic-ai-workloads

NVIDIA Dynamo prend désormais en charge un identifiant de session qui permet aux serveurs d’inférence de traiter une série d’appels à un LLM comme un seul programme. Cet identifiant est lu dans les en-têtes existants d’agents de programmation populaires comme Claude Code, Codex et OpenCode. Il peut aussi être ajouté aux environnements personnalisés à l’aide d’un seul en-tête X‑Dynamo‑Session‑ID. Grâce à cet identifiant, Dynamo peut acheminer les requêtes, partager le cache KV et mettre les sessions en pause aux étapes où des outils sont utilisés, ce qui réduit la nécessité de préremplir à nouveau de grands contextes.

## Les faits

- Parmi les agents pris en charge figurent Claude Code, Codex et OpenCode.
- Les environnements personnalisés utilisent l’en-tête X‑Dynamo‑Session‑ID.

## Pourquoi c'est important

Les développeurs d’assistants de programmation IA peuvent réduire la latence, car le système réutilise le contexte en cache au lieu de le charger à répétition.

## Sources et références

1. [Session-Aware Agentic Inference with NVIDIA Dynamo](https://pytorch.org/blog/session-aware-agentic-inference-with-nvidia-dynamo/) – PyTorch

Dernière mise à jour: 2026-10-08
