# NVIDIA Dynamo introduce il routing per sessioni AI

> La nuova funzione usa un ID di sessione stabile per mantenere la cache del contesto tra più interazioni e accelerare assistenti di programmazione e agenti che usano strumenti.

Oossa · 2026-10-08 · https://oossa.com/it/nvidia-dynamo-adds-session-aware-routing-for-agentic-ai-workloads

NVIDIA Dynamo ora supporta un identificativo a livello di sessione, che permette ai server di inferenza di trattare una sequenza di chiamate a un LLM come un unico programma. L’ID viene letto dagli header già usati da agenti di programmazione diffusi come Claude Code, Codex e OpenCode; può inoltre essere aggiunto agli harness personalizzati tramite un singolo header X‑Dynamo‑Session‑ID. Grazie a questo identificativo, Dynamo può instradare le richieste, condividere la cache KV e sospendere le sessioni quando si passa agli strumenti, riducendo la necessità di ricalcolare il prefill di contesti estesi.

## I fatti

- Tra gli agenti supportati figurano Claude Code, Codex e OpenCode.
- Gli harness personalizzati utilizzano l’header X‑Dynamo‑Session‑ID.

## Perché conta

Gli sviluppatori di assistenti di programmazione basati sull’AI possono ridurre la latenza perché il sistema riutilizza il contesto memorizzato nella cache invece di caricarlo ripetutamente.

## Fonti e riferimenti

1. [Session-Aware Agentic Inference with NVIDIA Dynamo](https://pytorch.org/blog/session-aware-agentic-inference-with-nvidia-dynamo/) – PyTorch

Ultimo aggiornamento: 2026-10-08
