# NVIDIA Dynamo、AIエージェント向けにセッション単位のルーティングに対応

> 新機能は安定したセッションIDを使い、複数ターンにわたってコンテキストのキャッシュを維持。コーディングアシスタントやツールを使うエージェントの処理を高速化する。

Oossa · 2026-10-08 · https://oossa.com/ja/nvidia-dynamo-adds-session-aware-routing-for-agentic-ai-workloads

NVIDIA Dynamoがセッション単位の識別子に対応し、推論サーバーが一連のLLM呼び出しを1つのプログラムとして扱えるようになった。このIDはClaude Code、Codex、OpenCodeなどの主要なコーディングエージェントが既存のヘッダーに含めている情報から読み取れるほか、カスタムハーネスではX‑Dynamo‑Session‑IDヘッダーを1つ追加するだけで利用できる。Dynamoはこの識別子を使ってリクエストをルーティングし、KVキャッシュを共有できる。また、ツールの実行境界でセッションを一時停止し、大きなコンテキストを再度プリフィルする必要を減らせる。

## 事実

- 対応するエージェントにはClaude Code、Codex、OpenCodeが含まれる。
- カスタムハーネスではX‑Dynamo‑Session‑IDヘッダーを使う。

## なぜ重要か

AIコーディングアシスタントの開発者は、コンテキストを繰り返し読み込む代わりにキャッシュを再利用することで、レイテンシの低下が期待できる。

## 出典と参考資料

1. [Session-Aware Agentic Inference with NVIDIA Dynamo](https://pytorch.org/blog/session-aware-agentic-inference-with-nvidia-dynamo/) – PyTorch

最終更新: 2026-10-08
