# NVIDIA Dynamo新增会话感知路由，支持智能体AI工作负载

> 这项新功能通过稳定的会话ID，在多轮交互中保留缓存上下文，提升编程助手和工具调用型智能体的速度。

Oossa · 2026-10-08 · https://oossa.com/zh/nvidia-dynamo-adds-session-aware-routing-for-agentic-ai-workloads

NVIDIA Dynamo现已支持会话级标识符，让推理服务器能够将一连串LLM调用视为同一个程序。该标识符可从Claude Code、Codex和OpenCode等热门编程智能体的现有请求头中读取；自定义执行框架则只需添加一个X‑Dynamo‑Session‑ID请求头即可使用。借助这一标识符，Dynamo可以路由请求、共享KV缓存，并在调用工具时暂停会话，从而减少重新预填充大量上下文的需要。

## 事实

- 支持的智能体包括Claude Code、Codex和OpenCode。
- 自定义执行框架使用X‑Dynamo‑Session‑ID请求头。

## 为什么重要

AI编程助手的开发者可以降低延迟，因为系统会复用缓存的上下文，而不是反复加载。

## 来源与参考

1. [Session-Aware Agentic Inference with NVIDIA Dynamo](https://pytorch.org/blog/session-aware-agentic-inference-with-nvidia-dynamo/) – PyTorch

最后更新: 2026-10-08
