# NVIDIA Dynamo incorpora enrutamiento por sesión para IA agéntica

> La nueva función de Dynamo usa un ID de sesión estable para mantener en caché el contexto a lo largo de varios turnos y acelerar asistentes de programación y agentes que usan herramientas.

Oossa · 2026-10-08 · https://oossa.com/es/nvidia-dynamo-adds-session-aware-routing-for-agentic-ai-workloads

NVIDIA Dynamo ahora admite un identificador a nivel de sesión que permite a los servidores de inferencia tratar una cadena de llamadas a LLM como un único programa. El ID se obtiene de encabezados existentes de agentes de programación populares, como Claude Code, Codex y OpenCode, y puede añadirse a entornos personalizados mediante un único encabezado X‑Dynamo‑Session‑ID. Con este identificador, Dynamo puede enrutar solicitudes, compartir la caché KV y pausar sesiones cuando se usan herramientas, lo que reduce la necesidad de volver a procesar contextos extensos desde el principio.

## Los hechos

- Entre los agentes compatibles están Claude Code, Codex y OpenCode.
- Los entornos personalizados usan el encabezado X‑Dynamo‑Session‑ID.

## Por qué importa

Los desarrolladores de asistentes de programación con IA pueden reducir la latencia porque el sistema reutiliza el contexto almacenado en caché en vez de cargarlo una y otra vez.

## Fuentes y referencias

1. [Session-Aware Agentic Inference with NVIDIA Dynamo](https://pytorch.org/blog/session-aware-agentic-inference-with-nvidia-dynamo/) – PyTorch

Última actualización: 2026-10-08
