Oossa

NVIDIA Dynamo leitet KI-Agenten sitzungsbasiert weiter

Die neue Funktion nutzt eine stabile Sitzungs-ID, damit der Kontext über mehrere Gesprächsrunden hinweg im Cache bleibt. Das beschleunigt Coding-Assistenten und Agenten, die Tools verwenden.

KurzmeldungVon Von Oossa veröffentlicht: 1 Min. Lesezeit

NVIDIA Dynamo unterstützt jetzt eine sitzungsbezogene Kennung, mit der Inferenzserver eine Folge von LLM-Aufrufen als ein einziges Programm behandeln können. Die ID wird aus vorhandenen Headern gängiger Coding-Agenten wie Claude Code, Codex und OpenCode ausgelesen. Eigene Harnesses können sie über den einzelnen Header X‑Dynamo‑Session‑ID hinzufügen. Anhand dieser Kennung kann Dynamo Anfragen weiterleiten, den KV-Cache gemeinsam nutzen und Sitzungen an den Übergängen zu Tools pausieren. So müssen umfangreiche Kontexte seltener erneut vorab verarbeitet werden.

Warum es wichtig ist

Entwickler von KI-Coding-Assistenten profitieren von geringeren Latenzen, weil das System Kontext aus dem Cache wiederverwendet, statt ihn wiederholt neu zu laden.

War dieser Artikel hilfreich?
Teilen

Als Nächstes lesen

Oossa · Newsletter

Die KI-Woche, erklärt

Jeden Montag: die Nachrichten, die man kennen sollte – verständlich. Kostenlos, kein Spam.