Oossa

llama.cpp überschreibt belegte Slots nicht mehr

Das Release vom 10. Oktober 2026 behebt einen Fehler, durch den eine neue Anfrage eine laufende Generierung stören konnte, indem sie deren Prompt-Cache überschrieb.

KurzmeldungVon Von Oossa veröffentlicht: 1 Min. Lesezeit

Das llama.cpp-Projekt hat am 10.10.2026 Version b11552 veröffentlicht. Die Änderung verhindert, dass eine Anfrage den Prompt-Cache eines bereits belegten Slots aktualisiert. Bislang wurde der belegte Slot überschrieben, sodass die Generierung mit dem falschen Kontext fortgesetzt wurde. Nun bleibt der belegte Slot unverändert, und die neue Anfrage wartet, bis der Slot frei ist.

Warum es wichtig ist

Entwickler, die llama.cpp einsetzen, werden weniger Generierungsfehler erleben, wenn mehrere Anfragen denselben GPU-Speicher nutzen.

War dieser Artikel hilfreich?
Teilen

Als Nächstes lesen

Oossa · Newsletter

Die KI-Woche, erklärt

Jeden Montag: die Nachrichten, die man kennen sollte – verständlich. Kostenlos, kein Spam.