Oossa

llama.cpp behebt Instabilität im Sampling-Graphen

Das Release vom 9. Oktober 2026 hält den Sampling-Graphen über alle Ubatches hinweg statisch und verbessert so die Zuverlässigkeit auf allen unterstützten Plattformen.

KurzmeldungVon Von Oossa veröffentlicht: 1 Min. Lesezeit

Das Projekt ggml‑org/llama.cpp hat am 2026‑10‑09 Version b11530 veröffentlicht. Die Änderung hält den Backend-Sampling-Graphen über alle Ubatches hinweg statisch, sodass sich seine Form während der Reserve- und Decodierschritte nicht mehr ändert. Damit werden Abstürze behoben, die auftraten, wenn sich die Graph-Topologie nach einem Reserve-Aufbau verschob. Die Fehlerbehebung gilt für alle aufgeführten Builds – macOS, Linux, Android, Windows und openEuler – sowie für alle Hardware-Backends wie CUDA, Vulkan und OpenCL.

Warum es wichtig ist

Entwickler, die llama.cpp verwenden, werden bei der Ausführung von Generierungen mit mehreren Ausgaben auf allen unterstützten CPUs und GPUs weniger Laufzeitfehler erleben.

War dieser Artikel hilfreich?
Teilen

Als Nächstes lesen

Oossa · Newsletter

Die KI-Woche, erklärt

Jeden Montag: die Nachrichten, die man kennen sollte – verständlich. Kostenlos, kein Spam.