Oossa

llama.cpp unterstützt Host-Tensor-Ansichten und wieder K2-Horizon-Tensoren

Das Release vom 9. Okt. 2026 behebt einen Absturz bei KV-Cache-Aufteilungen und stellt die Unterstützung für K2-Horizon-Hardware wieder her.

KurzmeldungVon Von Oossa veröffentlicht: 1 Min. Lesezeit

Das Team von ggml-org hat am 9. Okt. 2026 llama.cpp Version b11528 veröffentlicht. Mit dem Update behandelt die Bibliothek Ansichten hostallokierter Tensoren wie normale Knoten. Dadurch wird ein früherer Assertion-Fehler verhindert, der bei der Option –split-mode tensor auftrat. Außerdem wird die SM-Tensor-Unterstützung für den Beschleuniger K2 Horizon wieder eingeführt. Die Änderung ist im offiziellen GitHub-Release enthalten und gilt für alle aufgeführten Plattformen – von macOS bis Windows und Linux.

Warum es wichtig ist

Entwickler können llama.cpp nun mit aufgeteiltem KV-Cache auf mehr Hardware ohne Abstürze nutzen. Dadurch stehen für die lokale LLM-Inferenz mehr Konfigurationen zur Verfügung.

War dieser Artikel hilfreich?
Teilen

Als Nächstes lesen

Oossa · Newsletter

Die KI-Woche, erklärt

Jeden Montag: die Nachrichten, die man kennen sollte – verständlich. Kostenlos, kein Spam.