Oossa

llama.cpp v0.2.4 bringt SYCL-Q5_K-Layout und GLU-Fusion

Die Open-Source-Bibliothek llama.cpp hat am 9. Okt. 2026 Version b11515 veröffentlicht – mit neuer SYCL-Unterstützung und vorgefertigten Binärdateien für macOS, iOS, Linux und CUDA.

KurzmeldungVon Von Oossa veröffentlicht: 1 Min. Lesezeit

Das Team von ggml-org hat am 2026-10-09 llama.cpp Release b11515 veröffentlicht. Das Update ergänzt eine SYCL-basierte Q5_K-Layout-Umordnung für Matrix-Vektor-Multiplikation mit Quantisierung (MMVQ) sowie einen fusionierten GLU-Operator. Das verbessert die Leistung auf kompatibler Hardware. Außerdem enthält das Release sofort nutzbare Binärdateien für Apple Silicon, Intel-Macs, iOS, Ubuntu (CPU, Vulkan, CUDA 12.8) und IBM s390x. Das passende Archiv können Nutzer von der GitHub-Seite herunterladen.

Warum es wichtig ist

Entwickler können llama.cpp jetzt auf SYCL-kompatiblen GPUs schneller ausführen, ohne das Programm selbst kompilieren zu müssen.

War dieser Artikel hilfreich?
Teilen

Als Nächstes lesen

Oossa · Newsletter

Die KI-Woche, erklärt

Jeden Montag: die Nachrichten, die man kennen sollte – verständlich. Kostenlos, kein Spam.