Oossa

llama.cpp b11540 beschleunigt MoE-Decoding mit SYCL

Die Open-Source-Bibliothek llama.cpp ist am 10.10.2026 in Version b11540 erschienen. Neu sind SYCL-Beschleunigung für MXFP4-MoE-Modelle und vorgefertigte Binärdateien für macOS, iOS und Linux.

KurzmeldungVon Von Oossa veröffentlicht: 1 Min. Lesezeit

Das Team von ggml-org hat am 10.10.2026 llama.cpp in Version b11540 veröffentlicht. Das Update ergänzt SYCL-Unterstützung, um MXFP4-Mixture-of-Experts-Modelle (MoE) mithilfe von arithmetischem Decoding und einer Neuordnung der Gewichte zu beschleunigen. Außerdem gibt es vorgefertigte Binärdateien für Apple-Silicon- und Intel-Macs, iOS sowie verschiedene Ubuntu-Varianten (CPU, Vulkan und CUDA). Die Änderungen sind auf GitHub unter dem Tag b11540 aufgeführt.

Warum es wichtig ist

Entwickler können größere MoE-Modelle nun schneller auf GPUs mit SYCL-Unterstützung ausführen. Damit stehen llama.cpp-Nutzern mehr Hardwareoptionen zur Verfügung.

War dieser Artikel hilfreich?
Teilen

Als Nächstes lesen

Oossa · Newsletter

Die KI-Woche, erklärt

Jeden Montag: die Nachrichten, die man kennen sollte – verständlich. Kostenlos, kein Spam.