Oossa

llama.cpp b11493 bringt gruppiertes MoE-XMX-GEMM

Die Open-Source-Bibliothek llama.cpp ist am 8. Oktober 2026 in Version b11493 erschienen. Neu sind eine SYCL-basierte gruppierte MoE-XMX-GEMM-Operation und vorgefertigte Binärdateien für zahlreiche Plattformen.

KurzmeldungVon Von Oossa veröffentlicht: 1 Min. Lesezeit

Das Team von ggml-org hat am 8. Oktober 2026 llama.cpp in Version b11493 veröffentlicht. Das Update ergänzt eine SYCL-Implementierung für gruppiertes Mixture-of-Experts-XMX-GEMM (MoE), eine Matrixmultiplikation, die in großen Sprachmodellen verwendet wird. Ebenfalls enthalten sind vorgefertigte Binärdateien für macOS, iOS und Ubuntu (CPU, Vulkan und CUDA).

Warum es wichtig ist

Entwickler können MoE-basierte Modelle nun auf SYCL-kompatiblen GPUs ausführen. Damit stehen für Open-Source-LLM-Anwendungen mehr Hardwareoptionen zur Verfügung.

War dieser Artikel hilfreich?
Teilen

Als Nächstes lesen

Oossa · Newsletter

Die KI-Woche, erklärt

Jeden Montag: die Nachrichten, die man kennen sollte – verständlich. Kostenlos, kein Spam.