# llama.cpp b11540 beschleunigt MoE-Decoding mit SYCL

> Die Open-Source-Bibliothek llama.cpp ist am 10.10.2026 in Version b11540 erschienen. Neu sind SYCL-Beschleunigung für MXFP4-MoE-Modelle und vorgefertigte Binärdateien für macOS, iOS und Linux.

Oossa · 2026-10-10 · https://oossa.com/de/llama-cpp-release-b11540-adds-sycl-support-for-faster-moe-decoding

Das Team von ggml-org hat am 10.10.2026 llama.cpp in Version b11540 veröffentlicht. Das Update ergänzt SYCL-Unterstützung, um MXFP4-Mixture-of-Experts-Modelle (MoE) mithilfe von arithmetischem Decoding und einer Neuordnung der Gewichte zu beschleunigen. Außerdem gibt es vorgefertigte Binärdateien für Apple-Silicon- und Intel-Macs, iOS sowie verschiedene Ubuntu-Varianten (CPU, Vulkan und CUDA). Die Änderungen sind auf GitHub unter dem Tag b11540 aufgeführt.

## Die Fakten

- Release-Tag b11540 am 10.10.2026 veröffentlicht
- SYCL-Beschleunigung für MXFP4-MoE-Modelle hinzugefügt

## Warum es wichtig ist

Entwickler können größere MoE-Modelle nun schneller auf GPUs mit SYCL-Unterstützung ausführen. Damit stehen llama.cpp-Nutzern mehr Hardwareoptionen zur Verfügung.

## Quellen und Referenzen

1. [ggml-org/llama.cpp b11540](https://github.com/ggml-org/llama.cpp/releases/tag/b11540) – llama.cpp, 2026-10-10

Zuletzt aktualisiert: 2026-10-10
