ggml-org-teamet släppte llama.cpp b11515 den 2026-10-09. Uppdateringen lägger till en SYCL-baserad Q5_K-layout för matris-vektor-multiplikation med kvantisering (MMVQ) samt en fusionerad GLU-operator, vilket förbättrar prestandan på kompatibel hårdvara. Versionen innehåller också färdigbyggda binärer för Apple Silicon, Intel-Macar, iOS, Ubuntu (CPU, Vulkan, CUDA 12.8) och IBM s390x. Användare kan ladda ner rätt arkiv från GitHub-sidan.
Varför det spelar roll
Utvecklare kan nu köra llama.cpp snabbare på SYCL-kompatibla GPU:er utan att behöva bygga programmet från källkod.