Het ggml-org-team bracht op 2026-10-09 release b11515 van llama.cpp uit. De update voegt een SYCL-gebaseerde Q5_K-herordende layout voor matrixvermenigvuldiging met vectoren en quantisatie (MMVQ) en een gefuseerde GLU-operator toe, voor betere prestaties op compatibele hardware. De release bevat ook kant-en-klare binaries voor Apple Silicon, Intel-Macs, iOS, Ubuntu (CPU, Vulkan, CUDA 12.8) en IBM s390x. Gebruikers kunnen het geschikte archief downloaden via de GitHub-pagina.
Waarom het ertoe doet
Ontwikkelaars kunnen llama.cpp nu sneller gebruiken op SYCL-compatibele GPU’s, zonder de software zelf te hoeven compileren.