Het ggml-org-team publiceerde op 8 okt 2026 versie b11501 van llama.cpp. De update voegt optimalisaties toe voor de snelle Walsh-Hadamardtransformatie (FWHT) in SYCL (een platformonafhankelijke API voor berekeningen), die bepaalde matrixbewerkingen kunnen versnellen. Ook bevat de release kant-en-klare binaries voor Apple Silicon en Intel-Macs, iOS en Ubuntu-builds met ondersteuning voor CPU, Vulkan en CUDA 12.8.
Waarom het ertoe doet
Ontwikkelaars kunnen Llama-modellen nu sneller draaien op GPU's die compatibel zijn met SYCL en hoeven de bibliotheek niet zelf te compileren.