Teamet ggml-org publicerade llama.cpp version b11501 den 8 okt. 2026. Uppdateringen innehåller optimeringar för den snabba Walsh–Hadamard-transformen i SYCL (ett plattformsoberoende API för beräkningar), vilket kan snabba upp vissa matrisoperationer. Den innehåller också färdigbyggda binärfiler för Apple Silicon och Intel på macOS, iOS samt Ubuntu-versioner med stöd för CPU, Vulkan och CUDA 12.8.
Varför det spelar roll
Utvecklare kan nu köra Llama-modeller snabbare på SYCL-kompatibla GPU:er och slipper bygga biblioteket själva.