ggml‑org bracht llama.cpp versie b11462 uit op 2026‑10‑07. De update ruimt de buffers voor SYCL-gebaseerde attention op, een interface voor grafische berekeningen op laag niveau. Ook bevat de release kant-en-klare binaries voor macOS (Apple Silicon en Intel), iOS en verschillende Ubuntu-varianten, met versies voor CPU, Vulkan en CUDA 12.8. De binaries zijn te downloaden via de GitHub-releasepagina.
Waarom het ertoe doet
Ontwikkelaars kunnen llama.cpp nu op meer platforms lokaal gebruiken zonder de software zelf vanaf de broncode te compileren, waardoor ze sneller kunnen experimenteren.