Het ggml-org-team bracht op 1 oktober 2026 versie b11322 van llama.cpp uit. De update bevat vooraf gecompileerde binaries voor macOS op Apple Silicon, macOS op Intel, iOS en verschillende Ubuntu-versies (CPU, Vulkan, CUDA). Ook is een raceconditie in het onderdeel hex-workqueue verholpen. De binaries zijn rechtstreeks te downloaden via de releasepagina op GitHub.
Waarom het ertoe doet
Ontwikkelaars kunnen llama.cpp nu op meer platforms lokaal gebruiken zonder het zelf vanaf de broncode te bouwen, wat testen en implementeren versnelt.