Het ggml‑org-team heeft op 4 October 2026 versie b11391 van llama.cpp uitgebracht. In de update wordt de CUDA-variabele blocks_per_col verplaatst naar de plek waar die wordt gebruikt. Adrien Gallouët heeft deze wijziging goedgekeurd. De release bevat ook nieuwe voorgecompileerde binaries voor macOS Apple Silicon, macOS Intel, iOS en verschillende Ubuntu-builds (CPU, Vulkan en CUDA 12). Alle bestanden zijn te downloaden via de GitHub-releasepagina.
Waarom het ertoe doet
Ontwikkelaars kunnen llama.cpp nu direct op meer hardware gebruiken, vooral als ze een CUDA-compatibele GPU hebben.