ggml-org-teamet släppte llama.cpp version b11391 den 4 oktober 2026. Uppdateringen flyttar CUDA-variabeln blocks_per_col till den plats där den används. Ändringen har signerats av Adrien Gallouët. Versionen innehåller också nya förkompilerade binärfiler för macOS med Apple Silicon, macOS med Intel, iOS och flera Ubuntu-versioner (CPU, Vulkan och CUDA 12). Alla filer kan laddas ner från releasesidan på GitHub.
Varför det spelar roll
Utvecklare kan nu köra llama.cpp direkt på fler typer av hårdvara, särskilt om de använder CUDA-kompatibla grafikprocessorer.