Teamet bakom ggml-org släppte version b11498 av llama.cpp den 2026-10-08. Uppdateringen åtgärdar ett problem med en CUDA-kärna som uppstod när vissa tensordimensioner överskred gränserna för GPU:ns rutnät. Den innehåller också nya förkompilerade binärfiler för Apple Silicon, Intel-baserade Mac-datorer, iOS och flera Ubuntu-konfigurationer, däribland versioner för CPU, Vulkan och CUDA 12.8.
Varför det spelar roll
Utvecklare kan nu köra llama.cpp på fler GPU-konfigurationer utan krascher och få färdiga binärfiler för sin plattform.