ggml-org-teamet släppte en ny version av llama.cpp den 30 september 2026. Den åtgärdar ett problem där MUSA-GPU-drivrutinen inte definierade CUDA_ARCH, vilket gjorde att vissa kärnor kompilerades utan innehåll. Patchen lägger till korrekt identifiering av arkitekturen och tar bort överflödiga kontroller. I versionssläppet listas också många färdigbyggda binärfiler, nu även för CUDA 12.8 och 13.4 på Linux och Windows, samt stöd för olika ARM- och Apple Silicon-målplattformar.
Varför det spelar roll
Utvecklare kan nu köra Llama.cpp på MUSA-GPU:er och med nyare CUDA-versioner utan manuella patchar.