Biblioteket llama.cpp med öppen källkod släpptes i version b11511 den 8 okt 2026. Uppdateringen åtgärdar ett fel i MMQ-implementationen som kunde leda till läsning utanför tilldelat minnesområde i CUDA. Den innehåller också färdigbyggda binärer för macOS (Apple Silicon och Intel), iOS och Ubuntu för x64, arm64 och s390x, samt byggen för Vulkan och CUDA 12.8.
Varför det spelar roll
Utvecklare kan nu köra llama.cpp på fler typer av hårdvara utan krascher, särskilt de som använder NVIDIA-grafikkort.