Het ggml-org-team bracht op 2026-10-07 llama.cpp versie b11461 uit. De update verhelpt het traag inlezen van checkpoints bij gebruik van Vulkan op AMD-GPU’s. Ook zijn er nieuwe binaire pakketten voor Apple Silicon, Intel-Macs, iOS en verschillende Linux-builds (CPU, Vulkan, CUDA 12.8). Gebruikers kunnen het juiste archief downloaden via de GitHub-releasepagina.
Waarom het ertoe doet
AMD-laptopgebruikers kunnen LLaMA-modellen nu sneller draaien, zonder de eerdere vertraging.