ggml‑org-teamet släppte llama.cpp version b11461 den 2026-10-07. Uppdateringen åtgärdar långsam inläsning av kontrollpunkter när Vulkan används med AMD:s integrerade grafikprocessorer. Den innehåller också nya binärpaket för Apple Silicon, Intel-Macar, iOS och flera Linux-versioner (CPU, Vulkan, CUDA 12.8). Användare kan ladda ner rätt arkiv från versionssidan på GitHub.
Varför det spelar roll
AMD-användare med bärbara datorer kan nu köra LLaMA-modeller snabbare utan den tidigare prestandaförsämringen.