ggml‑org släppte llama.cpp version b11466 den 7 oktober 2026. Uppdateringen rättar till kontrollen av supports_op för överlappande nyckel-värde-par i flash_attn. Den innehåller också färdiga binärer för macOS med Apple Silicon, macOS med Intel, iOS och flera Ubuntu-varianter (CPU, Vulkan och CUDA 12.8). Filerna kan hämtas från releasesidan på GitHub.
Varför det spelar roll
Utvecklare kan köra den senaste versionen av llama.cpp på fler plattformar utan att behöva kompilera källkoden själva.