ggml-org-teamet släppte llama.cpp b11496 den 8 okt. 2026. Uppdateringen lägger till ett SYCL-steg som överför stora modelluppladdningar via en låst ringbuffert och därmed snabbar upp inläsningen på kompatibla GPU:er. Det finns binärfiler att ladda ner för macOS (Apple Silicon och Intel), iOS och flera Ubuntu-versioner (CPU, Vulkan, CUDA 12).
Varför det spelar roll
Utvecklare kan läsa in stora språkmodeller snabbare på SYCL-kompatibel hårdvara, vilket minskar starttiden för appar som använder llama.cpp.