ggml‑org ने 2026‑10‑07 को llama.cpp का संस्करण b11462 जारी किया। इस अपडेट में SYCL पर आधारित attention buffers—ग्राफिक्स कंप्यूटिंग के एक लो-लेवल इंटरफ़ेस—को व्यवस्थित किया गया है। इसके साथ macOS (Apple Silicon और Intel), iOS और Ubuntu के कई संस्करणों के लिए पहले से बने बाइनरी पैकेज भी दिए गए हैं। इनमें CPU, Vulkan और CUDA 12.8 बिल्ड शामिल हैं। ये बाइनरी GitHub के रिलीज़ पेज से डाउनलोड किए जा सकते हैं।
यह क्यों मायने रखता है
डेवलपर अब सोर्स कोड से बिल्ड किए बिना अधिक प्लेटफ़ॉर्म पर llama.cpp चला सकते हैं, जिससे प्रयोग करना तेज़ होगा।