ggml-org टीम ने 2026-10-09 को llama.cpp रिलीज़ b11515 जारी किया। इस अपडेट में SYCL-आधारित Q5_K रीऑर्डर-लेआउट मैट्रिक्स-मल्टिप्लाई-वेक्टर-क्वांटाइज़ेशन (MMVQ) और फ़्यूज़्ड GLU ऑपरेटर जोड़ा गया है, जिससे संगत हार्डवेयर पर प्रदर्शन बेहतर होता है। रिलीज़ में Apple Silicon, Intel Macs, iOS, Ubuntu (CPU, Vulkan, CUDA 12.8) और IBM s390x के लिए इस्तेमाल के लिए तैयार बाइनरी भी शामिल हैं। उपयोगकर्ता GitHub पेज से अपने सिस्टम के लिए उपयुक्त आर्काइव डाउनलोड कर सकते हैं।
यह क्यों मायने रखता है
डेवलपर अब सोर्स से बिल्ड किए बिना SYCL-संगत GPU पर llama.cpp तेज़ी से चला सकते हैं।