ggml‑org टीम ने 8 Oct 2026 को llama.cpp b11496 जारी किया। इस अपडेट में SYCL का एक चरण जोड़ा गया है, जो पिन किए गए रिंग बफ़र के ज़रिए मॉडल का बल्क अपलोड करता है और संगत GPU पर लोडिंग तेज़ बनाता है। macOS (Apple Silicon और Intel), iOS और Ubuntu के कई बिल्ड (CPU, Vulkan, CUDA 12) के बाइनरी डाउनलोड के लिए उपलब्ध हैं।
यह क्यों मायने रखता है
SYCL-संगत हार्डवेयर पर डेवलपर बड़े भाषा मॉडल तेज़ी से लोड कर सकते हैं, जिससे llama.cpp इस्तेमाल करने वाले ऐप्स का स्टार्टअप समय घटता है।