ggml‑org ने 7 अक्टूबर 2026 को llama.cpp का b11466 संस्करण जारी किया। इस अपडेट में ओवरलैप करने वाले key‑value पेयर के लिए flash_attn का supports_op चेक ठीक किया गया है। साथ ही macOS Apple Silicon, macOS Intel, iOS और Ubuntu के कई बिल्ड (CPU, Vulkan और CUDA 12.8) के लिए तैयार बाइनरी जोड़े गए हैं। ये फ़ाइलें GitHub के रिलीज़ पेज से डाउनलोड की जा सकती हैं।
यह क्यों मायने रखता है
डेवलपर बिना सोर्स से बिल्ड किए, ज़्यादा प्लेटफ़ॉर्म पर llama.cpp का नवीनतम कोड चला सकते हैं।