ggml‑org टीम ने 4 October 2026 को llama.cpp संस्करण b11391 जारी किया। इस अपडेट में blocks_per_col नाम के CUDA वेरिएबल को उसके इस्तेमाल वाली जगह पर रखा गया है। इस बदलाव को Adrien Gallouët ने मंजूरी दी। रिलीज़ में macOS Apple Silicon, macOS Intel, iOS और Ubuntu के कई बिल्ड (CPU, Vulkan और CUDA 12) के लिए नए प्रीकम्पाइल्ड बाइनरी भी शामिल हैं। सभी फ़ाइलें GitHub रिलीज़ पेज से डाउनलोड की जा सकती हैं।
यह क्यों मायने रखता है
डेवलपर अब llama.cpp को पहले से तैयार बाइनरी के साथ ज़्यादा तरह के हार्डवेयर पर चला सकते हैं—खास तौर पर CUDA-सक्षम GPU इस्तेमाल करने वाले लोग।