ggml‑org टीम ने llama.cpp रिलीज़ b11531 प्रकाशित किया है। इसमें चैट API को नए सिरे से व्यवस्थित किया गया है और macOS (Apple Silicon और Intel), iOS तथा Ubuntu के कई वेरिएंट के लिए पहले से तैयार बाइनरी शामिल हैं। इनमें CPU, Vulkan और CUDA 12.8 के विकल्प भी हैं। डाउनलोड लिंक GitHub के रिलीज़ पेज पर उपलब्ध हैं। अब उपयोगकर्ता खुद कंपाइल किए बिना अधिक प्लेटफ़ॉर्म पर LLM स्थानीय रूप से चला सकते हैं।
यह क्यों मायने रखता है
डेवलपर अब बिल्ड की प्रक्रिया से बचे बिना अधिक डिवाइस पर Llama मॉडल स्थानीय रूप से चला सकते हैं। Ubuntu पर GPU एक्सेलरेशन का भी समर्थन है।