ggml‑org ने llama.cpp का b11539 रिलीज़ जारी किया है। यह हल्का LLM रनर कई तरह के डिवाइस पर काम करता है। macOS Apple Silicon, macOS Intel, iOS XCFramework और Ubuntu के कई बिल्ड के लिए नए बाइनरी आर्काइव उपलब्ध हैं। इनमें CPU, Vulkan और CUDA 12.8 शामिल हैं। डाउनलोड लिंक GitHub के रिलीज़ पेज पर दिए गए हैं।
यह क्यों मायने रखता है
डेवलपर अब खुद बिल्ड किए बिना, ज़्यादा तरह के हार्डवेयर पर llama.cpp चला सकते हैं।