ggml-org टीम ने 30 सितंबर, 2026 को llama.cpp का नया संस्करण जारी किया। इसमें उस समस्या को ठीक किया गया है, जिसमें MUSA GPU ड्राइवर CUDA_ARCH को परिभाषित नहीं करता था और इसके चलते कुछ कर्नेल खाली कंपाइल होते थे। इस पैच में आर्किटेक्चर की सही पहचान जोड़ी गई है और गैर-ज़रूरी जाँचें हटाई गई हैं। रिलीज़ में कई पहले से बने बाइनरी भी शामिल हैं। अब इनमें Linux और Windows के लिए CUDA 12.8 और 13.4 के साथ-साथ विभिन्न ARM और Apple Silicon टारगेट का समर्थन भी है।
यह क्यों मायने रखता है
डेवलपर अब बिना मैनुअल पैच के MUSA GPU और CUDA के नए संस्करणों पर Llama.cpp चला सकते हैं।