ggml-org टीम ने 30 सितंबर, 2026 को llama.cpp का b11270 संस्करण जारी किया। इसमें AMD के HIP प्लेटफ़ॉर्म पर इस्तेमाल होने वाले GPU ऑपरेशन में बदलाव किया गया है: धीमे बाइट-सब्ट्रैक्शन निर्देश की जगह तेज़ निर्देश दिया गया है। इस रिलीज़ में macOS (Apple Silicon और Intel), iOS और Ubuntu के कई बिल्ड के लिए नए बाइनरी पैकेज भी शामिल हैं। इनमें Vulkan-सक्षम GPU संस्करण भी हैं।
यह क्यों मायने रखता है
यह GPU बदलाव AMD हार्डवेयर पर इन्फ़रेंस की रफ़्तार बढ़ा सकता है। पहले से तैयार बाइनरी पैकेज डेवलपरों के लिए ज़्यादा प्लेटफ़ॉर्म पर llama.cpp आज़माना आसान बनाते हैं।