llama.cpp प्रोजेक्ट ने 9 Oct 2026 को b11517 नाम से एक नया प्री-रिलीज़ प्रकाशित किया। इस अपडेट में CUDA का एक विकल्प जोड़ा गया है, जिसकी मदद से उपयोगकर्ता GPU कोड के निचले स्तर के हिस्से MMQ हेल्पर्स को source‑1 प्रिसिजन दे सकते हैं। इस बदलाव पर NVIDIA के एक योगदानकर्ता के हस्ताक्षर हैं और यह Linux तथा Windows के लिए सूचीबद्ध CUDA 12 और 13 बिल्ड पर लागू होता है। इस रिलीज़ में macOS Apple Silicon से लेकर Android Snapdragon तक कई अन्य प्लेटफ़ॉर्म के लिए बिल्ड टारगेट भी शामिल हैं।
यह अपडेट प्रोजेक्ट के GitHub पेज और llama.app वेबसाइट पर उपलब्ध है।
यह क्यों मायने रखता है
डेवलपर अब llama.cpp में GPU प्रिसिजन नियंत्रित कर सकते हैं, जिससे LLaMA मॉडल चलाने में प्रदर्शन बेहतर हो सकता है या मेमोरी का इस्तेमाल कम हो सकता है।