Oossa

llama.cpp अपडेट में Q4_K वेट लिमिट के लिए OpenCL सुधार

llama.cpp लाइब्रेरी के रिलीज़ b11558 (Oct 11, 2026) में Q4_K वेट इमेज के लिए OpenCL सपोर्ट बेहतर किया गया है और कई कर्नेल बग ठीक किए गए हैं।

संक्षिप्तलेखक: Oossa द्वारा प्रकाशित: 1 मिनट पढ़ना

ओपन-सोर्स प्रोजेक्ट llama.cpp ने Oct 11, 2026 को संस्करण b11558 जारी किया। इस अपडेट में वह बग ठीक किया गया है, जिसके कारण Q4_K क्वांटाइज़्ड वेट इस्तेमाल करने पर OpenCL कर्नेल डिवाइस की इमेज लिमिट से आगे निकल जाते थे। इसमें उन डिवाइस के लिए फ़ॉलबैक विकल्प भी जोड़ा गया है जो इस लिमिट तक पहुँच जाते हैं। साथ ही, Q4_0 कर्नेल के लिए ब्रॉडकास्टिंग और RMS-norm की गणनाएँ भी दुरुस्त की गई हैं। इन बदलावों के सह-लेखक Qualcomm के Hongqiang Wang हैं।

यह क्यों मायने रखता है

llama.cpp को GPU पर इस्तेमाल करने वाले डेवलपर अब बिना क्रैश हुए ज़्यादा हार्डवेयर पर Q4_K क्वांटाइज़्ड मॉडल चला सकते हैं।

क्या यह लेख उपयोगी था?
साझा करें

यह भी पढ़ें

Oossa · न्यूज़लेटर

AI का हफ़्ता, आसान भाषा में

हर सोमवार: जानने लायक खबरें, सरल भाषा में। मुफ़्त, कोई स्पैम नहीं।