# llama.cpp अपडेट में Q4_K वेट लिमिट के लिए OpenCL सुधार

> llama.cpp लाइब्रेरी के रिलीज़ b11558 (Oct 11, 2026) में Q4_K वेट इमेज के लिए OpenCL सपोर्ट बेहतर किया गया है और कई कर्नेल बग ठीक किए गए हैं।

Oossa · 2026-10-11 · https://oossa.com/hi/llama-cpp-update-adds-opencl-fixes-for-q4-k-weight-limits

ओपन-सोर्स प्रोजेक्ट llama.cpp ने Oct 11, 2026 को संस्करण b11558 जारी किया। इस अपडेट में वह बग ठीक किया गया है, जिसके कारण Q4_K क्वांटाइज़्ड वेट इस्तेमाल करने पर OpenCL कर्नेल डिवाइस की इमेज लिमिट से आगे निकल जाते थे। इसमें उन डिवाइस के लिए फ़ॉलबैक विकल्प भी जोड़ा गया है जो इस लिमिट तक पहुँच जाते हैं। साथ ही, Q4_0 कर्नेल के लिए ब्रॉडकास्टिंग और RMS-norm की गणनाएँ भी दुरुस्त की गई हैं। इन बदलावों के सह-लेखक Qualcomm के Hongqiang Wang हैं।

## तथ्य

- रिलीज़ संस्करण b11558, 2026-10-11 को प्रकाशित हुआ
- Q4_K dense bin कर्नेल के लिए OpenCL इमेज लिमिट की समस्या ठीक की गई

## यह क्यों मायने रखता है

llama.cpp को GPU पर इस्तेमाल करने वाले डेवलपर अब बिना क्रैश हुए ज़्यादा हार्डवेयर पर Q4_K क्वांटाइज़्ड मॉडल चला सकते हैं।

## स्रोत और संदर्भ

1. [ggml-org/llama.cpp b11558](https://github.com/ggml-org/llama.cpp/releases/tag/b11558) – llama.cpp, 2026-10-11

अंतिम अपडेट: 2026-10-11
