# به‌روزرسانی llama.cpp محدودیت وزن‌های Q4_K را در OpenCL رفع می‌کند

> نسخه b11558 کتابخانه llama.cpp که 11 اکتبر 2026 منتشر شد، پشتیبانی OpenCL از تصاویر وزن Q4_K را بهبود می‌دهد و چند اشکال در کرنل‌ها را برطرف می‌کند.

Oossa · 2026-10-11 · https://oossa.com/fa/llama-cpp-update-adds-opencl-fixes-for-q4-k-weight-limits

پروژه متن‌باز llama.cpp در 11 اکتبر 2026 نسخه b11558 را منتشر کرد. این به‌روزرسانی اشکالی را رفع می‌کند که باعث می‌شد کرنل‌های OpenCL هنگام استفاده از وزن‌های کوانتیزه‌شده Q4_K از محدودیت تصویر دستگاه فراتر بروند. همچنین برای دستگاه‌هایی که به این محدودیت می‌رسند، مسیر جایگزینی اضافه می‌کند و محاسبات broadcasting و RMS-norm را در کرنل‌های Q4_0 اصلاح می‌کند. این تغییرات با همکاری Hongqiang Wang از Qualcomm انجام شده‌اند.

## حقایق

- نسخه b11558 در 2026-10-11 منتشر شد
- محدودیت تصویر OpenCL را برای کرنل‌های dense bin مربوط به Q4_K رفع می‌کند

## چرا مهم است

توسعه‌دهندگانی که از llama.cpp روی GPU استفاده می‌کنند، حالا می‌توانند مدل‌های کوانتیزه‌شده Q4_K را روی سخت‌افزارهای بیشتری بدون کرش اجرا کنند.

## منابع و ارجاع‌ها

1. [ggml-org/llama.cpp b11558](https://github.com/ggml-org/llama.cpp/releases/tag/b11558) – llama.cpp, 2026-10-11

آخرین به‌روزرسانی: 2026-10-11
