Oossa

به‌روزرسانی llama.cpp محدودیت وزن‌های Q4_K را در OpenCL رفع می‌کند

نسخه b11558 کتابخانه llama.cpp که 11 اکتبر 2026 منتشر شد، پشتیبانی OpenCL از تصاویر وزن Q4_K را بهبود می‌دهد و چند اشکال در کرنل‌ها را برطرف می‌کند.

خبر کوتاهنویسنده: منتشرشده توسط Oossa: 1 دقیقه مطالعه

پروژه متن‌باز llama.cpp در 11 اکتبر 2026 نسخه b11558 را منتشر کرد. این به‌روزرسانی اشکالی را رفع می‌کند که باعث می‌شد کرنل‌های OpenCL هنگام استفاده از وزن‌های کوانتیزه‌شده Q4_K از محدودیت تصویر دستگاه فراتر بروند. همچنین برای دستگاه‌هایی که به این محدودیت می‌رسند، مسیر جایگزینی اضافه می‌کند و محاسبات broadcasting و RMS-norm را در کرنل‌های Q4_0 اصلاح می‌کند. این تغییرات با همکاری Hongqiang Wang از Qualcomm انجام شده‌اند.

چرا مهم است

توسعه‌دهندگانی که از llama.cpp روی GPU استفاده می‌کنند، حالا می‌توانند مدل‌های کوانتیزه‌شده Q4_K را روی سخت‌افزارهای بیشتری بدون کرش اجرا کنند.

آیا این مقاله مفید بود؟
اشتراک‌گذاری

بیشتر بخوانید

Oossa · خبرنامه

هفتهٔ هوش مصنوعی، به زبان ساده

هر دوشنبه: خبرهایی که ارزش دانستن دارند، به زبان ساده. رایگان و بدون هرزنامه.