کتابخانه متنباز llama.cpp در 9 اکتبر 2026 نسخه b11523 را منتشر کرد. این بهروزرسانی کرشی را برطرف میکند که هنگام اجرای عملیات DUP در WebGPU رخ میداد. پیشتر، DUP روی CPU اجرا میشد و بقیه پردازشها روی WebGPU؛ این تفاوت باعث ناسازگاری بافر و کرش میشد. حالا DUP هم مانند عملیات CPY (کپی) و CONT از همان مسیر کد استفاده میکند و روی WebGPU میماند.
چرا مهم است
کاربران WebGPU میتوانند مدلهای llama.cpp را با batchهای ترکیبی اجرا کنند، بیآنکه برنامه کرش کند.