نسخهٔ جدید کتابخانهٔ llama.cpp (b11374) در 3 اکتبر 2026 منتشر شد. این نسخه بکاند OpenVINO را به 2026.4.1 ارتقا میدهد، قابلیت جدید ادغام کانولوشن را اضافه میکند، خطاهای بافر GPU را برطرف میکند و نحوهٔ پردازش محورها در مدلهای ترکیب خبره (MoE) را اصلاح میکند. این تغییرات سرعت تولید توکن را در مدلهای MoE ادغامشده افزایش میدهند و از کرشکردن روی برخی GPUهای Intel جلوگیری میکنند.
چرا مهم است
توسعهدهندگانی که llama.cpp را روی GPUهای Intel اجرا میکنند، حالا میتوانند از OpenVINO با سرعت بیشتر و کرشهای کمتر استفاده کنند.