تیم ggml‑org نسخه b11540 از llama.cpp را در 10 اکتبر 2026 منتشر کرد. این بهروزرسانی با افزودن پشتیبانی از SYCL، اجرای مدلهای ترکیبی متخصصان (MoE) با قالب MXFP4 را با استفاده از رمزگشایی حسابی و بازچینی وزنها سریعتر میکند. همچنین فایلهای اجرایی ازپیشساختهشدهای برای Apple Silicon و Intel در macOS، iOS و چند نسخه از Ubuntu (برای CPU، Vulkan و CUDA) ارائه میدهد. جزئیات تغییرات با برچسب b11540 در GitHub فهرست شدهاند.
چرا مهم است
توسعهدهندگان اکنون میتوانند مدلهای بزرگتر MoE را روی GPUهای سازگار با SYCL سریعتر اجرا کنند؛ این قابلیت دامنه سختافزارهای قابل استفاده برای کاربران llama.cpp را گسترش میدهد.