تیم ggml-org نسخه b11493 از llama.cpp را در 8 اکتبر 2026 منتشر کرد. این بهروزرسانی پیادهسازی SYCL برای grouped Mixture-of-Experts (MoE) XMX GEMM را اضافه میکند؛ عملیاتی برای ضرب ماتریسی که در مدلهای زبانی بزرگ استفاده میشود. این نسخه همچنین فایلهای باینری ازپیشساختهشدهای برای macOS، iOS و Ubuntu (CPU، Vulkan و CUDA) ارائه میدهد.
چرا مهم است
توسعهدهندگان اکنون میتوانند مدلهای مبتنی بر MoE را روی GPUهای سازگار با SYCL اجرا کنند؛ این قابلیت گزینههای سختافزاری را برای اجرای مدلهای زبانی بزرگ متنباز گسترش میدهد.