تیم ggml‑org در ۲۰۲۶‑۱۰‑۰۹ نسخه b11515 از llama.cpp را منتشر کرد. این بهروزرسانی، چیدمان بازآراییشده Q5_K برای ضرب ماتریس در بردارِ کوانتیزهشده (MMVQ) مبتنی بر SYCL و یک عملگر GLU ادغامشده را اضافه میکند که عملکرد را روی سختافزارهای سازگار بهبود میدهد. این نسخه همچنین فایلهای اجرایی آماده برای Apple Silicon، رایانههای Mac مجهز به پردازندههای Intel، iOS، Ubuntu (CPU، Vulkan و CUDA 12.8) و IBM s390x را در بر میگیرد. کاربران میتوانند فایل مناسب را از صفحه GitHub دانلود کنند.
چرا مهم است
توسعهدهندگان اکنون میتوانند llama.cpp را روی GPUهای سازگار با SYCL سریعتر اجرا کنند، بیآنکه لازم باشد آن را از کد منبع بسازند.