تیم ggml-org نسخه b11501 از llama.cpp را در ۸ اکتبر ۲۰۲۶ منتشر کرد. این بهروزرسانی بهینهسازیهایی برای تبدیل سریع Walsh-Hadamard در SYCL (رابط برنامهنویسی محاسباتی چندسکویی) دارد که میتواند اجرای برخی عملیات ماتریسی را سرعت ببخشد. همچنین باینریهای آماده اجرا برای Apple Silicon و Intel در macOS، iOS و نسخههای اوبونتو با پشتیبانی از CPU، Vulkan و CUDA 12.8 ارائه میکند.
چرا مهم است
توسعهدهندگان حالا میتوانند مدلهای Llama را روی GPUهای سازگار با SYCL سریعتر اجرا کنند و دیگر نیازی نیست خودشان کتابخانه را بسازند.