تیم ggml‑org در ۸ اکتبر ۲۰۲۶ نسخه b11496 از llama.cpp را منتشر کرد. این بهروزرسانی مرحلهای مبتنی بر SYCL اضافه میکند که بارگذاری حجیم مدلها را از طریق یک بافر حلقوی پینشده انجام میدهد و سرعت بارگذاری را در GPUهای سازگار افزایش میدهد. فایلهای اجرایی برای macOS (Apple Silicon و Intel)، iOS و نسخههای مختلف Ubuntu (CPU، Vulkan، CUDA 12) برای دانلود در دسترساند.
چرا مهم است
توسعهدهندگان میتوانند مدلهای زبانی بزرگ را روی سختافزار سازگار با SYCL سریعتر بارگذاری کنند و زمان راهاندازی برنامههای مبتنی بر llama.cpp را کاهش دهند.