ggml‑org در 7 اکتبر 2026 نسخه b11466 از llama.cpp را منتشر کرد. این بهروزرسانی بررسی supports_op در flash_attn را برای جفتهای همپوشان کلید و مقدار اصلاح میکند. همچنین باینریهای آمادهاجرا برای macOS با Apple Silicon، macOS با پردازندههای Intel، iOS و چند نسخه اوبونتو (CPU، Vulkan و CUDA 12.8) ارائه میدهد. فایلها را میتوان از صفحه انتشار در GitHub دانلود کرد.
چرا مهم است
توسعهدهندگان میتوانند تازهترین کد llama.cpp را روی پلتفرمهای بیشتری، بدون نیاز به ساخت از کد منبع، اجرا کنند.