تیم ggml‑org نسخه b11391 از llama.cpp را در ۴ اکتبر ۲۰۲۶ منتشر کرد. در این بهروزرسانی، متغیر CUDA با نام blocks_per_col به محلی منتقل شده که از آن استفاده میشود؛ تغییری که Adrien Gallouët تأیید کرده است. این نسخه همچنین فایلهای اجرایی ازپیشکامپایلشدهٔ تازهای برای macOS با Apple Silicon، macOS با پردازندههای Intel، iOS و چند نسخهٔ Ubuntu (CPU، Vulkan و CUDA 12) دارد. همهٔ فایلها از صفحهٔ انتشار در GitHub قابل دانلود هستند.
چرا مهم است
توسعهدهندگان حالا میتوانند llama.cpp را بدون نیاز به آمادهسازی جداگانه روی سختافزارهای بیشتری اجرا کنند؛ بهویژه کسانی که از GPUهای سازگار با CUDA استفاده میکنند.