تیم ggml‑org نسخه b11498 از llama.cpp را در 2026‑10‑08 منتشر کرد. این بهروزرسانی ایرادی در کرنل CUDA را برطرف میکند که وقتی بعضی ابعاد تانسورها از محدودیتهای شبکه GPU فراتر میرفتند، رخ میداد. همچنین باینریهای ازپیشکامپایلشده تازهای برای Apple Silicon، مکهای مبتنی بر Intel، iOS و چند پیکربندی Ubuntu ارائه میکند؛ از جمله نسخههای CPU، Vulkan و CUDA 12.8.
چرا مهم است
توسعهدهندگان حالا میتوانند llama.cpp را روی مجموعه گستردهتری از پیکربندیهای GPU، بدون ازکارافتادن برنامه اجرا کنند و برای پلتفرم خود باینریهای آماده در اختیار داشته باشند.