أصدر فريق ggml‑org الإصدار b11391 من llama.cpp في 4 أكتوبر 2026. ينقل التحديث متغير CUDA يُسمى blocks_per_col إلى الموضع الذي يُستخدم فيه، وهو تغيير أقرّه Adrien Gallouët. ويتضمن الإصدار أيضًا ملفات جديدة مُجمّعة مسبقًا لأجهزة macOS المزودة بمعالجات Apple Silicon، وأجهزة macOS بمعالجات Intel، ونظام iOS، وعدة إصدارات من Ubuntu (CPU وVulkan وCUDA 12). تتوفر جميع الملفات للتنزيل من صفحة الإصدار على GitHub.
لماذا يهم
بات بإمكان المطورين تشغيل llama.cpp على مزيد من الأجهزة مباشرةً، ولا سيما مستخدمي وحدات معالجة الرسومات الداعمة لـCUDA.