أعلن فريق ggml-org إصدار llama.cpp b11499 في 8 أكتوبر 2026. ويعدّل التحديث الواجهة الخلفية لـ CUDA لاستخدام خطوات بالبايت في عملية roll، ما يتيح لوحدة معالجة الرسوميات التعامل مع البيانات غير المتجاورة على نحو صحيح. ويضم الإصدار أيضًا ملفات تشغيل جديدة جاهزة لـ Apple Silicon وأجهزة Mac بمعالجات Intel وiOS وعدة إصدارات من Ubuntu، تشمل CPU وVulkan وCUDA 12. ويمكن تنزيل جميع الملفات من صفحة الإصدار على GitHub.
لماذا يهم
يمكن للمطورين تشغيل llama.cpp على مجموعة أوسع من إعدادات وحدات معالجة الرسوميات من دون أخطاء، ما يوسّع استخدام نماذج اللغة الكبيرة محليًا على أجهزة الكمبيوتر المكتبية والخوادم.