نشر مشروع llama.cpp إصدارًا تمهيديًا جديدًا باسم b11517 في 9 Oct 2026. ويضيف التحديث خيارًا في CUDA يتيح للمستخدمين تمرير دقة source-1 إلى مساعدات MMQ، وهي جزء منخفض المستوى من شيفرة GPU. وقد وقّع التغيير مساهم من NVIDIA، وينطبق على إصدارات CUDA 12 و13 المدرجة لنظامي Linux وWindows. ويتضمن الإصدار أيضًا أهداف بناء لمنصات أخرى كثيرة، من أجهزة Mac المزودة بمعالجات Apple Silicon إلى أجهزة Android المزودة بمعالجات Snapdragon.
يتوفر التحديث على صفحة المشروع في GitHub وموقع llama.app.
لماذا يهم
بات بإمكان المطورين التحكم في دقة GPU عند استخدام llama.cpp، ما قد يحسّن الأداء أو يقلل استهلاك الذاكرة عند تشغيل نماذج LLaMA.