أصدر فريق ggml‑org الإصدار b11528 من llama.cpp في 2026-10-09. ويتيح التحديث للمكتبة التعامل مع عروض الموترات المخصّصة في ذاكرة المضيف بوصفها عقدًا عادية، ما يمنع خطأ تأكيد كان يظهر سابقًا عند استخدام خيار –split-mode tensor. كما يعيد دعم موترات SM لمسرّع K2 Horizon. والتغيير مُدرج في الإصدار الرسمي على GitHub، وينطبق على جميع المنصات المذكورة، من macOS إلى Windows وLinux.
لماذا يهم
يمكن للمطورين الآن تشغيل llama.cpp مع تقسيم ذاكرة KV المؤقتة على مزيد من الأجهزة من دون أعطال، ما يوسّع نطاق الإعدادات المتاحة للاستدلال على نماذج اللغة الكبيرة محليًا.