أصدر مشروع llama.cpp الإصدار b11552 في 2026‑10‑10. ويمنع التغيير الطلب من تحديث ذاكرة التخزين المؤقت للموجّه في خانة قيد الاستخدام. في السابق، كان يُكتب فوق الخانة المشغولة، ما يؤدي إلى مواصلة التوليد بسياق غير صحيح. أما الآن، فتُترك الخانة المشغولة كما هي، وينتظر الطلب الجديد إلى أن تصبح الخانة متاحة.
لماذا يهم
سيواجه المطورون الذين يستخدمون llama.cpp أخطاء أقل في التوليد عند مشاركة عدة طلبات للذاكرة نفسها في وحدة GPU.