أصدر مشروع ggml‑org/llama.cpp الإصدار b11530 بتاريخ 2026‑10‑09. ويُبقي التغيير مخطط أخذ العينات في الواجهة الخلفية ثابتًا عبر الدُفعات المصغّرة، بحيث لا يتغير شكل المخطط أثناء خطوات الحجز وفك الترميز. ويعالج ذلك حالات التعطل التي كانت تحدث عند تغيّر بنية المخطط بعد إنشائه للحجز. وينطبق الإصلاح على جميع الأنظمة المذكورة — macOS وLinux وAndroid وWindows وopenEuler — وعلى جميع الواجهات الخلفية للأجهزة، مثل CUDA وVulkan وOpenCL.
لماذا يهم
سيواجه المطورون الذين يستخدمون llama.cpp أخطاء تشغيل أقل عند تنفيذ عمليات توليد متعددة المخرجات على أي وحدة معالجة مركزية أو رسومية مدعومة.