أصدر فريق ggml‑org الإصدار b11489 من llama.cpp. ويُسرّع التحديث فك تكميم أوزان Q6_K — وهي خطوة تحوّل أوزان النماذج المضغوطة إلى أرقام قابلة للاستخدام — كما يضاعف عامل فكّ التكرار، وفقًا لملاحظات الإصدار. وأصبحت الملفات التنفيذية الجاهزة متاحة الآن لأجهزة Apple Silicon، وأجهزة Intel العاملة بنظام macOS، ونظام iOS، وعدة إعدادات من Ubuntu، بما فيها إصدارات Vulkan وCUDA.
لماذا يهم
يتيح فك التكميم الأسرع للمطورين تشغيل نماذج اللغة الكبيرة على الأجهزة نفسها بزمن استجابة أقل.