أصدر مشروع ggml‑org/llama.cpp نسخة تمهيدية (بالوسم b11272) في 30 سبتمبر 2026. وتتضمن تحسينًا مخصصًا لـ Hexagon لعملية الدمج (concat)، وهي خطوة شائعة في استدلال النماذج اللغوية. يقلّل التغيير النفقات الإضافية للحزم ويستخدم روتين قسمة أسرع، ما يسرّع الحلقة الأساسية التي تنقل البيانات. ويأتي هذا التحديث ضمن مجموعة أوسع من الإصدارات لمنصات عديدة، منها أجهزة Android المزودة بمعالجات Snapdragon ووحدات Hexagon NPU.
لماذا يهم
يجعل تشغيل النماذج اللغوية الكبيرة على هواتف Snapdragon أسرع بشكل ملحوظ، ويقلّل زمن الاستجابة لمهام الذكاء الاصطناعي على الجهاز.