Oossa

llama.cpp يضيف نواة MMA لعدة أنواع مكمّمة

يوسّع تحديث 7 أكتوبر 2026 نواة Metal لتدعم BF16 وQ-Types وغيرها، ويسرّع ضرب المصفوفات على أجهزة Apple M3 Ultra.

خبر موجزبقلم نشرته Oossa: 1 دقائق قراءة

أصدر مشروع llama.cpp الإصدار b11476 في 7 أكتوبر 2026. ويضيف نواة عامة لعمليات MMA (الضرب والتجميع للمصفوفات) تعمل مع BF16 وQ1_0 وQ2_0 وMXFP4 وQ2_K وQ3_K وTQ2_0 وعدة تنسيقات IQ. تعمل النواة عند أعداد مختلفة من الصفوف: 5 صفوف لـTQ2_0، و4 لـBF16، و3 لـMXFP4 وQ2_0 وQ2_K وIQ4_NL، وصفّان للأنواع الأخرى. وعند هذه الحدود، تتفوق على الأنوية السابقة على جهاز Apple M3 Ultra. وتُظهر الاختبارات المعيارية أن التغيير يسرّع العمليات من 0.23 إلى 0.98 ثانية عند بلوغ الحد، كما يحسّن أزمنة التنفيذ عبر نطاقات أخرى من أعداد الصفوف.

لماذا يهم

يستطيع المطورون تشغيل نماذج Llama المكمّمة بسرعة أكبر على أجهزة Mac المزودة بشرائح M3 Ultra، ما يقلل زمن الاستدلال في التطبيقات.

هل كان هذا المقال مفيدًا؟
مشاركة

اقرأ أيضًا

Oossa · النشرة البريدية

أسبوع الذكاء الاصطناعي، مشروحًا

كل يوم اثنين: الأخبار التي تستحق المعرفة، بلغة بسيطة. مجانًا وبلا رسائل مزعجة.