# llama.cpp يضيف نواة MMA لعدة أنواع مكمّمة

> يوسّع تحديث 7 أكتوبر 2026 نواة Metal لتدعم BF16 وQ-Types وغيرها، ويسرّع ضرب المصفوفات على أجهزة Apple M3 Ultra.

Oossa · 2026-10-07 · https://oossa.com/ar/llama-cpp-adds-few-row-mma-kernel-for-many-quantized-types

أصدر مشروع llama.cpp الإصدار b11476 في 7 أكتوبر 2026. ويضيف نواة عامة لعمليات MMA (الضرب والتجميع للمصفوفات) تعمل مع BF16 وQ1_0 وQ2_0 وMXFP4 وQ2_K وQ3_K وTQ2_0 وعدة تنسيقات IQ. تعمل النواة عند أعداد مختلفة من الصفوف: 5 صفوف لـTQ2_0، و4 لـBF16، و3 لـMXFP4 وQ2_0 وQ2_K وIQ4_NL، وصفّان للأنواع الأخرى. وعند هذه الحدود، تتفوق على الأنوية السابقة على جهاز Apple M3 Ultra. وتُظهر الاختبارات المعيارية أن التغيير يسرّع العمليات من 0.23 إلى 0.98 ثانية عند بلوغ الحد، كما يحسّن أزمنة التنفيذ عبر نطاقات أخرى من أعداد الصفوف.

## الحقائق

- نُشر الإصدار b11476 في 7 أكتوبر 2026 ("Wed Oct 07 2026 16:55:09 GMT+0200").
- تدعم نواة MMA الجديدة ذات الصفوف القليلة BF16 وQ-Types وMXFP4 وأنواع IQ، وتعمل بسرعة أكبر على M3 Ultra.

## لماذا يهم

يستطيع المطورون تشغيل نماذج Llama المكمّمة بسرعة أكبر على أجهزة Mac المزودة بشرائح M3 Ultra، ما يقلل زمن الاستدلال في التطبيقات.

## المصادر والمراجع

1. [ggml-org/llama.cpp b11476](https://github.com/ggml-org/llama.cpp/releases/tag/b11476) – llama.cpp, 2026-10-07

آخر تحديث: 2026-10-07
