أصدر مشروع llama.cpp الإصدار b11482 في 8 أكتوبر 2026. ويضيف نوى CUDA لتحويل فورييه السريع-هادَمار (FWHT) تعمل مع أحجام كتل تتجاوز 512، لتوسّع نطاق الدعم إلى 1,024–8,192 لبيانات FP32 وFP16. ويعيد هذا التغيير استخدام البنية التحتية الحالية لـF16، وقد اجتاز الاختبارات على وحدة معالجة الرسوميات A10. أما النوى الحالية بعرض الموجة (64–512)، فتبقى دون تغيير.
لماذا يهم
بات بإمكان مستخدمي وحدات معالجة الرسوميات تنفيذ عمليات ضرب المصفوفات بأحجام أكبر وبسرعة أعلى باستخدام llama.cpp.