# llama.cpp يضيف تحميل F32 بمحاذاة 2 لمعالجات Intel Vulkan

> يعزز التحديث سرعة ضرب المصفوفات على وحدات Intel GPU عبر تحميل قيمتين عشريتين في كل مرة.

Oossa · 2026-09-30 · https://oossa.com/ar/llama-cpp-adds-2-aligned-f32-loads-for-intel-vulkan-builds

أصدر مشروع llama.cpp تصحيحًا يغيّر طريقة تحميل شيفرة Vulkan للقيم العشرية ذات 32 بت (F32). ففي وحدات Intel GPU، يكون تحميل قيمتين معًا أسرع من تحميلهما واحدة تلو الأخرى، لذا تستخدم الآلية الجديدة تحميلًا بمحاذاة 2 ضمن الروتين mul_mat_vec. ويضيف التغيير أيضًا فحصًا للمحاذاة كان مفقودًا. وأظهرت الاختبارات المعيارية على لوحة الاختبار B60 أداءً يصل إلى 1.63 TFLOPS لبعض أحجام المصفوفات، في تحسن ملحوظ مقارنة بالإصدار السابق.

## الحقائق

- صدر التصحيح في 30 سبتمبر 2026 (b11266)
- زيادة السرعة إلى 1.63 TFLOPS عند استخدام مصفوفة بأبعاد 4096×8×14336

## لماذا يهم

تعني الحسابات الأسرع على GPU استدلالًا أسرع لنماذج اللغة الكبيرة للمستخدمين الذين يشغّلون llama.cpp على أجهزة Intel.

## المصادر والمراجع

1. [ggml-org/llama.cpp b11266](https://github.com/ggml-org/llama.cpp/releases/tag/b11266) – llama.cpp, 2026-09-29
2. [ggml-org/llama.cpp b11267](https://github.com/ggml-org/llama.cpp/releases/tag/b11267) – llama.cpp, 2026-09-30

آخر تحديث: 2026-09-30
