# إصدار llama.cpp ‏b11494 يحسّن أداء CUDA

> تستخدم مكتبة Llama.cpp مفتوحة المصدر الآن أربعة أعمدة لحالة GDN لكل warp في CUDA، ما يعزز أداء GPU.

Oossa · 2026-10-08 · https://oossa.com/ar/llama-cpp-release-b11494-adds-cuda-warp-optimizations

أصدر فريق ggml‑org الإصدار b11494 من llama.cpp. ويغيّر التحديث آلية عمل واجهة CUDA الخلفية، بحيث تخصص أربعة أعمدة لحالة GDN لكل warp بدلًا من عمودين. وأصبح هذا الإعداد هو الافتراضي الآن. تتوفر للتنزيل ملفات ثنائية لأنظمة macOS (Apple Silicon وIntel) وiOS، وعدة إصدارات من Ubuntu.

## الحقائق

- نُشر وسم الإصدار b11494 في 2026-10-08
- ضُبطت قيمة cols_per_warp الافتراضية في CUDA على 4

## لماذا يهم

يمكن للمطورين الذين يستخدمون llama.cpp على وحدات GPU من NVIDIA توقع استدلال أسرع من دون الحاجة إلى تغيير شيفراتهم.

## المصادر والمراجع

1. [ggml-org/llama.cpp b11494](https://github.com/ggml-org/llama.cpp/releases/tag/b11494) – llama.cpp, 2026-10-08

آخر تحديث: 2026-10-08
