# llama.cpp يدعم الآن تخزين MoE المؤقت على عدة وحدات GPU

> تتيح مكتبة Llama.cpp مفتوحة المصدر الآن تشغيل نماذج مزيج الخبراء عبر عدة وحدات GPU.

Oossa · 2026-10-08 · https://oossa.com/ar/llama-cpp-adds-multi-gpu-moe-cache-support

أصدر فريق ggml‑org الإصدار b11507 من llama.cpp في October 8, 2026. ويضيف التحديث دعمًا لذاكرة تخزين مؤقت لمزيج الخبراء (MoE) يمكن توزيعها على عدة وحدات GPU. وهذا يتيح للمطورين تشغيل نماذج MoE أكبر من دون الحاجة إلى وضع كل شيء على بطاقة واحدة. ويتضمن الإصدار أيضًا حزمًا ثنائية جديدة لأنظمة macOS وiOS وعدة إعدادات من Linux، بما فيها دعم CUDA 12.8.

## الحقائق

- نُشر الإصدار b11507 في 2026-10-08
- إضافة دعم لذاكرة تخزين MoE المؤقتة عبر عدة وحدات GPU

## لماذا يهم

بات بإمكان المطورين تشغيل نماذج ذكاء اصطناعي أكبر وأكثر قدرة على أجهزة تضم عدة وحدات GPU، ما يوسع إمكانات الأجهزة الشخصية.

## المصادر والمراجع

1. [ggml-org/llama.cpp b11507](https://github.com/ggml-org/llama.cpp/releases/tag/b11507) – llama.cpp, 2026-10-08

آخر تحديث: 2026-10-08
