# llama.cpp يدعم التنبؤ متعدد الرموز في GLM5‑Next مع تحسينات للسرعة

> يدعم مشغّل نماذج اللغة الكبير مفتوح المصدر الآن رأس MTP جديدًا في GLM5‑Next، ما يخفض زمن اللحاق بأربعة رموز إلى 0.33 ms.

Oossa · 2026-10-07 · https://oossa.com/ar/llama-cpp-adds-glm5-next-multi-token-prediction-and-speed-tweaks

أصدر مشروع llama.cpp الإصدار b11474 في 2026‑10‑07. ويضيف الإصدار إلى مشغّل النماذج مخططًا للتنبؤ متعدد الرموز (MTP) في GLM5‑Next، يُسمّى NextN. ويتيح هذا التغيير تخطي العمليات الحسابية غير الضرورية عند عدم الحاجة إلى صفوف مخرجات، ما يخفض زمن اللحاق بأربعة رموز من 6.9 ms إلى 0.33 ms. كما يعالج التحديث عقود الاستخراج ويحسّن التعامل مع عمليات التراجع الجزئي في النماذج التكرارية.

## الحقائق

- صدر الإصدار b11474 في 2026‑10‑07 ("Wed Oct 07 2026 15:42:20 GMT+0200")
- انخفض زمن اللحاق بأربعة رموز من 6.9 ms إلى 0.33 ms

## لماذا يهم

يمكن للمطورين الآن تشغيل نماذج llama.cpp بسرعة أكبر، خصوصًا عند استخدام التوليد المعتمد على المسودات الذي يستفيد من التنبؤ متعدد الرموز.

## المصادر والمراجع

1. [ggml-org/llama.cpp b11474](https://github.com/ggml-org/llama.cpp/releases/tag/b11474) – llama.cpp, 2026-10-07

آخر تحديث: 2026-10-07
