أصدر مشروع llama.cpp نسخة جديدة في 30 سبتمبر 2026. وتضيف النسخة دعم GLM‑5.3‑Flash، المعروف أيضًا باسم GLM5‑Next، وهو بنية أحدث للنماذج اللغوية. كما يقلّص التحديث حجم مخزن الحسابات المؤقت، ويسرّع فك الترميز في السياقات الطويلة، ويصلح عدة أخطاء تتعلق بالتعامل مع الرموز وذاكرة GPU. وتستهدف هذه التغييرات المطورين الذين يشغّلون النماذج اللغوية الكبيرة محليًا على وحدات المعالجة المركزية أو الرسومية.
لماذا يهم
تتيح الميزات الجديدة للمستخدمين تشغيل أحدث نماذج GLM على أجهزتهم بسرعة أكبر وباستهلاك أقل للذاكرة.