نشر فريق ggml‑org الإصدار b11540 من llama.cpp في 10 أكتوبر 2026. ويضيف التحديث دعم SYCL لتسريع نماذج خليط الخبراء (MoE) من نوع MXFP4، باستخدام فك الترميز الحسابي وإعادة ترتيب الأوزان. كما يتضمن ملفات تنفيذية مُعدّة مسبقًا لأنظمة macOS على أجهزة Apple Silicon وIntel، وiOS، وعدة إصدارات من Ubuntu (للمعالج CPU وVulkan وCUDA). ويمكن الاطلاع على التغييرات ضمن الوسم b11540 على GitHub.
لماذا يهم
بات بإمكان المطورين تشغيل نماذج MoE أكبر بسرعة أعلى على وحدات معالجة الرسومات التي تدعم SYCL، ما يوسع خيارات الأجهزة المتاحة لمستخدمي llama.cpp.