أصدر فريق ggml‑org الإصدار b11293 من llama.cpp. ويضيف عمليات أحادية وGLU وثنائية وعمليات قياس من نوع BF16 (تنسيق أرقام بنصف الدقة) لكل من المعالجات المركزية وCUDA. كما يحدّث التغيير نوى CUDA لإصلاح مشكلة في بناء BF16. يتوفر التحديث على منصات كثيرة، من macOS وWindows إلى Linux وAndroid.
لماذا يهم
يمكن للمطورين الآن تشغيل نماذج llama.cpp بسرعة أكبر على الأجهزة التي تدعم BF16، مثل وحدات معالجة الرسومات الأحدث.