أصدر فريق ggml‑org الإصدار b11531 من llama.cpp. ويعيد الإصدار هيكلة API المحادثة، ويتضمن ملفات تنفيذية جاهزة لأنظمة macOS (بمعالجات Apple Silicon وIntel) وiOS وعدة إصدارات من Ubuntu، بما فيها نسخ CPU وVulkan وCUDA 12.8. تتوفر روابط التنزيل على صفحة الإصدار في GitHub. ويمكن للمستخدمين الآن تشغيل النماذج اللغوية الكبيرة محليًا على مزيد من المنصات من دون الحاجة إلى تجميعها بأنفسهم.
لماذا يهم
يمكن للمطورين تشغيل نماذج Llama محليًا على مزيد من الأجهزة اليوم، من دون خطوات البناء، مع دعم تسريع GPU على Ubuntu.