أصدر فريق ggml-org الإصدار b11487 من llama.cpp. ويضيف الإصدار دعم GET_ROWS المبلّط لتنسيقي Q4_K وQ6_K على معالجات Hexagon، ويحسّن التعامل مع عروض Q4_K. كما تتوفر ملفات ثنائية جاهزة لأجهزة Apple Silicon، وأجهزة Mac بمعالجات Intel، ونظام iOS، وعدة إصدارات من Ubuntu (للمعالجة المركزية وVulkan). ويمكن تنزيل التحديث من صفحة الإصدارات على GitHub.
لماذا يهم
بات بإمكان المطورين تشغيل نماذج Llama بكفاءة أكبر على الأجهزة المعتمدة على Hexagon، مثل شرائح Qualcomm، ما يحسّن الأداء على الأجهزة المحمولة والمدمجة المدعومة.