أعلن فريق ggml-org عن إصدار llama.cpp b11510 في 8 أكتوبر 2026. ويضيف الإصدار نواة PAD حلقية لـCUDA، تتيح للمكتبة معالجة المصفوفات التي تضم أكثر من 65,000 صف أو شريحة. كما يتضمن ملفات تنفيذية جاهزة لأجهزة Apple Silicon، وأنظمة macOS بمعالجات Intel، وiOS، وعدة إصدارات من Ubuntu (للمعالجة المركزية وVulkan وCUDA 12.8). ويمكن الوصول إلى الشيفرة وإثباتات صحتها عبر صفحة GitHub.
لماذا يهم
أصبح بإمكان المطورين تشغيل نماذج لغوية أكبر على وحدات معالجة الرسوميات من NVIDIA من دون الاصطدام بحد الصفوف السابق.