أصدر فريق ggml‑org الإصدار llama.cpp b11527 في 2026-10-09. وينقل التحديث جميع عمليات WebGPU إلى توزيع مجموعات العمل ثنائي الأبعاد، مستغنيًا عن الطريقة الأحادية الأبعاد السابقة. كما يتضمن ملفات ثنائية جديدة مُجمّعة مسبقًا لأنظمة macOS (بمعالجات Apple Silicon وIntel) وiOS، وعدة إعدادات من Ubuntu، تشمل إصدارات Vulkan وCUDA. وتهدف هذه التغييرات إلى تحسين سلاسة أداء GPU في المتصفحات وتسهيل الإعداد على الأجهزة المدعومة.
لماذا يهم
يمكن للمطورين تشغيل نماذج اللغة الكبيرة بسرعة أكبر في المتصفحات التي تدعم WebGPU، من دون الحاجة إلى كتابة شيفرة مخصصة للأنوية البرمجية.