پروژه llama.cpp نسخه b11554 را در 2026‑10‑11 منتشر کرد. این بهروزرسانی اصلاحاتی ویژه Vulkan دارد که شناسههای ردیف تکراری را در ضرب ماتریسی تشخیص میدهد و بهجای پردازش در یک حلقه، آنها را در مرحلهای مقدماتی مدیریت میکند. همچنین بهینهسازی «hoist row ids» را بهبود میدهد تا همیشه اجرا شود و بتواند چندین کاشی فشرده تولید کند. این تغییرات به GPU اجازه میدهند گروههای کاری کمتری اجرا کند و در صورت امکان زودتر کار را متوقف کند.
چرا مهم است
کاربران GPU در llama.cpp میتوانند از استنتاج سریعتری بهره ببرند، چون کتابخانه دیگر محاسبات یکسان را تکرار نمیکند.