تیم ggml‑org نسخهٔ b11528 از llama.cpp را در 2026-10-09 منتشر کرد. این بهروزرسانی باعث میشود کتابخانه نماهای تانسورهای تخصیصیافته در حافظهٔ میزبان را مانند گرههای معمولی در نظر بگیرد و خطای assert قبلی را که هنگام استفاده از گزینهٔ –split-mode tensor رخ میداد، برطرف کند. همچنین پشتیبانی از تانسورهای SM را برای شتابدهندهٔ K2 Horizon بازمیگرداند. این تغییر در انتشار رسمی GitHub گنجانده شده و برای همهٔ پلتفرمهای فهرستشده، از macOS گرفته تا Windows و Linux، اعمال میشود.
چرا مهم است
توسعهدهندگان حالا میتوانند llama.cpp را با کش KV در حالت تقسیمشده روی سختافزارهای بیشتری و بدون خرابی اجرا کنند؛ در نتیجه گزینههای بیشتری برای استنتاج محلی LLM در دسترس است.