کتابخانهٔ ggml‑org/llama.cpp نسخهٔ b11475 را در ۷ اکتبر ۲۰۲۶ منتشر کرد. این نسخه باگی را در بکاند Metal (پردازندهٔ گرافیکی اپل) برطرف میکند که در آن، عملیات ترکیبی MUL_MAT+ADD ماتریس باقیماندهٔ اشتباهی را انتخاب میکرد و در مدلهایی که در یک گام چند ضرب ماتریسی انجام میدهند، به نتایج نادرست میانجامید. این اصلاح باعث میشود کُدگذار عملوند درست را انتخاب کند و خروجی دقیق را در پردازندههای گرافیکی Metal بازگرداند.
چرا مهم است
توسعهدهندگانی که llama.cpp را روی پردازندههای گرافیکی اپل اجرا میکنند، اکنون خروجیهای قابلاعتمادی از مدلها میگیرند و دیگر با احتمالهای یکنواخت قبلی روبهرو نمیشوند.