ggml-org/llama.cppライブラリは2026年10月7日、バージョンb11475をリリースしました。Metal(Apple GPU)バックエンドで、融合されたMUL_MAT+ADD演算が誤った残差行列を選択し、1回の処理で複数の行列乗算を行うモデルの結果が不正になるバグを修正しています。この修正により、エンコーダーが正しいオペランドを選ぶようになり、Metal GPUで正確な出力が得られるようになりました。
なぜ重要か
Apple GPUでllama.cppを使う開発者は、従来のように確率が一様になるのではなく、信頼できるモデル出力を得られるようになります。