# llama.cpp 更新修复 Metal 矩阵乘加融合错误

> 2026年10月7日发布的版本修正了 Metal 后端的一个错误，该错误会导致部分模型输出错误概率。

Oossa · 2026-10-07 · https://oossa.com/zh/llama-cpp-update-fixes-metal-matrix-multiply-add-fusion-bug

ggml‑org/llama.cpp 库于 2026年10月7日发布 b11475 版本。该版本修复了 Metal（Apple GPU）后端的一个错误：融合 MUL_MAT+ADD 运算时选错了残差矩阵，导致在单步中使用多次矩阵乘法的模型产生错误结果。此次修复让编码器选取正确的操作数，使 Metal GPU 上的输出恢复准确。

## 事实

- b11475 版本于 2026年10月7日发布
- 修复前，Metal 上 28 个测试用例中有 27 个失败

## 为什么重要

在 Apple GPU 上使用 llama.cpp 的开发者现在可以获得可靠的模型输出，不再像之前那样得到几乎一致的概率。

## 来源与参考

1. [ggml-org/llama.cpp b11475](https://github.com/ggml-org/llama.cpp/releases/tag/b11475) – llama.cpp, 2026-10-07

最后更新: 2026-10-07
