ggml‑org/llama.cpp 库于 2026年10月7日发布 b11475 版本。该版本修复了 Metal(Apple GPU)后端的一个错误:融合 MUL_MAT+ADD 运算时选错了残差矩阵,导致在单步中使用多次矩阵乘法的模型产生错误结果。此次修复让编码器选取正确的操作数,使 Metal GPU 上的输出恢复准确。
为什么重要
在 Apple GPU 上使用 llama.cpp 的开发者现在可以获得可靠的模型输出,不再像之前那样得到几乎一致的概率。
2026年10月7日发布的版本修正了 Metal 后端的一个错误,该错误会导致部分模型输出错误概率。
简讯作者: OossaOossa 发布日期: 1 分钟阅读
ggml‑org/llama.cpp 库于 2026年10月7日发布 b11475 版本。该版本修复了 Metal(Apple GPU)后端的一个错误:融合 MUL_MAT+ADD 运算时选错了残差矩阵,导致在单步中使用多次矩阵乘法的模型产生错误结果。此次修复让编码器选取正确的操作数,使 Metal GPU 上的输出恢复准确。
在 Apple GPU 上使用 llama.cpp 的开发者现在可以获得可靠的模型输出,不再像之前那样得到几乎一致的概率。
Oossa · 新闻简报
一周 AI,讲明白
每周一,用通俗的语言讲清值得知道的新闻。免费,无垃圾邮件。