llama.cpp 项目于2026年10月8日发布 b11509 版。该版本修复了一个 CUDA 版本判断问题:程序将 CCCL 4.x 误判为较旧版本,导致 argsort 操作性能悄然下降。此次修复以单个打包整数比较替代逐项检查,恢复了快速的跨步迭代器路径。该改动已在搭载 CUDA 13.4 的 RTX 4070 上测试,并通过所有后端测试。
为什么重要
在较新的 CUDA 环境中使用 llama.cpp 的开发者无需更改代码,就能获得更快的排序性能。
2026年10月8日发布的版本修正了一处版本判断漏洞,解决了新版 CCCL 下 CUDA 参数排序变慢的问题。
简讯作者: OossaOossa 发布日期: 1 分钟阅读
llama.cpp 项目于2026年10月8日发布 b11509 版。该版本修复了一个 CUDA 版本判断问题:程序将 CCCL 4.x 误判为较旧版本,导致 argsort 操作性能悄然下降。此次修复以单个打包整数比较替代逐项检查,恢复了快速的跨步迭代器路径。该改动已在搭载 CUDA 13.4 的 RTX 4070 上测试,并通过所有后端测试。
在较新的 CUDA 环境中使用 llama.cpp 的开发者无需更改代码,就能获得更快的排序性能。
Oossa · 新闻简报
一周 AI,讲明白
每周一,用通俗的语言讲清值得知道的新闻。免费,无垃圾邮件。