Oossa

llama.cpp 更新修复 CUDA 版本检查回归问题

2026年10月8日发布的版本修正了一处版本判断漏洞,解决了新版 CCCL 下 CUDA 参数排序变慢的问题。

简讯作者: Oossa 发布日期: 1 分钟阅读

llama.cpp 项目于2026年10月8日发布 b11509 版。该版本修复了一个 CUDA 版本判断问题:程序将 CCCL 4.x 误判为较旧版本,导致 argsort 操作性能悄然下降。此次修复以单个打包整数比较替代逐项检查,恢复了快速的跨步迭代器路径。该改动已在搭载 CUDA 13.4 的 RTX 4070 上测试,并通过所有后端测试。

为什么重要

在较新的 CUDA 环境中使用 llama.cpp 的开发者无需更改代码,就能获得更快的排序性能。

这篇文章有帮助吗?
分享

继续阅读

Oossa · 新闻简报

一周 AI,讲明白

每周一,用通俗的语言讲清值得知道的新闻。免费,无垃圾邮件。