# llama.cpp 更新修复 CUDA 版本检查回归问题

> 2026年10月8日发布的版本修正了一处版本判断漏洞，解决了新版 CCCL 下 CUDA 参数排序变慢的问题。

Oossa · 2026-10-08 · https://oossa.com/zh/llama-cpp-update-fixes-cuda-version-check-regression

llama.cpp 项目于2026年10月8日发布 b11509 版。该版本修复了一个 CUDA 版本判断问题：程序将 CCCL 4.x 误判为较旧版本，导致 argsort 操作性能悄然下降。此次修复以单个打包整数比较替代逐项检查，恢复了快速的跨步迭代器路径。该改动已在搭载 CUDA 13.4 的 RTX 4070 上测试，并通过所有后端测试。

## 事实

- 版本标签 b11509 于2026-10-08发布
- 在搭载 CUDA 13.4 的 RTX 4070（sm_89）上完成测试

## 为什么重要

在较新的 CUDA 环境中使用 llama.cpp 的开发者无需更改代码，就能获得更快的排序性能。

## 来源与参考

1. [ggml-org/llama.cpp b11509](https://github.com/ggml-org/llama.cpp/releases/tag/b11509) – llama.cpp, 2026-10-08

最后更新: 2026-10-08
