ggml-org 团队于 2026 年 9 月 30 日发布了 llama.cpp 新版。新版修复了 MUSA GPU 驱动未定义 CUDA_ARCH、导致部分内核编译结果为空的问题。补丁新增了正确的架构检测,并移除了多余的检查。此次发布还列出了多种预编译二进制文件,现已涵盖适用于 Linux 和 Windows 的 CUDA 12.8 和 13.4 版本,以及对多种 ARM 和 Apple Silicon 目标平台的支持。
为什么重要
开发者现在无需手动打补丁,就能在 MUSA GPU 和较新版本的 CUDA 上运行 Llama.cpp。