ggml‑org 团队于 2026 年 10 月 4 日发布 llama.cpp b11391 版。此次更新将名为 blocks_per_col 的 CUDA 变量移至实际使用的位置,该改动由 Adrien Gallouët 签署确认。新版还附带适用于 macOS Apple Silicon、macOS Intel、iOS 以及多个 Ubuntu 版本(CPU、Vulkan 和 CUDA 12)的预编译程序。所有文件均可从 GitHub 发布页面下载。
为什么重要
开发者现在可以更方便地在更多硬件上运行 llama.cpp,尤其是使用支持 CUDA 的 GPU 的用户。