ggml‑org 团队于 2026 年 9 月 30 日发布 llama.cpp b11270 版本。此次更新调整了 AMD HIP 平台使用的一项GPU操作,将较慢的字节减法指令替换为更快的指令。新版本还提供了适用于 macOS(Apple Silicon 和 Intel)、iOS 以及多个 Ubuntu 版本的预编译包,其中包括支持 Vulkan 的GPU版本。
为什么重要
这项GPU优化有望提升 AMD 硬件上的推理速度,而可直接运行的预编译版本也让开发者更容易在更多平台上试用 llama.cpp。