OossaAI 发展迅速。我们用简单的话讲清楚。

llama.cpp b11270发布:优化GPU减法并新增预编译版本

开源库 llama.cpp 发布 b11270 版本,优化了GPU减法操作,并提供适用于 macOS、iOS 和 Ubuntu 的预编译版本。

简讯Oossa1 分钟阅读

ggml‑org 团队于 2026 年 9 月 30 日发布 llama.cpp b11270 版本。此次更新调整了 AMD HIP 平台使用的一项GPU操作,将较慢的字节减法指令替换为更快的指令。新版本还提供了适用于 macOS(Apple Silicon 和 Intel)、iOS 以及多个 Ubuntu 版本的预编译包,其中包括支持 Vulkan 的GPU版本。

为什么重要

这项GPU优化有望提升 AMD 硬件上的推理速度,而可直接运行的预编译版本也让开发者更容易在更多平台上试用 llama.cpp。

这篇文章有帮助吗?
分享

继续阅读

Oossa · 新闻简报

一周 AI,讲明白

每周一,用通俗的语言讲清值得知道的新闻。免费,无垃圾邮件。

来源与参考

#来源发布方日期要点
1ggml-org/llama.cpp b11270 ↗llama.cpp2026年9月30日<details open> ggml-cuda: HIP: optimize packed byte subtraction (`__vsubss4` -> `__vsub4`) (#29478) * ggml-cuda: HIP: optimize non-saturatin

1 个来源

最后更新: ·Markdown·llms.txt