llama.cpp 库于 2026 年 10 月 11 日发布 b11559 版本。该版本改进了 OpenCL,可加快因子分配速度,并支持在 Qualcomm E4B 和 E2B GPU 上解码 Gemma‑4。更新还针对多种量化设置优化了 DK64 和 DK128 解码路径。这些改动由 Qualcomm 的 Hongqiang Wang 共同撰写。
为什么重要
开发者现在可以在兼容的 Qualcomm GPU 上更快地运行 Gemma‑4 模型,拓展边缘 AI 的应用能力。
2026 年 10 月 11 日发布的更新提升了 OpenCL 性能,并支持在较新的 Qualcomm GPU 上解码 Gemma‑4。
简讯作者: OossaOossa 发布日期: 1 分钟阅读
llama.cpp 库于 2026 年 10 月 11 日发布 b11559 版本。该版本改进了 OpenCL,可加快因子分配速度,并支持在 Qualcomm E4B 和 E2B GPU 上解码 Gemma‑4。更新还针对多种量化设置优化了 DK64 和 DK128 解码路径。这些改动由 Qualcomm 的 Hongqiang Wang 共同撰写。
开发者现在可以在兼容的 Qualcomm GPU 上更快地运行 Gemma‑4 模型,拓展边缘 AI 的应用能力。
Oossa · 新闻简报
一周 AI,讲明白
每周一,用通俗的语言讲清值得知道的新闻。免费,无垃圾邮件。