开源项目 llama.cpp 于 2026 年 10 月 11 日发布 b11558 版。此次更新修复了一个漏洞:使用 Q4_K 量化权重时,OpenCL 内核会超出设备图像限制。更新还为达到这些限制的设备增加了备用处理路径,并修正了 Q4_0 内核的广播和 RMS 归一化计算。此次改动由 Qualcomm 的 Hongqiang Wang 共同参与编写。
为什么重要
在 GPU 上使用 llama.cpp 的开发者现在可以在更多硬件上运行 Q4_K 量化模型,避免程序崩溃。
llama.cpp b11558 版于 2026 年 10 月 11 日发布,改进了 OpenCL 对 Q4_K 权重图像的处理,并修复了多个内核错误。
简讯作者: OossaOossa 发布日期: 1 分钟阅读
开源项目 llama.cpp 于 2026 年 10 月 11 日发布 b11558 版。此次更新修复了一个漏洞:使用 Q4_K 量化权重时,OpenCL 内核会超出设备图像限制。更新还为达到这些限制的设备增加了备用处理路径,并修正了 Q4_0 内核的广播和 RMS 归一化计算。此次改动由 Qualcomm 的 Hongqiang Wang 共同参与编写。
在 GPU 上使用 llama.cpp 的开发者现在可以在更多硬件上运行 Q4_K 量化模型,避免程序崩溃。
Oossa · 新闻简报
一周 AI,讲明白
每周一,用通俗的语言讲清值得知道的新闻。免费,无垃圾邮件。