# llama.cpp 更新修复 OpenCL 的 Q4_K 权重限制问题

> llama.cpp b11558 版于 2026 年 10 月 11 日发布，改进了 OpenCL 对 Q4_K 权重图像的处理，并修复了多个内核错误。

Oossa · 2026-10-11 · https://oossa.com/zh/llama-cpp-update-adds-opencl-fixes-for-q4-k-weight-limits

开源项目 llama.cpp 于 2026 年 10 月 11 日发布 b11558 版。此次更新修复了一个漏洞：使用 Q4_K 量化权重时，OpenCL 内核会超出设备图像限制。更新还为达到这些限制的设备增加了备用处理路径，并修正了 Q4_0 内核的广播和 RMS 归一化计算。此次改动由 Qualcomm 的 Hongqiang Wang 共同参与编写。

## 事实

- b11558 版于 2026-10-11 发布
- 修复了 Q4_K 密集二进制内核的 OpenCL 图像限制问题

## 为什么重要

在 GPU 上使用 llama.cpp 的开发者现在可以在更多硬件上运行 Q4_K 量化模型，避免程序崩溃。

## 来源与参考

1. [ggml-org/llama.cpp b11558](https://github.com/ggml-org/llama.cpp/releases/tag/b11558) – llama.cpp, 2026-10-11

最后更新: 2026-10-11
