# llama.cpp更新、Q4_Kの重み制限に関するOpenCLの問題を修正

> llama.cppのリリースb11558（2026年10月11日）では、Q4_Kの重み画像に対するOpenCL処理が改善されました。

Oossa · 2026-10-11 · https://oossa.com/ja/llama-cpp-update-adds-opencl-fixes-for-q4-k-weight-limits

オープンソースのllama.cppプロジェクトは、2026年10月11日にバージョンb11558をリリースしました。今回の更新では、Q4_K量子化重みを使う際、OpenCLカーネルがデバイスの画像サイズ上限を超えてしまうバグを修正しています。また、この上限に達するデバイス向けのフォールバック処理を追加し、Q4_0カーネルのブロードキャストとRMSノルムの計算に関する問題も修正しました。これらの変更は、QualcommのHongqiang Wang氏との共同開発によるものです。

## 事実

- リリースb11558は2026-10-11に公開
- Q4_K dense binカーネルのOpenCL画像サイズ上限に関する問題を修正

## なぜ重要か

llama.cppをGPUで使う開発者は、より多くのハードウェアでQ4_K量子化モデルをクラッシュさせずに実行できるようになります。

## 出典と参考資料

1. [ggml-org/llama.cpp b11558](https://github.com/ggml-org/llama.cpp/releases/tag/b11558) – llama.cpp, 2026-10-11

最終更新: 2026-10-11
