# llama.cpp、幅512超に対応するCUDAカーネルを追加

> 2026年10月8日のリリースで、NVIDIA GPU向けに幅1,024〜8,192を処理できる新しい高速フーリエ・アダマール変換カーネルが追加されました。

Oossa · 2026-10-08 · https://oossa.com/ja/llama-cpp-adds-cuda-kernels-for-block-widths-over-512

llama.cppプロジェクトは2026年10月8日、バージョンb11482をリリースしました。幅512を超えるブロックに対応するCUDA FWHTカーネルが追加され、FP32とFP16の両方で幅1,024〜8,192を処理できるようになりました。この変更では既存のF16基盤を再利用しており、A10 GPUでテストに合格しています。既存のワープ幅カーネル（64〜512）に変更はありません。

## 事実

- リリースタグはb11482、公開日は2026年10月8日
- 新しいカーネルはFP32とFP16で幅1,024〜8,192に対応

## なぜ重要か

GPUユーザーは、llama.cppでより幅の大きい行列乗算をより高速に実行できるようになります。

## 出典と参考資料

1. [ggml-org/llama.cpp b11482](https://github.com/ggml-org/llama.cpp/releases/tag/b11482) – llama.cpp, 2026-10-08

最終更新: 2026-10-08
