# llama.cpp、BF16行列入力のCPU処理を修正

> リリースb11292では、depthwise convolutionで使われるBF16行列入力にCPUが対応。Vulkanの対応判定も厳格化されました。

Oossa · 2026-09-30 · https://oossa.com/ja/llama-cpp-fixes-cpu-handling-for-bf16-matrix-inputs

AIの支援で作成・翻訳しています。以下の原典をご確認ください。

llama.cppのリリースb11292では、カーネルにBF16（16ビット数値形式）を使うdepthwise 1D convolutionで、CPUバックエンドにあった制限が修正されました。CPUバックエンドは計算時に入力を32ビット浮動小数点数へ拡張するようになり、Metalの行列ベクトルカーネルで使われる演算方式と一致します。

このリリースではVulkanの判定も変更されました。2つ目の行列入力にBF16を使えるのは、1つ目の入力もBF16の場合に限られます。それ以外の組み合わせは非対応として扱われ、スケジューラーによってCPUで処理されます。リリースノートにはテストの追加が記載されていますが、パッケージ版アプリに変更が反映される時期や、対象ユーザーについては触れられていません。

## 事実

- リリースはllama.cpp b11292で、2026年9月30日に公開されました。
- リリースノートには、F32、F16、BF16のカーネルを使ったdepthwise convolutionのテストと、2つ目の入力にBF16を使う行列乗算の3つのケースが記載されています。

## なぜ重要か

BF16のdepthwise convolutionを実行する開発者は、これまでCPUバックエンドで処理できなかった組み合わせを扱えるようになりました。ただし、下流のアプリにこの修正が反映される時期は、リリースノートに記載されていません。

## 出典と参考資料

1. [ggml-org/llama.cpp b11292](https://github.com/ggml-org/llama.cpp/releases/tag/b11292) – llama.cpp, 2026-09-30

最終更新: 2026-09-30
