# llama.cpp、WebGPUでDUP演算に対応

> llama.cppのバージョンb11523で修正され、混合バッチのモデル実行時にクラッシュする問題が解消された。

Oossa · 2026-10-09 · https://oossa.com/ja/llama-cpp-adds-webgpu-support-for-duplicate-operation

オープンソースのllama.cppライブラリは2026年10月9日、バージョンb11523をリリースした。今回のアップデートでは、WebGPU上でDUP演算を実行しようとするとクラッシュする問題が修正された。従来は、ほかの処理がWebGPU上で行われる一方、DUPはCPUで実行されていたため、バッファーの不整合が発生してクラッシュしていた。DUPはCPY（コピー）やCONT演算と同じコードパスを使うようになり、WebGPU上で実行される。

## 事実

- バージョンb11523は2026-10-09にリリース
- 修正によりGGML_OP_DUP演算がWebGPUに対応

## なぜ重要か

WebGPUを使うユーザーは、混合バッチのモデルを実行してもプログラムがクラッシュしなくなる。

## 出典と参考資料

1. [ggml-org/llama.cpp b11523](https://github.com/ggml-org/llama.cpp/releases/tag/b11523) – llama.cpp, 2026-10-09

最終更新: 2026-10-09
