Oossa

llama.cpp、WebGPUでDUP演算に対応

llama.cppのバージョンb11523で修正され、混合バッチのモデル実行時にクラッシュする問題が解消された。

短信著者: Oossa公開日: 1 分で読める

オープンソースのllama.cppライブラリは2026年10月9日、バージョンb11523をリリースした。今回のアップデートでは、WebGPU上でDUP演算を実行しようとするとクラッシュする問題が修正された。従来は、ほかの処理がWebGPU上で行われる一方、DUPはCPUで実行されていたため、バッファーの不整合が発生してクラッシュしていた。DUPはCPY(コピー)やCONT演算と同じコードパスを使うようになり、WebGPU上で実行される。

なぜ重要か

WebGPUを使うユーザーは、混合バッチのモデルを実行してもプログラムがクラッシュしなくなる。

この記事は役に立ちましたか?
共有

次に読む

Oossa · ニュースレター

今週のAIを、わかりやすく

毎週月曜日、知っておきたいニュースをやさしい言葉で。無料・スパムなし。