ggml-orgチームは2026-10-09、llama.cppのバージョンb11527をリリースした。今回のアップデートでは、すべてのWebGPU処理で2Dワークグループによるディスパッチを採用し、従来の1D方式を廃止した。また、macOS(Apple SiliconおよびIntel)、iOS、Vulkan版やCUDA版を含む複数のUbuntu環境向けに、新たなプリコンパイル済みバイナリを同梱している。ブラウザーでのGPU処理をよりスムーズにし、対応デバイスでのセットアップを簡単にすることを狙った変更だ。
なぜ重要か
開発者はカスタムカーネルコードを用意しなくても、WebGPU対応ブラウザーでLLMをより高速に実行できる。