ggml‑org/llama.cppプロジェクトは、2026-10-09にバージョンb11530をリリースした。この変更により、ubatch間でバックエンドのサンプリンググラフが固定され、reserveやdecodeの処理中にグラフの形状が変わらなくなる。reserve時に構築したグラフからトポロジーが変化した際に発生していたクラッシュを修正する。修正は、macOS、Linux、Android、Windows、openEulerの各ビルドと、CUDA、Vulkan、OpenCLなどすべてのハードウェアバックエンドに適用される。
なぜ重要か
llama.cppを使う開発者は、対応するCPUやGPUで複数出力の生成を実行する際、実行時エラーが減ることを期待できる。