ggml-orgチームは4 October 2026、llama.cppのバージョンb11391を公開した。今回のアップデートでは、CUDAの変数blocks_per_colを使用箇所に移動した。この変更はAdrien Gallouëtが承認している。また、macOS Apple Silicon、macOS Intel、iOS、および複数のUbuntuビルド(CPU、Vulkan、CUDA 12)向けの新しいプリコンパイル済みバイナリも同梱する。すべてのファイルはGitHubのリリースページからダウンロードできる。
なぜ重要か
開発者は、より多くのハードウェアでllama.cppをすぐに実行できるようになる。特にCUDA対応GPUを使う人にとって有用だ。