ggml-orgチームは2026-10-08、llama.cppのバージョンb11498をリリースしました。今回のアップデートでは、一部のテンソル次元がGPUのグリッド上限を超えた際に発生するCUDAカーネルの問題を修正しています。また、Apple Silicon、Intel搭載Mac、iOS、およびCPU、Vulkan、CUDA 12.8を含む複数のUbuntu環境向けに、新しいプリコンパイル済みバイナリを同梱しています。
なぜ重要か
より多くのGPU環境でクラッシュを起こさずにllama.cppを実行できるようになり、開発者は各プラットフォームですぐに使えるバイナリを入手できます。