ggml-orgチームは2026年9月30日、llama.cppの新バージョンをリリースした。MUSA GPUドライバーでCUDA_ARCHが定義されず、一部のカーネルが空のままコンパイルされる問題を修正。適切にアーキテクチャを検出する仕組みを追加し、重複していたチェックを削除した。今回のリリースでは、多数のビルド済みバイナリも公開。LinuxとWindows向けのCUDA 12.8および13.4に加え、各種ARMやApple Siliconの環境にも対応している。
なぜ重要か
開発者は手動でパッチを適用せずに、MUSA GPUや新しいCUDAバージョンでLlama.cppを実行できる。