ggml-orgチームは2026年9月30日、llama.cppのバージョンb11270を公開した。AMDのHIPプラットフォームで使われるGPU演算を変更し、低速なバイト減算命令をより高速な命令に置き換えた。また、Apple SiliconおよびIntel搭載Mac、iOS、複数のUbuntu環境向けに新しいバイナリパッケージを同梱。Vulkan対応のGPU版も含まれる。
なぜ重要か
このGPU最適化によりAMD製ハードウェアでの推論が高速化する可能性がある。すぐに実行できるバイナリが用意されたことで、より多くのプラットフォームで開発者がllama.cppを試しやすくなる。