ggml‑orgチームは2026年10月8日、llama.cppのバージョンb11501を公開しました。今回の更新では、クロスプラットフォームのコンピュートAPIであるSYCLの高速ウォルシュ・アダマール変換(FWHT)を最適化し、一部の行列演算を高速化できるようにしました。また、macOSのApple Silicon搭載機とIntel搭載機、iOS向けに加え、CPU、Vulkan、CUDA 12.8に対応するUbuntu向けのすぐに使えるバイナリも提供します。
なぜ重要か
開発者はSYCL対応GPUでLlamaモデルをより速く実行でき、ライブラリを自分でビルドする手間も省けます。