ggml-orgチームは2026年10月8日、llama.cppのバージョンb11493を公開した。今回のアップデートでは、大規模言語モデルで使われる行列乗算であるGrouped Mixture-of-Experts(MoE)XMX GEMMのSYCL実装が追加された。また、macOS、iOS、Ubuntu向けのビルド済みバイナリも同梱。Ubuntu版はCPU、Vulkan、CUDAに対応する。
なぜ重要か
SYCL対応GPUでMoEベースのモデルを実行できるようになり、オープンソースの大規模言語モデルを動かす際のハードウェアの選択肢が広がる。