# llama.cpp、b11540でSYCLに対応しMoEの推論を高速化

> オープンソースのllama.cppが2026年10月10日にバージョンb11540を公開。MXFP4 MoEモデル向けのSYCLアクセラレーションに加え、macOS、iOS、Linux用の新しいバイナリを追加した。

Oossa · 2026-10-10 · https://oossa.com/ja/llama-cpp-release-b11540-adds-sycl-support-for-faster-moe-decoding

ggml-orgチームは2026年10月10日、llama.cppのバージョンb11540を公開した。今回のアップデートでは、算術デコードと重みの並べ替えを利用し、MXFP4のMixture of Experts（MoE）モデルを高速化するSYCLサポートが追加された。また、macOS（Apple Silicon、Intel）、iOS、および複数のUbuntu環境（CPU、Vulkan、CUDA）向けのビルド済みバイナリも提供される。変更内容はGitHubのタグb11540に記載されている。

## 事実

- リリースタグb11540は2026年10月10日に公開
- MXFP4 MoEモデル向けのSYCLアクセラレーションを追加

## なぜ重要か

SYCLに対応するGPUで、開発者はより大規模なMoEモデルを高速に実行できるようになり、llama.cppで利用できるハードウェアの選択肢が広がる。

## 出典と参考資料

1. [ggml-org/llama.cpp b11540](https://github.com/ggml-org/llama.cpp/releases/tag/b11540) – llama.cpp, 2026-10-10

最終更新: 2026-10-10
