# llama.cpp b11540 新增 SYCL 支持，加快 MoE 解码

> 开源库 llama.cpp 于 2026 年 10 月 10 日发布 b11540 版本，为 MXFP4 MoE 模型加入 SYCL 加速，并新增适用于 macOS、iOS 和 Linux 的二进制文件。

Oossa · 2026-10-10 · https://oossa.com/zh/llama-cpp-release-b11540-adds-sycl-support-for-faster-moe-decoding

ggml‑org 团队于 2026 年 10 月 10 日发布 llama.cpp b11540 版本。此次更新加入 SYCL 支持，通过算术解码和权重重排加快 MXFP4 混合专家（MoE）模型的运行速度。新版本还提供预编译二进制文件，适用于搭载 Apple Silicon 芯片的 Mac、Intel Mac、iOS，以及多个 Ubuntu 版本（CPU、Vulkan 和 CUDA）。相关改动已列在 GitHub 的 b11540 标签下。

## 事实

- 发布标签 b11540 于 2026 年 10 月 10 日发布
- 为 MXFP4 MoE 模型新增 SYCL 加速

## 为什么重要

开发者现在可以在支持 SYCL 的 GPU 上更快地运行更大型的 MoE 模型，为 llama.cpp 用户提供更多硬件选择。

## 来源与参考

1. [ggml-org/llama.cpp b11540](https://github.com/ggml-org/llama.cpp/releases/tag/b11540) – llama.cpp, 2026-10-10

最后更新: 2026-10-10
