# llama.cpp b11540 accélère le décodage MoE avec SYCL

> La bibliothèque open source llama.cpp a publié la version b11540 le 10 oct. 2026. Elle ajoute l’accélération SYCL pour les modèles MoE MXFP4 et propose de nouveaux binaires pour macOS, iOS et Linux.

Oossa · 2026-10-10 · https://oossa.com/fr/llama-cpp-release-b11540-adds-sycl-support-for-faster-moe-decoding

L’équipe ggml-org a publié la version b11540 de llama.cpp le 10 oct. 2026. Cette mise à jour ajoute la prise en charge de SYCL pour accélérer les modèles mixture-of-experts (MoE) MXFP4 grâce au décodage arithmétique et au réordonnancement des poids. Elle comprend aussi des binaires précompilés pour les Mac à puce Apple Silicon, les Mac Intel, iOS et plusieurs variantes d’Ubuntu (CPU, Vulkan et CUDA). Les modifications sont répertoriées sous le tag b11540 sur GitHub.

## Les faits

- Tag de version b11540 publié le 10 oct. 2026
- Ajout de l’accélération SYCL pour les modèles MoE MXFP4

## Pourquoi c'est important

Les développeurs peuvent désormais exécuter plus rapidement des modèles MoE de plus grande taille sur les GPU compatibles avec SYCL, ce qui élargit les possibilités matérielles des utilisateurs de llama.cpp.

## Sources et références

1. [ggml-org/llama.cpp b11540](https://github.com/ggml-org/llama.cpp/releases/tag/b11540) – llama.cpp, 2026-10-10

Dernière mise à jour: 2026-10-10
