# llama.cpp b11493 prend en charge le GEMM XMX groupé pour MoE

> La bibliothèque open source llama.cpp a publié la version b11493 le 8 oct. 2026. Elle ajoute une opération GEMM XMX groupée pour MoE basée sur SYCL et fournit des binaires pour de nombreuses plateformes.

Oossa · 2026-10-08 · https://oossa.com/fr/llama-cpp-release-b11493-adds-grouped-moe-xmx-gemm-support

L’équipe ggml‑org a publié llama.cpp version b11493 le 8 oct. 2026. Cette mise à jour ajoute une implémentation SYCL du GEMM XMX groupé pour les modèles Mixture‑of‑Experts (MoE), une opération de multiplication matricielle utilisée dans les grands modèles de langage. La version comprend également des binaires précompilés pour macOS, iOS et Ubuntu (CPU, Vulkan et CUDA).

## Les faits

- Version b11493 publiée le 2026-10-08
- Nouvelle fonctionnalité : GEMM XMX groupé pour MoE avec SYCL

## Pourquoi c'est important

Les développeurs peuvent désormais exécuter des modèles basés sur l’architecture MoE sur des GPU compatibles avec SYCL, ce qui élargit le choix de matériel pour les charges de travail LLM open source.

## Sources et références

1. [ggml-org/llama.cpp b11493](https://github.com/ggml-org/llama.cpp/releases/tag/b11493) – llama.cpp, 2026-10-08

Dernière mise à jour: 2026-10-08
