Oossa

llama.cpp b11493 prend en charge le GEMM XMX groupé pour MoE

La bibliothèque open source llama.cpp a publié la version b11493 le 8 oct. 2026. Elle ajoute une opération GEMM XMX groupée pour MoE basée sur SYCL et fournit des binaires pour de nombreuses plateformes.

BrèvePar Publié par Oossa: 1 min de lecture

L’équipe ggml‑org a publié llama.cpp version b11493 le 8 oct. 2026. Cette mise à jour ajoute une implémentation SYCL du GEMM XMX groupé pour les modèles Mixture‑of‑Experts (MoE), une opération de multiplication matricielle utilisée dans les grands modèles de langage. La version comprend également des binaires précompilés pour macOS, iOS et Ubuntu (CPU, Vulkan et CUDA).

Pourquoi c'est important

Les développeurs peuvent désormais exécuter des modèles basés sur l’architecture MoE sur des GPU compatibles avec SYCL, ce qui élargit le choix de matériel pour les charges de travail LLM open source.

Cet article vous a-t-il été utile ?
Partager

À lire ensuite

Oossa · Newsletter

La semaine de l'IA, expliquée

Chaque lundi : l'essentiel de l'actualité, en langage clair. Gratuit, sans spam.