# llama.cpp v0.2.4 ajoute la disposition SYCL Q5_K et la fusion GLU

> La bibliothèque open source llama.cpp a publié la version b11515 le 9 octobre 2026, avec une nouvelle prise en charge de SYCL et des binaires précompilés pour macOS, iOS, Linux et CUDA.

Oossa · 2026-10-09 · https://oossa.com/fr/llama-cpp-v0-2-4-adds-sycl-q5-k-layout-and-glu-fusion

L’équipe ggml-org a publié llama.cpp b11515 le 2026-10-09. Cette mise à jour ajoute une multiplication matrice-vecteur quantifiée (MMVQ) avec réorganisation de la disposition Q5_K via SYCL, ainsi qu’un opérateur GLU fusionné, pour améliorer les performances sur le matériel compatible. La version inclut également des binaires prêts à l’emploi pour Apple Silicon, les Mac Intel, iOS, Ubuntu (CPU, Vulkan, CUDA 12.8) et IBM s390x. Les utilisateurs peuvent télécharger l’archive qui leur convient depuis la page GitHub.

## Les faits

- Date de publication : 2026-10-09 (« Fri Oct 09 2026 »).
- Ajout d’une nouvelle disposition SYCL Q5_K et d’une fonctionnalité GLU fusionnée.

## Pourquoi c'est important

Les développeurs peuvent désormais exécuter llama.cpp plus rapidement sur les GPU compatibles avec SYCL, sans avoir à compiler le code source.

## Sources et références

1. [ggml-org/llama.cpp b11515](https://github.com/ggml-org/llama.cpp/releases/tag/b11515) – llama.cpp, 2026-10-09

Dernière mise à jour: 2026-10-09
