# llama.cpp b11527 adopte des groupes WebGPU 2D et de nouveaux binaires

> Le moteur open source pour LLM passe à une exécution WebGPU en 2D et propose de nouvelles versions pour macOS, iOS et Linux.

Oossa · 2026-10-09 · https://oossa.com/fr/llama-cpp-v-b11527-adds-2d-webgpu-workgroups-and-new-binaries

L’équipe ggml‑org a publié llama.cpp version b11527 le 2026-10-09. Cette mise à jour fait passer toutes les opérations WebGPU à une répartition des groupes de travail en 2D, abandonnant l’ancienne méthode en 1D. Elle comprend également de nouveaux binaires précompilés pour macOS (Apple Silicon et Intel), iOS et plusieurs configurations Ubuntu, avec notamment des versions Vulkan et CUDA. Ces changements visent à améliorer la fluidité des performances GPU dans les navigateurs et à simplifier l’installation sur les appareils compatibles.

## Les faits

- Version publiée : b11527 (2026‑10‑09)
- WebGPU utilise désormais une répartition des groupes de travail en 2D pour toutes les opérations

## Pourquoi c'est important

Les développeurs peuvent exécuter des LLM plus rapidement dans les navigateurs compatibles WebGPU, sans avoir à écrire de code de noyau personnalisé.

## Sources et références

1. [ggml-org/llama.cpp b11527](https://github.com/ggml-org/llama.cpp/releases/tag/b11527) – llama.cpp, 2026-10-09

Dernière mise à jour: 2026-10-09
