# llama.cpp prend en charge DUP sur WebGPU

> La version b11523 de llama.cpp corrige un plantage en permettant à WebGPU de gérer l’opération DUP lors de l’exécution de modèles en lots mixtes.

Oossa · 2026-10-09 · https://oossa.com/fr/llama-cpp-adds-webgpu-support-for-duplicate-operation

La bibliothèque open source llama.cpp a publié la version b11523 le 9 octobre 2026. Cette mise à jour corrige un plantage qui se produisait lorsque la bibliothèque tentait d’exécuter l’opération DUP sur WebGPU. Auparavant, DUP était exécutée sur le processeur tandis que les autres opérations tournaient sur WebGPU, ce qui entraînait une incompatibilité des tampons et un plantage. DUP emprunte désormais le même chemin de code que les opérations CPY (copie) et CONT, et reste donc sur WebGPU.

## Les faits

- La version b11523 est sortie le 2026-10-09
- Le correctif ajoute la prise en charge de l’opération GGML_OP_DUP sur WebGPU

## Pourquoi c'est important

Les utilisateurs de WebGPU peuvent exécuter llama.cpp avec des lots mixtes sans que le programme plante.

## Sources et références

1. [ggml-org/llama.cpp b11523](https://github.com/ggml-org/llama.cpp/releases/tag/b11523) – llama.cpp, 2026-10-09

Dernière mise à jour: 2026-10-09
