Oossa

llama.cpp prend en charge DUP sur WebGPU

La version b11523 de llama.cpp corrige un plantage en permettant à WebGPU de gérer l’opération DUP lors de l’exécution de modèles en lots mixtes.

BrèvePar Publié par Oossa: 1 min de lecture

La bibliothèque open source llama.cpp a publié la version b11523 le 9 octobre 2026. Cette mise à jour corrige un plantage qui se produisait lorsque la bibliothèque tentait d’exécuter l’opération DUP sur WebGPU. Auparavant, DUP était exécutée sur le processeur tandis que les autres opérations tournaient sur WebGPU, ce qui entraînait une incompatibilité des tampons et un plantage. DUP emprunte désormais le même chemin de code que les opérations CPY (copie) et CONT, et reste donc sur WebGPU.

Pourquoi c'est important

Les utilisateurs de WebGPU peuvent exécuter llama.cpp avec des lots mixtes sans que le programme plante.

Cet article vous a-t-il été utile ?
Partager

À lire ensuite

Oossa · Newsletter

La semaine de l'IA, expliquée

Chaque lundi : l'essentiel de l'actualité, en langage clair. Gratuit, sans spam.