# llama.cpp añade compatibilidad con DUP en WebGPU

> Una corrección de la versión b11523 de llama.cpp permite ejecutar la operación DUP en WebGPU y evita fallos con modelos que usan lotes mixtos.

Oossa · 2026-10-09 · https://oossa.com/es/llama-cpp-adds-webgpu-support-for-duplicate-operation

La biblioteca de código abierto llama.cpp publicó la versión b11523 el 9 de octubre de 2026. La actualización corrige un fallo que se producía cuando la biblioteca intentaba ejecutar la operación DUP en WebGPU. Antes, DUP se ejecutaba en la CPU mientras el resto del trabajo se procesaba en WebGPU, lo que provocaba una discrepancia entre búferes y hacía que el programa fallara. Ahora DUP sigue la misma ruta de código que las operaciones CPY (copia) y CONT, por lo que permanece en WebGPU.

## Los hechos

- La versión b11523 se publicó el 2026-10-09
- La corrección añade compatibilidad con la operación GGML_OP_DUP en WebGPU

## Por qué importa

Los usuarios de WebGPU pueden ejecutar modelos de llama.cpp con lotes mixtos sin que el programa falle.

## Fuentes y referencias

1. [ggml-org/llama.cpp b11523](https://github.com/ggml-org/llama.cpp/releases/tag/b11523) – llama.cpp, 2026-10-09

Última actualización: 2026-10-09
