# llama.cpp unterstützt DUP-Operation jetzt auch auf WebGPU

> Ein Fix in llama.cpp Version b11523 sorgt dafür, dass WebGPU die DUP-Operation ausführt. So stürzen Modelle mit gemischten Batches nicht mehr ab.

Oossa · 2026-10-09 · https://oossa.com/de/llama-cpp-adds-webgpu-support-for-duplicate-operation

Die Open-Source-Bibliothek llama.cpp ist am 9. Okt. 2026 in Version b11523 erschienen. Das Update behebt einen Absturz, der auftrat, wenn die Bibliothek die DUP-Operation auf WebGPU ausführen wollte. Bisher lief DUP auf der CPU, während andere Aufgaben auf WebGPU ausgeführt wurden. Das führte zu einem Pufferfehler und zum Absturz. DUP nutzt nun denselben Codepfad wie die Operationen CPY (copy) und CONT und bleibt damit auf WebGPU.

## Die Fakten

- Version b11523 erschien am 2026-10-09
- Der Fix ergänzt WebGPU-Unterstützung für die GGML_OP_DUP-Operation

## Warum es wichtig ist

Wer llama.cpp mit WebGPU nutzt, kann Modelle mit gemischten Batches ausführen, ohne dass das Programm abstürzt.

## Quellen und Referenzen

1. [ggml-org/llama.cpp b11523](https://github.com/ggml-org/llama.cpp/releases/tag/b11523) – llama.cpp, 2026-10-09

Zuletzt aktualisiert: 2026-10-09
