# llama.cpp ondersteunt DUP nu ook op WebGPU

> Een wijziging in llama.cpp versie b11523 voorkomt crashes bij gemengde batches door de DUP-bewerking op WebGPU uit te voeren.

Oossa · 2026-10-09 · https://oossa.com/nl/llama-cpp-adds-webgpu-support-for-duplicate-operation

De open-sourcelibrary llama.cpp bracht op 9 oktober 2026 versie b11523 uit. De update verhelpt een crash die optrad wanneer de library de DUP-bewerking op WebGPU probeerde uit te voeren. Eerder werd DUP op de CPU uitgevoerd, terwijl ander werk op WebGPU plaatsvond. Daardoor kwamen buffers niet overeen en crashte het programma. DUP volgt nu hetzelfde codepad als de bewerkingen CPY (copy) en CONT en blijft daardoor op WebGPU.

## De feiten

- Versie b11523 uitgebracht op 2026-10-09
- De oplossing voegt WebGPU-ondersteuning toe voor de bewerking GGML_OP_DUP

## Waarom het ertoe doet

Gebruikers van WebGPU kunnen llama.cpp-modellen met gemengde batches uitvoeren zonder dat het programma crasht.

## Bronnen en referenties

1. [ggml-org/llama.cpp b11523](https://github.com/ggml-org/llama.cpp/releases/tag/b11523) – llama.cpp, 2026-10-09

Laatst bijgewerkt: 2026-10-09
