De open-sourcelibrary llama.cpp bracht op 9 oktober 2026 versie b11523 uit. De update verhelpt een crash die optrad wanneer de library de DUP-bewerking op WebGPU probeerde uit te voeren. Eerder werd DUP op de CPU uitgevoerd, terwijl ander werk op WebGPU plaatsvond. Daardoor kwamen buffers niet overeen en crashte het programma. DUP volgt nu hetzelfde codepad als de bewerkingen CPY (copy) en CONT en blijft daardoor op WebGPU.
Waarom het ertoe doet
Gebruikers van WebGPU kunnen llama.cpp-modellen met gemengde batches uitvoeren zonder dat het programma crasht.