Die Open-Source-Bibliothek llama.cpp ist am 9. Okt. 2026 in Version b11523 erschienen. Das Update behebt einen Absturz, der auftrat, wenn die Bibliothek die DUP-Operation auf WebGPU ausführen wollte. Bisher lief DUP auf der CPU, während andere Aufgaben auf WebGPU ausgeführt wurden. Das führte zu einem Pufferfehler und zum Absturz. DUP nutzt nun denselben Codepfad wie die Operationen CPY (copy) und CONT und bleibt damit auf WebGPU.
Warum es wichtig ist
Wer llama.cpp mit WebGPU nutzt, kann Modelle mit gemischten Batches ausführen, ohne dass das Programm abstürzt.