Open source-biblioteket llama.cpp släppte version b11523 den 9 oktober 2026. Uppdateringen åtgärdar en krasch som inträffade när biblioteket försökte använda DUP-operationen i WebGPU. Tidigare kördes DUP på processorn medan annat arbete utfördes i WebGPU, vilket ledde till att buffertarna inte stämde överens och programmet kraschade. Nu följer DUP samma kodväg som operationerna CPY (copy) och CONT, så den körs kvar i WebGPU.
Varför det spelar roll
WebGPU-användare kan köra llama.cpp-modeller med blandade batcher utan att programmet kraschar.