Oossa

llama.cpp får stöd för DUP-operationen i WebGPU

En fix i llama.cpp version b11523 gör att WebGPU kan hantera DUP-operationen och förhindrar krascher med modeller som kör blandade batcher.

NotisAv Publicerad av Oossa: 1 min läsning

Open source-biblioteket llama.cpp släppte version b11523 den 9 oktober 2026. Uppdateringen åtgärdar en krasch som inträffade när biblioteket försökte använda DUP-operationen i WebGPU. Tidigare kördes DUP på processorn medan annat arbete utfördes i WebGPU, vilket ledde till att buffertarna inte stämde överens och programmet kraschade. Nu följer DUP samma kodväg som operationerna CPY (copy) och CONT, så den körs kvar i WebGPU.

Varför det spelar roll

WebGPU-användare kan köra llama.cpp-modeller med blandade batcher utan att programmet kraschar.

Var den här artikeln användbar?
Dela

Läs vidare

Oossa · Nyhetsbrev

Veckans AI, förklarad

Varje måndag: nyheterna som är värda att känna till, på enkel svenska. Gratis, ingen spam.