Oossa

llama.cpp ondersteunt DUP nu ook op WebGPU

Een wijziging in llama.cpp versie b11523 voorkomt crashes bij gemengde batches door de DUP-bewerking op WebGPU uit te voeren.

Kort berichtDoor Gepubliceerd door Oossa: 1 min lezen

De open-sourcelibrary llama.cpp bracht op 9 oktober 2026 versie b11523 uit. De update verhelpt een crash die optrad wanneer de library de DUP-bewerking op WebGPU probeerde uit te voeren. Eerder werd DUP op de CPU uitgevoerd, terwijl ander werk op WebGPU plaatsvond. Daardoor kwamen buffers niet overeen en crashte het programma. DUP volgt nu hetzelfde codepad als de bewerkingen CPY (copy) en CONT en blijft daardoor op WebGPU.

Waarom het ertoe doet

Gebruikers van WebGPU kunnen llama.cpp-modellen met gemengde batches uitvoeren zonder dat het programma crasht.

Was dit artikel nuttig?
Delen

Lees ook

Oossa · Nieuwsbrief

De AI-week, uitgelegd

Elke maandag: het nieuws dat ertoe doet, in gewone taal. Gratis, geen spam.