Oossa

llama.cpp unterstützt DUP-Operation jetzt auch auf WebGPU

Ein Fix in llama.cpp Version b11523 sorgt dafür, dass WebGPU die DUP-Operation ausführt. So stürzen Modelle mit gemischten Batches nicht mehr ab.

KurzmeldungVon Von Oossa veröffentlicht: 1 Min. Lesezeit

Die Open-Source-Bibliothek llama.cpp ist am 9. Okt. 2026 in Version b11523 erschienen. Das Update behebt einen Absturz, der auftrat, wenn die Bibliothek die DUP-Operation auf WebGPU ausführen wollte. Bisher lief DUP auf der CPU, während andere Aufgaben auf WebGPU ausgeführt wurden. Das führte zu einem Pufferfehler und zum Absturz. DUP nutzt nun denselben Codepfad wie die Operationen CPY (copy) und CONT und bleibt damit auf WebGPU.

Warum es wichtig ist

Wer llama.cpp mit WebGPU nutzt, kann Modelle mit gemischten Batches ausführen, ohne dass das Programm abstürzt.

War dieser Artikel hilfreich?
Teilen

Als Nächstes lesen

Oossa · Newsletter

Die KI-Woche, erklärt

Jeden Montag: die Nachrichten, die man kennen sollte – verständlich. Kostenlos, kein Spam.