Oossa

llama.cpp aggiunge il supporto WebGPU all’operazione DUP

Una correzione nella versione b11523 di llama.cpp consente a WebGPU di gestire l’operazione DUP, evitando arresti anomali con modelli a batch misti.

BreveDi Pubblicato da Oossa: 1 min di lettura

La libreria open source llama.cpp ha rilasciato la versione b11523 il 9 ottobre 2026. L’aggiornamento corregge un arresto anomalo che si verificava quando la libreria tentava di eseguire l’operazione DUP su WebGPU. In precedenza, DUP veniva eseguita sulla CPU mentre le altre operazioni erano gestite da WebGPU, causando un’incompatibilità tra i buffer e il conseguente arresto anomalo. Ora DUP segue lo stesso percorso di codice delle operazioni CPY (copy) e CONT, quindi viene eseguita su WebGPU.

Perché conta

Chi usa WebGPU può eseguire modelli llama.cpp con batch misti senza che il programma si arresti.

Questo articolo ti è stato utile?
Condividi

Leggi anche

Oossa · Newsletter

La settimana dell'IA, spiegata

Ogni lunedì: le notizie che contano, in parole semplici. Gratis, niente spam.