# llama.cpp aggiunge il supporto WebGPU all’operazione DUP

> Una correzione nella versione b11523 di llama.cpp consente a WebGPU di gestire l’operazione DUP, evitando arresti anomali con modelli a batch misti.

Oossa · 2026-10-09 · https://oossa.com/it/llama-cpp-adds-webgpu-support-for-duplicate-operation

La libreria open source llama.cpp ha rilasciato la versione b11523 il 9 ottobre 2026. L’aggiornamento corregge un arresto anomalo che si verificava quando la libreria tentava di eseguire l’operazione DUP su WebGPU. In precedenza, DUP veniva eseguita sulla CPU mentre le altre operazioni erano gestite da WebGPU, causando un’incompatibilità tra i buffer e il conseguente arresto anomalo. Ora DUP segue lo stesso percorso di codice delle operazioni CPY (copy) e CONT, quindi viene eseguita su WebGPU.

## I fatti

- La versione b11523 è stata rilasciata il 2026-10-09
- La correzione aggiunge il supporto WebGPU per l’operazione GGML_OP_DUP

## Perché conta

Chi usa WebGPU può eseguire modelli llama.cpp con batch misti senza che il programma si arresti.

## Fonti e riferimenti

1. [ggml-org/llama.cpp b11523](https://github.com/ggml-org/llama.cpp/releases/tag/b11523) – llama.cpp, 2026-10-09

Ultimo aggiornamento: 2026-10-09
