# llama.cpp aggiunge kernel CUDA per blocchi oltre 512

> La versione dell’8 ottobre 2026 introduce nuovi kernel fast Fourier-Hadamard, con larghezze da 1,024 a 8,192 sulle GPU NVIDIA.

Oossa · 2026-10-08 · https://oossa.com/it/llama-cpp-adds-cuda-kernels-for-block-widths-over-512

Il progetto llama.cpp ha pubblicato la versione b11482 l’8 ottobre 2026. Aggiunge kernel CUDA FWHT compatibili con larghezze dei blocchi superiori a 512, estendendo il supporto da 1,024 a 8,192 per i dati FP32 e FP16. La modifica riutilizza l’infrastruttura F16 esistente e supera i test su una GPU A10. I kernel esistenti per larghezze di warp (64-512) restano invariati.

## I fatti

- Tag della versione b11482, pubblicata l’8 ottobre 2026
- I nuovi kernel supportano larghezze da 1,024 a 8,192 per FP32 e FP16

## Perché conta

Gli utenti GPU possono ora eseguire moltiplicazioni di matrici con larghezze maggiori e più velocemente con llama.cpp.

## Fonti e riferimenti

1. [ggml-org/llama.cpp b11482](https://github.com/ggml-org/llama.cpp/releases/tag/b11482) – llama.cpp, 2026-10-08

Ultimo aggiornamento: 2026-10-08
