# llama.cpp voegt CUDA-kernels toe voor blokbreedtes boven 512

> De release van 8 okt 2026 introduceert nieuwe fast-Fourier-Hadamard-kernels voor breedtes van 1.024 tot 8.192 op NVIDIA-GPU’s.

Oossa · 2026-10-08 · https://oossa.com/nl/llama-cpp-adds-cuda-kernels-for-block-widths-over-512

Het llama.cpp-project bracht op 8 okt 2026 versie b11482 uit. Deze voegt CUDA-FWHT-kernels toe voor blokbreedtes boven 512 en breidt de ondersteuning uit naar 1.024–8.192 voor zowel FP32- als FP16-data. De wijziging hergebruikt de bestaande F16-infrastructuur en is getest op een A10-GPU. De bestaande kernels voor warpbreedtes (64–512) blijven ongewijzigd.

## De feiten

- Release-tag b11482, gepubliceerd op 8 okt 2026
- Nieuwe kernels ondersteunen breedtes van 1.024–8.192 voor FP32 en FP16

## Waarom het ertoe doet

GPU-gebruikers kunnen nu met llama.cpp sneller matrixvermenigvuldigingen met grotere breedtes uitvoeren.

## Bronnen en referenties

1. [ggml-org/llama.cpp b11482](https://github.com/ggml-org/llama.cpp/releases/tag/b11482) – llama.cpp, 2026-10-08

Laatst bijgewerkt: 2026-10-08
