# llama.cpp får CUDA-kärnor för blockbredder över 512

> Versionen från 8 okt. 2026 innehåller nya snabba Fourier–Hadamard-kärnor för bredder på 1 024–8 192 på NVIDIA-GPU:er.

Oossa · 2026-10-08 · https://oossa.com/sv/llama-cpp-adds-cuda-kernels-for-block-widths-over-512

Projektet llama.cpp släppte version b11482 den 8 okt. 2026. Den innehåller CUDA FWHT-kärnor som klarar blockbredder över 512 och utökar stödet till 1 024–8 192 för både FP32- och FP16-data. Ändringen återanvänder den befintliga F16-infrastrukturen och har klarat tester på en A10-GPU. De befintliga kärnorna för warp-bredder (64–512) är oförändrade.

## Fakta

- Version b11482, publicerad 8 okt. 2026
- De nya kärnorna stöder bredder på 1 024–8 192 för FP32 och FP16

## Varför det spelar roll

GPU-användare kan nu köra matris multiplikationer med större bredder snabbare i llama.cpp.

## Källor och referenser

1. [ggml-org/llama.cpp b11482](https://github.com/ggml-org/llama.cpp/releases/tag/b11482) – llama.cpp, 2026-10-08

Senast uppdaterad: 2026-10-08
