# llama.cpp b11499 verbetert CUDA-roll en voegt nieuwe binaries toe

> De opensource-LLM-runtime llama.cpp verscheen op 8 okt 2026 in versie b11499. De update bevat een CUDA-fix voor niet-aaneengesloten roll-bewerkingen en nieuwe vooraf gebouwde binaries voor macOS, iOS en Linux.

Oossa · 2026-10-08 · https://oossa.com/nl/llama-cpp-v-b11499-adds-cuda-roll-improvement-and-new-binaries

Het ggml-org-team bracht llama.cpp-release b11499 uit op 8 okt 2026. De update past de CUDA-backend aan zodat die voor de roll-bewerking byte-strides gebruikt. Daardoor kan de GPU niet-aaneengesloten data correct verwerken. De release bevat ook nieuwe binaries voor Apple Silicon, Intel-Macs, iOS en verschillende Ubuntu-builds (CPU, Vulkan en CUDA 12). Alle bestanden zijn te downloaden via de GitHub-releasepagina.

## De feiten

- Versie b11499 uitgebracht op 2026-10-08
- De CUDA-backend ondersteunt nu roll-bewerkingen met byte-strides

## Waarom het ertoe doet

Ontwikkelaars kunnen llama.cpp op meer GPU-configuraties gebruiken zonder fouten, waardoor lokale LLM's op desktops en servers breder inzetbaar worden.

## Bronnen en referenties

1. [ggml-org/llama.cpp b11499](https://github.com/ggml-org/llama.cpp/releases/tag/b11499) – llama.cpp, 2026-10-08

Laatst bijgewerkt: 2026-10-08
