# llama.cpp b11510 ondersteunt grotere tensors met CUDA

> De opensourcebibliotheek voor LLaMA-inferentie is bijgewerkt naar versie b11510. De nieuwe CUDA-kernel verwerkt meer dan 65.535 rijen. Er zijn ook binaries voor macOS, iOS en Linux.

Oossa · 2026-10-08 · https://oossa.com/nl/llama-cpp-b11510-adds-cuda-support-for-larger-tensors

Het team van ggml-org bracht llama.cpp versie b11510 uit op 8 oktober 2026. De update voegt een PAD-kernel met een lus toe voor CUDA, zodat de bibliotheek tensors met meer dan 65.000 rijen of slices kan verwerken. De release bevat ook vooraf gebouwde binaries voor Apple Silicon, Intel-macs, iOS en verschillende Ubuntu-versies (CPU, Vulkan en CUDA 12.8). De code en attesten zijn gelinkt vanaf de GitHub-pagina.

## De feiten

- Versie b11510 uitgebracht op 2026-10-08
- Nieuwe CUDA PAD-kernel ondersteunt meer dan 65.535 rijen

## Waarom het ertoe doet

Ontwikkelaars kunnen nu grotere taalmodellen draaien op NVIDIA-GPU's zonder tegen de eerdere limiet voor het aantal rijen aan te lopen.

## Bronnen en referenties

1. [ggml-org/llama.cpp b11510](https://github.com/ggml-org/llama.cpp/releases/tag/b11510) – llama.cpp, 2026-10-08

Laatst bijgewerkt: 2026-10-08
