# llama.cpp b11510 stöder större tensorer med CUDA

> Det öppna inferensbiblioteket för LLaMA släpps i version b11510 med en ny CUDA-kärna som hanterar fler än 65 535 rader, samt färdigbyggda binärfiler för macOS, iOS och Linux.

Oossa · 2026-10-08 · https://oossa.com/sv/llama-cpp-b11510-adds-cuda-support-for-larger-tensors

Teamet bakom ggml-org publicerade llama.cpp version b11510 den 8 oktober 2026. Uppdateringen lägger till en loopad PAD-kärna för CUDA, så att biblioteket kan bearbeta tensorer med fler än 65 000 rader eller skivor. Versionen innehåller också färdigbyggda binärfiler för Apple Silicon, Intel-baserade Macar, iOS och flera Ubuntu-varianter (CPU, Vulkan och CUDA 12.8). Kod och intyg finns länkade från GitHub-sidan.

## Fakta

- Version b11510 släpptes 2026-10-08
- Den nya CUDA PAD-kärnan stöder fler än 65 535 rader

## Varför det spelar roll

Utvecklare kan nu köra större språkmodeller på NVIDIA-GPU:er utan att slå i den tidigare begränsningen för antal rader.

## Källor och referenser

1. [ggml-org/llama.cpp b11510](https://github.com/ggml-org/llama.cpp/releases/tag/b11510) – llama.cpp, 2026-10-08

Senast uppdaterad: 2026-10-08
