# llama.cpp b11499 förbättrar CUDA-stöd och får nya binärer

> Den öppna LLM-motorn llama.cpp släpptes i version b11499 den 8 okt. 2026. Uppdateringen rättar ett CUDA-problem med roll-operationer på icke sammanhängande data och innehåller nya förbyggda binärer för macOS, iOS och Linux.

Oossa · 2026-10-08 · https://oossa.com/sv/llama-cpp-v-b11499-adds-cuda-roll-improvement-and-new-binaries

Teamet ggml-org publicerade llama.cpp version b11499 den 8 okt. 2026. I uppdateringen ändras CUDA-backenden så att roll-operationen använder bytebaserade steg, vilket gör att grafikprocessorn kan hantera icke sammanhängande data korrekt. Versionen innehåller också nya binärer för Apple Silicon, Intel-baserade Mac-datorer, iOS och flera Ubuntu-varianter (CPU, Vulkan och CUDA 12). Alla filer finns att hämta på GitHub-sidan för versionen.

## Fakta

- Version b11499 publicerades 2026-10-08
- CUDA-backenden stöder nu roll-operationer med bytebaserade steg

## Varför det spelar roll

Utvecklare kan köra llama.cpp på fler GPU-konfigurationer utan fel, vilket breddar möjligheterna att använda lokala LLM:er på stationära datorer och servrar.

## Källor och referenser

1. [ggml-org/llama.cpp b11499](https://github.com/ggml-org/llama.cpp/releases/tag/b11499) – llama.cpp, 2026-10-08

Senast uppdaterad: 2026-10-08
