# llama.cpp b11494 optimerar CUDA-kärnor

> Biblioteket Llama.cpp med öppen källkod använder nu fyra GDN-tillståndskolumner per CUDA-warp, vilket förbättrar GPU-prestandan.

Oossa · 2026-10-08 · https://oossa.com/sv/llama-cpp-release-b11494-adds-cuda-warp-optimizations

Teamet ggml-org har släppt llama.cpp version b11494. Uppdateringen ändrar CUDA-bakänden så att varje warp tilldelas fyra GDN-tillståndskolumner i stället för två. Det här är nu standardinställningen. Binärfiler för macOS (Apple Silicon och Intel), iOS och flera Ubuntu-versioner finns att ladda ner.

## Fakta

- Versionsmärkningen b11494 publicerades 2026-10-08
- Standardvärdet för CUDA cols_per_warp har satts till 4

## Varför det spelar roll

Utvecklare som använder llama.cpp på NVIDIA-GPU:er kan räkna med snabbare inferens utan att ändra sin kod.

## Källor och referenser

1. [ggml-org/llama.cpp b11494](https://github.com/ggml-org/llama.cpp/releases/tag/b11494) – llama.cpp, 2026-10-08

Senast uppdaterad: 2026-10-08
