# llama.cpp b11499 behebt CUDA-Fehler und bringt neue Binärdateien

> Die Open-Source-LLM-Laufzeitumgebung llama.cpp ist am 8. Okt. 2026 in Version b11499 erschienen. Das Update behebt einen CUDA-Fehler bei Roll-Operationen mit nicht zusammenhängenden Daten und enthält neue vorgefertigte Binärdateien für macOS, iOS und Linux.

Oossa · 2026-10-08 · https://oossa.com/de/llama-cpp-v-b11499-adds-cuda-roll-improvement-and-new-binaries

Das Team von ggml-org hat llama.cpp b11499 am 8. Okt. 2026 veröffentlicht. Das Update ändert das CUDA-Backend so, dass die Roll-Operation Byte-Stride-Werte verwendet. Dadurch kann die GPU nicht zusammenhängende Daten korrekt verarbeiten. Außerdem enthält die Veröffentlichung neue Binärdateien für Apple Silicon, Intel-Macs, iOS und verschiedene Ubuntu-Versionen (CPU, Vulkan und CUDA 12). Alle Dateien stehen auf der GitHub-Release-Seite zum Download bereit.

## Die Fakten

- Version b11499 wurde am 2026-10-08 veröffentlicht
- Das CUDA-Backend unterstützt jetzt Roll-Operationen mit Byte-Stride-Werten

## Warum es wichtig ist

Entwickler können llama.cpp auf mehr GPU-Konfigurationen fehlerfrei ausführen und so lokale LLMs auf Desktop-Rechnern und Servern nutzen.

## Quellen und Referenzen

1. [ggml-org/llama.cpp b11499](https://github.com/ggml-org/llama.cpp/releases/tag/b11499) – llama.cpp, 2026-10-08

Zuletzt aktualisiert: 2026-10-08
