Oossa

llama.cpp b11499 behebt CUDA-Fehler und bringt neue Binärdateien

Die Open-Source-LLM-Laufzeitumgebung llama.cpp ist am 8. Okt. 2026 in Version b11499 erschienen. Das Update behebt einen CUDA-Fehler bei Roll-Operationen mit nicht zusammenhängenden Daten und enthält neue vorgefertigte Binärdateien für macOS, iOS und Linux.

KurzmeldungVon Von Oossa veröffentlicht: 1 Min. Lesezeit

Das Team von ggml-org hat llama.cpp b11499 am 8. Okt. 2026 veröffentlicht. Das Update ändert das CUDA-Backend so, dass die Roll-Operation Byte-Stride-Werte verwendet. Dadurch kann die GPU nicht zusammenhängende Daten korrekt verarbeiten. Außerdem enthält die Veröffentlichung neue Binärdateien für Apple Silicon, Intel-Macs, iOS und verschiedene Ubuntu-Versionen (CPU, Vulkan und CUDA 12). Alle Dateien stehen auf der GitHub-Release-Seite zum Download bereit.

Warum es wichtig ist

Entwickler können llama.cpp auf mehr GPU-Konfigurationen fehlerfrei ausführen und so lokale LLMs auf Desktop-Rechnern und Servern nutzen.

War dieser Artikel hilfreich?
Teilen

Als Nächstes lesen

Oossa · Newsletter

Die KI-Woche, erklärt

Jeden Montag: die Nachrichten, die man kennen sollte – verständlich. Kostenlos, kein Spam.