Oossa

llama.cpp behebt Fehler bei der CUDA-Versionsprüfung

Das Release vom 8. Oktober 2026 korrigiert einen Fehler in der Versionsabfrage, der argsort bei neueren CCCL-Versionen unter CUDA verlangsamte.

KurzmeldungVon Von Oossa veröffentlicht: 1 Min. Lesezeit

Das llama.cpp-Projekt hat am 8. Oktober 2026 Version b11509 veröffentlicht. Das Update behebt eine CUDA-Prüfung, die CCCL-Version 4.x fälschlich als älter einstufte und dadurch die argsort-Operation unbemerkt verlangsamte. Statt eines komponentenweisen Vergleichs kommt nun ein einzelner Vergleich gepackter Ganzzahlen zum Einsatz. So wird der schnelle Pfad mit strided iterators wiederhergestellt. Die Änderung wurde auf einer RTX 4070 mit CUDA 13.4 getestet und bestand alle Backend-Tests.

Warum es wichtig ist

Wer llama.cpp mit aktuellen CUDA-Systemen nutzt, profitiert von einer schnelleren Sortierleistung, ohne den eigenen Code ändern zu müssen.

War dieser Artikel hilfreich?
Teilen

Als Nächstes lesen

Oossa · Newsletter

Die KI-Woche, erklärt

Jeden Montag: die Nachrichten, die man kennen sollte – verständlich. Kostenlos, kein Spam.