Das llama.cpp-Projekt hat am 8. Oktober 2026 Version b11509 veröffentlicht. Das Update behebt eine CUDA-Prüfung, die CCCL-Version 4.x fälschlich als älter einstufte und dadurch die argsort-Operation unbemerkt verlangsamte. Statt eines komponentenweisen Vergleichs kommt nun ein einzelner Vergleich gepackter Ganzzahlen zum Einsatz. So wird der schnelle Pfad mit strided iterators wiederhergestellt. Die Änderung wurde auf einer RTX 4070 mit CUDA 13.4 getestet und bestand alle Backend-Tests.
Warum es wichtig ist
Wer llama.cpp mit aktuellen CUDA-Systemen nutzt, profitiert von einer schnelleren Sortierleistung, ohne den eigenen Code ändern zu müssen.