# llama.cpp corrige un bug de détection de version CUDA

> La version du 8 oct. 2026 corrige un bug de vérification qui ralentissait le tri des arguments avec CUDA et les versions récentes de CCCL.

Oossa · 2026-10-08 · https://oossa.com/fr/llama-cpp-update-fixes-cuda-version-check-regression

Le projet llama.cpp a publié la version b11509 le 8 oct. 2026. Elle corrige une vérification CUDA qui prenait à tort la version 4.x de CCCL pour une version antérieure, entraînant une baisse de performances silencieuse pour l’opération argsort. Le correctif remplace la comparaison composant par composant par une comparaison d’un entier compact, rétablissant ainsi le chemin rapide utilisant un itérateur à pas. Le changement a été testé sur une RTX 4070 avec CUDA 13.4 et a réussi tous les tests des backends.

## Les faits

- La version b11509 a été publiée le 2026-10-08
- Testée sur une RTX 4070 (sm_89) avec CUDA 13.4

## Pourquoi c'est important

Les développeurs qui utilisent llama.cpp avec des configurations CUDA récentes bénéficieront d’un tri plus rapide sans avoir à modifier leur code.

## Sources et références

1. [ggml-org/llama.cpp b11509](https://github.com/ggml-org/llama.cpp/releases/tag/b11509) – llama.cpp, 2026-10-08

Dernière mise à jour: 2026-10-08
