# llama.cpp corrige un fallo en la detección de la versión de CUDA

> La versión del 8 de octubre de 2026 corrige un error en la comprobación de versiones que ralentizaba argsort en CUDA con versiones recientes de CCCL.

Oossa · 2026-10-08 · https://oossa.com/es/llama-cpp-update-fixes-cuda-version-check-regression

El proyecto llama.cpp publicó la versión b11509 el 8 de octubre de 2026. Esta corrige una comprobación de CUDA que identificaba erróneamente CCCL 4.x como una versión anterior, lo que provocaba una caída silenciosa del rendimiento de la operación argsort. La corrección sustituye la comprobación componente por componente por una única comparación de enteros empaquetados y restablece la ruta rápida del iterador con pasos. El cambio se probó en una RTX 4070 con CUDA 13.4 y superó todas las pruebas de backend.

## Los hechos

- La versión b11509 se publicó el 2026-10-08
- Probada en una RTX 4070 (sm_89) con CUDA 13.4

## Por qué importa

Quienes usan llama.cpp con configuraciones CUDA modernas obtendrán un mayor rendimiento al ordenar, sin tener que cambiar el código.

## Fuentes y referencias

1. [ggml-org/llama.cpp b11509](https://github.com/ggml-org/llama.cpp/releases/tag/b11509) – llama.cpp, 2026-10-08

Última actualización: 2026-10-08
