Oossa

llama.cpp corrige un fallo en la detección de la versión de CUDA

La versión del 8 de octubre de 2026 corrige un error en la comprobación de versiones que ralentizaba argsort en CUDA con versiones recientes de CCCL.

BrevePor Publicado por Oossa: 1 min de lectura

El proyecto llama.cpp publicó la versión b11509 el 8 de octubre de 2026. Esta corrige una comprobación de CUDA que identificaba erróneamente CCCL 4.x como una versión anterior, lo que provocaba una caída silenciosa del rendimiento de la operación argsort. La corrección sustituye la comprobación componente por componente por una única comparación de enteros empaquetados y restablece la ruta rápida del iterador con pasos. El cambio se probó en una RTX 4070 con CUDA 13.4 y superó todas las pruebas de backend.

Por qué importa

Quienes usan llama.cpp con configuraciones CUDA modernas obtendrán un mayor rendimiento al ordenar, sin tener que cambiar el código.

¿Te resultó útil este artículo?
Compartir

Sigue leyendo

Oossa · Boletín

La semana en IA, explicada

Cada lunes: las noticias que vale la pena conocer, en lenguaje sencillo. Gratis, sin spam.