Oossa

llama.cpp v b11499 mejora roll en CUDA y añade nuevos binarios

El entorno de ejecución de LLM de código abierto llama.cpp publicó la versión b11499 el 8 de octubre de 2026. Incluye una corrección de CUDA para operaciones roll con datos no contiguos y nuevos binarios precompilados para macOS, iOS y Linux.

BrevePor Publicado por Oossa: 1 min de lectura

El equipo de ggml-org publicó la versión b11499 de llama.cpp el 8 de octubre de 2026. La actualización modifica el backend de CUDA para que la operación roll use desplazamientos en bytes, lo que permite a la GPU procesar correctamente datos no contiguos. La versión también incluye nuevos binarios para Apple Silicon, macOS con procesadores Intel, iOS y varias compilaciones de Ubuntu (CPU, Vulkan y CUDA 12). Todos los archivos se pueden descargar desde la página de lanzamientos de GitHub.

Por qué importa

Los desarrolladores pueden ejecutar llama.cpp en más configuraciones de GPU sin errores, lo que amplía el uso local de LLM en equipos de escritorio y servidores.

¿Te resultó útil este artículo?
Compartir

Sigue leyendo

Oossa · Boletín

La semana en IA, explicada

Cada lunes: las noticias que vale la pena conocer, en lenguaje sencillo. Gratis, sin spam.