# llama.cpp v b11499 mejora roll en CUDA y añade nuevos binarios

> El entorno de ejecución de LLM de código abierto llama.cpp publicó la versión b11499 el 8 de octubre de 2026. Incluye una corrección de CUDA para operaciones roll con datos no contiguos y nuevos binarios precompilados para macOS, iOS y Linux.

Oossa · 2026-10-08 · https://oossa.com/es/llama-cpp-v-b11499-adds-cuda-roll-improvement-and-new-binaries

El equipo de ggml-org publicó la versión b11499 de llama.cpp el 8 de octubre de 2026. La actualización modifica el backend de CUDA para que la operación roll use desplazamientos en bytes, lo que permite a la GPU procesar correctamente datos no contiguos. La versión también incluye nuevos binarios para Apple Silicon, macOS con procesadores Intel, iOS y varias compilaciones de Ubuntu (CPU, Vulkan y CUDA 12). Todos los archivos se pueden descargar desde la página de lanzamientos de GitHub.

## Los hechos

- La versión b11499 se publicó el 2026-10-08
- El backend de CUDA ahora admite operaciones roll con desplazamientos en bytes

## Por qué importa

Los desarrolladores pueden ejecutar llama.cpp en más configuraciones de GPU sin errores, lo que amplía el uso local de LLM en equipos de escritorio y servidores.

## Fuentes y referencias

1. [ggml-org/llama.cpp b11499](https://github.com/ggml-org/llama.cpp/releases/tag/b11499) – llama.cpp, 2026-10-08

Última actualización: 2026-10-08
