# llama.cpp v0.1.15 corrige un fallo de CUDA y suma binarios

> La versión de ggml-org, publicada el 8 de octubre de 2026, corrige un problema de memoria en CUDA y ofrece binarios precompilados para macOS, iOS y varias plataformas Linux.

Oossa · 2026-10-08 · https://oossa.com/es/llama-cpp-v0-1-15-adds-cuda-out-of-bounds-fix-and-new-binaries

La biblioteca de código abierto llama.cpp publicó la versión b11511 el 8 de octubre de 2026. Esta corrige un error de lectura fuera de límites en CUDA dentro de la implementación MMQ. La actualización también incorpora binarios listos para usar en macOS (Apple Silicon e Intel), iOS y Ubuntu para x64, arm64 y s390x, además de versiones compiladas para Vulkan y CUDA 12.8.

## Los hechos

- Etiqueta de la versión: b11511
- Corrección: lecturas fuera de límites en CUDA MMQ (#29953); publicada el 2026-10-08

## Por qué importa

Los desarrolladores ahora pueden ejecutar llama.cpp en más hardware sin que se produzcan fallos, en especial quienes usan GPU de NVIDIA.

## Fuentes y referencias

1. [ggml-org/llama.cpp b11511](https://github.com/ggml-org/llama.cpp/releases/tag/b11511) – llama.cpp, 2026-10-08

Última actualización: 2026-10-08
