# llama.cpp b11391 incluye un ajuste de CUDA y nuevos binarios

> El ejecutor de LLM de código abierto lanza la versión b11391 con un pequeño cambio en el código de CUDA y nuevos binarios para macOS, iOS y varias plataformas Ubuntu.

Oossa · 2026-10-04 · https://oossa.com/es/llama-cpp-vb11391-adds-cuda-tweak-and-new-pre-built-binaries

El equipo de ggml‑org lanzó llama.cpp versión b11391 el 4 de octubre de 2026. La actualización traslada una variable de CUDA llamada blocks_per_col al lugar donde se utiliza. El cambio fue aprobado por Adrien Gallouët. El lanzamiento también incluye nuevos binarios precompilados para macOS con Apple Silicon, macOS con Intel, iOS y varias versiones de Ubuntu (CPU, Vulkan y CUDA 12). Todos los archivos están disponibles para descargar desde la página del lanzamiento en GitHub.

## Los hechos

- La versión b11391 se lanzó el 2026-10-04
- Incluye un cambio en el código de CUDA y binarios para macOS, iOS y Ubuntu (CPU, Vulkan y CUDA 12)

## Por qué importa

Los desarrolladores ahora pueden ejecutar llama.cpp en más tipos de hardware sin tener que compilarlo, especialmente quienes usan GPU compatibles con CUDA.

## Fuentes y referencias

1. [ggml-org/llama.cpp b11391](https://github.com/ggml-org/llama.cpp/releases/tag/b11391) – llama.cpp, 2026-10-04

Última actualización: 2026-10-04
