# llama.cpp añade una opción de precisión CUDA en la versión preliminar b11517

> La biblioteca de inferencia LLaMA de código abierto publicó la versión b11517 el 9 de octubre de 2026, con una opción de CUDA para configurar la precisión de source-1.

Oossa · 2026-10-09 · https://oossa.com/es/llama-cpp-pre-release-b11517-adds-cuda-precision-option

El proyecto llama.cpp publicó una nueva versión preliminar, b11517, el 9 de octubre de 2026. La actualización añade una opción de CUDA que permite indicar la precisión de source-1 a los helpers MMQ, un componente de bajo nivel del código para GPU. El cambio lleva la firma de un colaborador de NVIDIA y se aplica a las compilaciones con CUDA 12 y 13 para Linux y Windows. La versión también incluye objetivos de compilación para muchas otras plataformas, desde macOS con Apple Silicon hasta Android con Snapdragon.

La actualización está disponible en la página de GitHub del proyecto y en el sitio web llama.app.

## Los hechos

- La etiqueta de versión b11517 se publicó el 09 Oct 2026
- Añade una opción de CUDA para la precisión de source-1 (afecta a las compilaciones con CUDA 12 y 13)

## Por qué importa

Los desarrolladores ahora pueden controlar la precisión de la GPU en llama.cpp, lo que podría mejorar el rendimiento o reducir el uso de memoria al ejecutar modelos LLaMA.

## Fuentes y referencias

1. [ggml-org/llama.cpp b11517](https://github.com/ggml-org/llama.cpp/releases/tag/b11517) – llama.cpp, 2026-10-09

Última actualización: 2026-10-09
