# llama.cpp corrige límites de pesos Q4_K en OpenCL

> La versión b11558 de la biblioteca llama.cpp (11 de octubre de 2026) mejora la gestión de imágenes de pesos Q4_K en OpenCL y corrige varios errores del kernel.

Oossa · 2026-10-11 · https://oossa.com/es/llama-cpp-update-adds-opencl-fixes-for-q4-k-weight-limits

El proyecto de código abierto llama.cpp publicó la versión b11558 el 11 de octubre de 2026. La actualización corrige un error que hacía que los kernels de OpenCL superaran los límites de imagen del dispositivo al usar pesos cuantizados Q4_K. También incorpora una ruta alternativa para los dispositivos que alcanzan esos límites y corrige los cálculos de difusión y de normalización RMS en los kernels Q4_0. Hongqiang Wang, de Qualcomm, colaboró en los cambios.

## Los hechos

- La versión b11558 se publicó el 11 de octubre de 2026
- Corrige el límite de imagen de OpenCL para los kernels binarios densos Q4_K

## Por qué importa

Los desarrolladores que usan llama.cpp en GPU ahora pueden ejecutar modelos cuantizados Q4_K en más tipos de hardware sin que se produzcan fallos.

## Fuentes y referencias

1. [ggml-org/llama.cpp b11558](https://github.com/ggml-org/llama.cpp/releases/tag/b11558) – llama.cpp, 2026-10-11

Última actualización: 2026-10-11
