# llama.cpp corrige limites de peso Q4_K no OpenCL

> A versão b11558 da biblioteca llama.cpp, lançada em 11 de outubro de 2026, aprimora o suporte a imagens de pesos Q4_K no OpenCL e corrige vários erros de kernel.

Oossa · 2026-10-11 · https://oossa.com/pt/llama-cpp-update-adds-opencl-fixes-for-q4-k-weight-limits

O projeto de código aberto llama.cpp lançou a versão b11558 em 11 de outubro de 2026. A atualização corrige um erro que fazia os kernels OpenCL ultrapassarem os limites de imagem do dispositivo ao usar pesos quantizados Q4_K. Também adiciona uma alternativa para dispositivos que atingem esses limites e corrige os cálculos de broadcasting e RMS-norm nos kernels Q4_0. As mudanças foram coescritas por Hongqiang Wang, da Qualcomm.

## Os fatos

- A versão b11558 foi lançada em 2026-10-11
- Corrige o limite de imagem do OpenCL para kernels dense bin Q4_K

## Por que importa

Desenvolvedores que usam llama.cpp em GPUs podem executar modelos quantizados Q4_K em mais dispositivos sem falhas.

## Fontes e referências

1. [ggml-org/llama.cpp b11558](https://github.com/ggml-org/llama.cpp/releases/tag/b11558) – llama.cpp, 2026-10-11

Última atualização: 2026-10-11
