# llama.cpp-update verhelpt OpenCL-problemen met Q4_K-gewichten

> Versie b11558 van de llama.cpp-bibliotheek (11 oktober 2026) verbetert de verwerking van Q4_K-gewichtsafbeeldingen in OpenCL en verhelpt fouten in meerdere kernels.

Oossa · 2026-10-11 · https://oossa.com/nl/llama-cpp-update-adds-opencl-fixes-for-q4-k-weight-limits

Het open-sourceproject llama.cpp heeft op 11 oktober 2026 versie b11558 uitgebracht. De update verhelpt een fout waardoor OpenCL-kernels bij gebruik van Q4_K-gekwantiseerde gewichten de limieten voor apparaat-afbeeldingen konden overschrijden. Ook voegt de update een terugvaloptie toe voor apparaten die tegen die limieten aanlopen en corrigeert die de berekeningen voor broadcasting en RMS-normering in Q4_0-kernels. Aan de wijzigingen werkte ook Hongqiang Wang van Qualcomm mee.

## De feiten

- Versie b11558 uitgebracht op 2026-10-11
- Verhelpt de limiet voor OpenCL-afbeeldingen bij Q4_K dense bin-kernels

## Waarom het ertoe doet

Ontwikkelaars die llama.cpp op GPU's gebruiken, kunnen Q4_K-gekwantiseerde modellen nu op meer hardware draaien zonder crashes.

## Bronnen en referenties

1. [ggml-org/llama.cpp b11558](https://github.com/ggml-org/llama.cpp/releases/tag/b11558) – llama.cpp, 2026-10-11

Laatst bijgewerkt: 2026-10-11
