# llama.cpp corrige la prise en charge OpenCL des poids Q4_K

> La version b11558 de la bibliothèque llama.cpp, publiée le 11 oct. 2026, améliore la gestion des images de poids Q4_K sous OpenCL et corrige plusieurs bugs de kernels.

Oossa · 2026-10-11 · https://oossa.com/fr/llama-cpp-update-adds-opencl-fixes-for-q4-k-weight-limits

Le projet open source llama.cpp a publié la version b11558 le 11 oct. 2026. Cette mise à jour corrige un bug qui faisait dépasser aux kernels OpenCL les limites d’image des appareils lors de l’utilisation de poids quantifiés Q4_K. Elle ajoute également une solution de repli pour les appareils qui atteignent ces limites et corrige les calculs de diffusion et de normalisation RMS dans les kernels Q4_0. Hongqiang Wang, de Qualcomm, a coécrit ces modifications.

## Les faits

- Version b11558 publiée le 2026-10-11
- Corrige le dépassement des limites d’image OpenCL pour les kernels denses binaires Q4_K

## Pourquoi c'est important

Les développeurs qui utilisent llama.cpp sur GPU peuvent désormais exécuter des modèles quantifiés Q4_K sur davantage de matériel sans plantage.

## Sources et références

1. [ggml-org/llama.cpp b11558](https://github.com/ggml-org/llama.cpp/releases/tag/b11558) – llama.cpp, 2026-10-11

Dernière mise à jour: 2026-10-11
