Oossa

llama.cpp corrige la prise en charge OpenCL des poids Q4_K

La version b11558 de la bibliothèque llama.cpp, publiée le 11 oct. 2026, améliore la gestion des images de poids Q4_K sous OpenCL et corrige plusieurs bugs de kernels.

BrèvePar Publié par Oossa: 1 min de lecture

Le projet open source llama.cpp a publié la version b11558 le 11 oct. 2026. Cette mise à jour corrige un bug qui faisait dépasser aux kernels OpenCL les limites d’image des appareils lors de l’utilisation de poids quantifiés Q4_K. Elle ajoute également une solution de repli pour les appareils qui atteignent ces limites et corrige les calculs de diffusion et de normalisation RMS dans les kernels Q4_0. Hongqiang Wang, de Qualcomm, a coécrit ces modifications.

Pourquoi c'est important

Les développeurs qui utilisent llama.cpp sur GPU peuvent désormais exécuter des modèles quantifiés Q4_K sur davantage de matériel sans plantage.

Cet article vous a-t-il été utile ?
Partager

À lire ensuite

Oossa · Newsletter

La semaine de l'IA, expliquée

Chaque lundi : l'essentiel de l'actualité, en langage clair. Gratuit, sans spam.