# llama.cpp: l’aggiornamento risolve i limiti OpenCL per Q4_K

> La versione b11558 della libreria llama.cpp, pubblicata l’11 ottobre 2026, migliora la gestione delle immagini dei pesi Q4_K in OpenCL e corregge diversi bug nei kernel.

Oossa · 2026-10-11 · https://oossa.com/it/llama-cpp-update-adds-opencl-fixes-for-q4-k-weight-limits

Il progetto open source llama.cpp ha pubblicato la versione b11558 l’11 ottobre 2026. L’aggiornamento corregge un bug che faceva superare ai kernel OpenCL i limiti delle immagini dei dispositivi quando si usavano pesi quantizzati Q4_K. Aggiunge inoltre un percorso alternativo per i dispositivi che raggiungono tali limiti e corregge i calcoli di broadcasting e RMS-norm per i kernel Q4_0. Le modifiche sono state realizzate insieme a Hongqiang Wang di Qualcomm.

## I fatti

- La versione b11558 è stata pubblicata l’11 ottobre 2026
- Corregge il superamento dei limiti delle immagini OpenCL per i kernel dense bin Q4_K

## Perché conta

Gli sviluppatori che usano llama.cpp sulle GPU possono ora eseguire modelli quantizzati Q4_K su più hardware senza arresti anomali.

## Fonti e riferimenti

1. [ggml-org/llama.cpp b11558](https://github.com/ggml-org/llama.cpp/releases/tag/b11558) – llama.cpp, 2026-10-11

Ultimo aggiornamento: 2026-10-11
