Oossa

llama.cpp: l’aggiornamento risolve i limiti OpenCL per Q4_K

La versione b11558 della libreria llama.cpp, pubblicata l’11 ottobre 2026, migliora la gestione delle immagini dei pesi Q4_K in OpenCL e corregge diversi bug nei kernel.

BreveDi Pubblicato da Oossa: 1 min di lettura

Il progetto open source llama.cpp ha pubblicato la versione b11558 l’11 ottobre 2026. L’aggiornamento corregge un bug che faceva superare ai kernel OpenCL i limiti delle immagini dei dispositivi quando si usavano pesi quantizzati Q4_K. Aggiunge inoltre un percorso alternativo per i dispositivi che raggiungono tali limiti e corregge i calcoli di broadcasting e RMS-norm per i kernel Q4_0. Le modifiche sono state realizzate insieme a Hongqiang Wang di Qualcomm.

Perché conta

Gli sviluppatori che usano llama.cpp sulle GPU possono ora eseguire modelli quantizzati Q4_K su più hardware senza arresti anomali.

Questo articolo ti è stato utile?
Condividi

Leggi anche

Oossa · Newsletter

La settimana dell'IA, spiegata

Ogni lunedì: le notizie che contano, in parole semplici. Gratis, niente spam.