La libreria llama.cpp ha rilasciato la versione b11559 l’11 ottobre 2026. L’aggiornamento introduce miglioramenti OpenCL per velocizzare l’allocazione dei fattori e supporta la decodifica di Gemma‑4 sulle GPU Qualcomm E4B ed E2B. Ottimizza inoltre i percorsi di decodifica DK64 e DK128 per diverse impostazioni di quantizzazione. Le modifiche sono state co-sviluppate da Hongqiang Wang di Qualcomm.
Perché conta
Gli sviluppatori possono ora eseguire più rapidamente i modelli Gemma‑4 sulle GPU Qualcomm compatibili, ampliando le possibilità dell’IA edge.