Oossa

llama.cpp corregge un bug di fusione delle operazioni su Metal

La versione del 7 ottobre 2026 risolve un errore nel backend Metal che causava probabilità errate in alcuni modelli.

BreveDi Pubblicato da Oossa: 1 min di lettura

La libreria ggml‑org/llama.cpp ha rilasciato la versione b11475 il 7 ottobre 2026. L’aggiornamento corregge un bug nel backend Metal (GPU Apple): un’operazione combinata MUL_MAT+ADD selezionava la matrice residua sbagliata, producendo risultati errati nei modelli che eseguono più moltiplicazioni di matrici in un singolo passaggio. La correzione fa sì che l’encoder selezioni l’operando giusto e ripristina risultati accurati sulle GPU Metal.

Perché conta

Gli sviluppatori che usano llama.cpp sulle GPU Apple potranno ottenere risultati affidabili dai modelli, invece delle probabilità uniformi che si verificavano in precedenza.

Questo articolo ti è stato utile?
Condividi

Leggi anche

Oossa · Newsletter

La settimana dell'IA, spiegata

Ogni lunedì: le notizie che contano, in parole semplici. Gratis, niente spam.