# llama.cpp corregge un bug di fusione delle operazioni su Metal

> La versione del 7 ottobre 2026 risolve un errore nel backend Metal che causava probabilità errate in alcuni modelli.

Oossa · 2026-10-07 · https://oossa.com/it/llama-cpp-update-fixes-metal-matrix-multiply-add-fusion-bug

La libreria ggml‑org/llama.cpp ha rilasciato la versione b11475 il 7 ottobre 2026. L’aggiornamento corregge un bug nel backend Metal (GPU Apple): un’operazione combinata MUL_MAT+ADD selezionava la matrice residua sbagliata, producendo risultati errati nei modelli che eseguono più moltiplicazioni di matrici in un singolo passaggio. La correzione fa sì che l’encoder selezioni l’operando giusto e ripristina risultati accurati sulle GPU Metal.

## I fatti

- La versione b11475 è stata pubblicata il 7 ottobre 2026
- Prima della correzione, 27 test su 28 fallivano su Metal

## Perché conta

Gli sviluppatori che usano llama.cpp sulle GPU Apple potranno ottenere risultati affidabili dai modelli, invece delle probabilità uniformi che si verificavano in precedenza.

## Fonti e riferimenti

1. [ggml-org/llama.cpp b11475](https://github.com/ggml-org/llama.cpp/releases/tag/b11475) – llama.cpp, 2026-10-07

Ultimo aggiornamento: 2026-10-07
