Oossa

llama.cpp corregge l’overflow DMA di Hexagon nella versione b11516

Il runtime open source per LLM ora elimina i vecchi descrittori DMA sulle NPU Qualcomm Hexagon, impedendo la produzione di risultati NaN.

BreveDi Pubblicato da Oossa: 1 min di lettura

Il progetto ggml‑org/llama.cpp ha rilasciato la versione b11516 il 2026‑10‑09. L’aggiornamento corregge un bug nel percorso dedicato alle NPU Hexagon, in cui l’anello DMA poteva andare in overflow, causando dati obsoleti e risultati NaN/inf. Ora il codice rimuove il descrittore più vecchio quando l’anello è pieno e svuota la coda in un secondo momento. I test con operazioni di patch‑embed di grandi dimensioni ora vengono superati sull’hardware Hexagon.

Perché conta

Gli sviluppatori che usano llama.cpp su dispositivi Qualcomm Hexagon otterranno risultati corretti dai modelli, senza NaN errati.

Questo articolo ti è stato utile?
Condividi

Leggi anche

Oossa · Newsletter

La settimana dell'IA, spiegata

Ogni lunedì: le notizie che contano, in parole semplici. Gratis, niente spam.