Il progetto ggml‑org/llama.cpp ha rilasciato la versione b11516 il 2026‑10‑09. L’aggiornamento corregge un bug nel percorso dedicato alle NPU Hexagon, in cui l’anello DMA poteva andare in overflow, causando dati obsoleti e risultati NaN/inf. Ora il codice rimuove il descrittore più vecchio quando l’anello è pieno e svuota la coda in un secondo momento. I test con operazioni di patch‑embed di grandi dimensioni ora vengono superati sull’hardware Hexagon.
Perché conta
Gli sviluppatori che usano llama.cpp su dispositivi Qualcomm Hexagon otterranno risultati corretti dai modelli, senza NaN errati.