Il 30 settembre 2026 la libreria llama.cpp ha rilasciato una patch che blocca i tensori le cui dimensioni causerebbero un overflow durante il padding. La modifica controlla la dimensione grezza più l’allineamento prima di aggiungere il padding, rifiutando subito i tensori non sicuri. Un nuovo test dimostra che la correzione intercetta un tensore da 2⁶⁴−16 byte, che prima riusciva a passare. L’aggiornamento si applica a tutte le build supportate, da macOS a Windows e Linux, comprese le versioni CUDA e Vulkan.
Perché conta
Prevenire questo overflow evita arresti anomali o risultati corrotti quando si eseguono modelli molto grandi.