OossaL'IA evolve in fretta. Noi la spieghiamo in modo semplice.

llama.cpp: l’aggiornamento evita l’overflow delle dimensioni dei tensori

La release del 30 settembre previene un raro bug di overflow durante il padding di tensori di grandi dimensioni, migliorando la stabilità su tutte le piattaforme.

BreveOossa1 min di lettura

Il 30 settembre 2026 la libreria llama.cpp ha rilasciato una patch che blocca i tensori le cui dimensioni causerebbero un overflow durante il padding. La modifica controlla la dimensione grezza più l’allineamento prima di aggiungere il padding, rifiutando subito i tensori non sicuri. Un nuovo test dimostra che la correzione intercetta un tensore da 2⁶⁴−16 byte, che prima riusciva a passare. L’aggiornamento si applica a tutte le build supportate, da macOS a Windows e Linux, comprese le versioni CUDA e Vulkan.

Perché conta

Prevenire questo overflow evita arresti anomali o risultati corrotti quando si eseguono modelli molto grandi.

Questo articolo ti è stato utile?
Condividi

Leggi anche

Oossa · Newsletter

La settimana dell'IA, spiegata

Ogni lunedì: le notizie che contano, in parole semplici. Gratis, niente spam.

Fonti e riferimenti

#FonteTestataDataPunto chiave
1ggml-org/llama.cpp b11275 ↗llama.cpp30 set 2026<details open> gguf : reject tensor size that wraps after padding (#26979) GGML_PAD(nbytes, alignment) wraps to 0 when nbytes is within (ali
2ggml-org/llama.cpp b11276 ↗llama.cpp30 set 2026<details open> Hexagon f16 activation ops (#29209) * hexagon: add F16 support for activation ops (SILU/GELU/GELU_QUICK/GEGLU/SWIGLU) Widens

2 fonti

Ultimo aggiornamento: ·Markdown·llms.txt