A biblioteca llama.cpp lançou uma correção em 30 de setembro de 2026 que bloqueia tensores cujo tamanho estouraria durante o preenchimento. A alteração verifica o tamanho bruto mais o alinhamento antes de adicionar o preenchimento e rejeita antecipadamente tensores inseguros. Um novo caso de teste mostra que a correção detecta um tensor de 2⁶⁴−16 bytes que antes passava despercebido. A atualização vale para todas as compilações compatíveis, do macOS ao Windows e Linux, incluindo as versões CUDA e Vulkan.
Por que importa
Evitar esse estouro impede falhas ou resultados corrompidos ao executar modelos muito grandes.