OossaA IA evolui rápido. Nós explicamos de forma simples.

Atualização do llama.cpp evita estouro no tamanho de tensores

A versão de 30 de setembro corrige um raro erro de estouro ao preencher tensores grandes, aumentando a estabilidade em diferentes plataformas.

NotaOossa1 min de leitura

A biblioteca llama.cpp lançou uma correção em 30 de setembro de 2026 que bloqueia tensores cujo tamanho estouraria durante o preenchimento. A alteração verifica o tamanho bruto mais o alinhamento antes de adicionar o preenchimento e rejeita antecipadamente tensores inseguros. Um novo caso de teste mostra que a correção detecta um tensor de 2⁶⁴−16 bytes que antes passava despercebido. A atualização vale para todas as compilações compatíveis, do macOS ao Windows e Linux, incluindo as versões CUDA e Vulkan.

Por que importa

Evitar esse estouro impede falhas ou resultados corrompidos ao executar modelos muito grandes.

Este artigo foi útil?
Compartilhar

Leia a seguir

Oossa · Newsletter

A semana em IA, explicada

Toda segunda-feira: as notícias que valem a pena, em linguagem simples. Grátis, sem spam.

Fontes e referências

#FonteVeículoDataPonto principal
1ggml-org/llama.cpp b11275 ↗llama.cpp30 de set. de 2026<details open> gguf : reject tensor size that wraps after padding (#26979) GGML_PAD(nbytes, alignment) wraps to 0 when nbytes is within (ali
2ggml-org/llama.cpp b11276 ↗llama.cpp30 de set. de 2026<details open> Hexagon f16 activation ops (#29209) * hexagon: add F16 support for activation ops (SILU/GELU/GELU_QUICK/GEGLU/SWIGLU) Widens

2 fontes

Última atualização: ·Markdown·llms.txt