Oossa

Atualização do llama.cpp corrige instabilidade no grafo de amostragem

A versão de 9 de outubro de 2026 mantém estático o grafo de amostragem do backend entre ubatches, aumentando a confiabilidade em todas as plataformas compatíveis.

NotaPor Publicado pelo Oossa: 1 min de leitura

O projeto ggml‑org/llama.cpp lançou a versão b11530 em 2026-10-09. A mudança mantém estático o grafo de amostragem do backend entre ubatches, impedindo que sua estrutura se altere durante as etapas de reserva e decodificação. Isso corrige falhas que ocorriam quando a topologia do grafo mudava após uma compilação de reserva. A correção se aplica a todas as compilações listadas — macOS, Linux, Android, Windows e openEuler — e a todos os backends de hardware, como CUDA, Vulkan e OpenCL.

Por que importa

Desenvolvedores que usam o llama.cpp terão menos erros em tempo de execução ao gerar várias saídas em qualquer CPU ou GPU compatível.

Este artigo foi útil?
Compartilhar

Leia a seguir

Oossa · Newsletter

A semana em IA, explicada

Toda segunda-feira: as notícias que valem a pena, em linguagem simples. Grátis, sem spam.