# Atualização do llama.cpp corrige instabilidade no grafo de amostragem

> A versão de 9 de outubro de 2026 mantém estático o grafo de amostragem do backend entre ubatches, aumentando a confiabilidade em todas as plataformas compatíveis.

Oossa · 2026-10-09 · https://oossa.com/pt/llama-cpp-update-fixes-sampling-graph-instability

O projeto ggml‑org/llama.cpp lançou a versão b11530 em 2026-10-09. A mudança mantém estático o grafo de amostragem do backend entre ubatches, impedindo que sua estrutura se altere durante as etapas de reserva e decodificação. Isso corrige falhas que ocorriam quando a topologia do grafo mudava após uma compilação de reserva. A correção se aplica a todas as compilações listadas — macOS, Linux, Android, Windows e openEuler — e a todos os backends de hardware, como CUDA, Vulkan e OpenCL.

## Os fatos

- A versão b11530 foi publicada na sexta-feira, 9 de outubro de 2026
- A correção mantém estático o grafo de amostragem entre ubatches, impedindo mudanças na topologia do grafo

## Por que importa

Desenvolvedores que usam o llama.cpp terão menos erros em tempo de execução ao gerar várias saídas em qualquer CPU ou GPU compatível.

## Fontes e referências

1. [ggml-org/llama.cpp b11530](https://github.com/ggml-org/llama.cpp/releases/tag/b11530) – llama.cpp, 2026-10-09

Última atualização: 2026-10-09
