# llama.cpp adota seleção gulosa com temperatura zero

> A biblioteca de código aberto Llama.cpp agora seleciona o token mais provável quando a temperatura é zero, simplificando a geração com menor variabilidade.

Oossa · 2026-10-07 · https://oossa.com/pt/llama-cpp-adds-greedy-sampling-for-zero-temperature-runs

O projeto ggml‑org/llama.cpp lançou uma nova versão em 7 de outubro de 2026. A alteração no amostrador faz com que, quando a temperatura é zero, o modelo sempre escolha o token de maior probabilidade (seleção gulosa). A atualização mantém a amostragem aleatória para temperaturas mais altas e para solicitações de probabilidades personalizadas. A mudança se aplica à execução na CPU e aos fluxos que usam gramáticas ou limites de raciocínio.

## Os fatos

- Data de lançamento: 7 de outubro de 2026
- Novo recurso: seleção gulosa em sequências com temperatura zero

## Por que importa

Desenvolvedores podem obter resultados mais previsíveis quando precisam gerar texto de forma determinística, sem configurações adicionais.

## Fontes e referências

1. [ggml-org/llama.cpp b11472](https://github.com/ggml-org/llama.cpp/releases/tag/b11472) – llama.cpp, 2026-10-07

Última atualização: 2026-10-07
