Oossa

llama.cpp adota seleção gulosa com temperatura zero

A biblioteca de código aberto Llama.cpp agora seleciona o token mais provável quando a temperatura é zero, simplificando a geração com menor variabilidade.

NotaPor Publicado pelo Oossa: 1 min de leitura

O projeto ggml‑org/llama.cpp lançou uma nova versão em 7 de outubro de 2026. A alteração no amostrador faz com que, quando a temperatura é zero, o modelo sempre escolha o token de maior probabilidade (seleção gulosa). A atualização mantém a amostragem aleatória para temperaturas mais altas e para solicitações de probabilidades personalizadas. A mudança se aplica à execução na CPU e aos fluxos que usam gramáticas ou limites de raciocínio.

Por que importa

Desenvolvedores podem obter resultados mais previsíveis quando precisam gerar texto de forma determinística, sem configurações adicionais.

Este artigo foi útil?
Compartilhar

Leia a seguir

Oossa · Newsletter

A semana em IA, explicada

Toda segunda-feira: as notícias que valem a pena, em linguagem simples. Grátis, sem spam.