Oossa

llama.cpp introduce la selezione greedy a temperatura zero

La libreria open source Llama.cpp ora seleziona il token più probabile quando la temperatura è impostata su zero, semplificando la generazione a bassa variabilità.

BreveDi Pubblicato da Oossa: 1 min di lettura

Il progetto ggml‑org/llama.cpp ha pubblicato una nuova versione il 7 ottobre 2026. La modifica riguarda il sampler: quando la temperatura è zero, il modello sceglie sempre il token con la probabilità più alta (selezione greedy). L’aggiornamento mantiene il campionamento casuale alle temperature più alte e per le richieste con probabilità personalizzate. La modifica si applica alle esecuzioni su CPU e ai percorsi che usano grammatiche o budget di ragionamento.

Perché conta

Gli sviluppatori possono ottenere risultati più prevedibili quando serve generare testo in modo deterministico, senza configurazioni aggiuntive.

Questo articolo ti è stato utile?
Condividi

Leggi anche

Oossa · Newsletter

La settimana dell'IA, spiegata

Ogni lunedì: le notizie che contano, in parole semplici. Gratis, niente spam.