# llama.cpp introduce la selezione greedy a temperatura zero

> La libreria open source Llama.cpp ora seleziona il token più probabile quando la temperatura è impostata su zero, semplificando la generazione a bassa variabilità.

Oossa · 2026-10-07 · https://oossa.com/it/llama-cpp-adds-greedy-sampling-for-zero-temperature-runs

Il progetto ggml‑org/llama.cpp ha pubblicato una nuova versione il 7 ottobre 2026. La modifica riguarda il sampler: quando la temperatura è zero, il modello sceglie sempre il token con la probabilità più alta (selezione greedy). L’aggiornamento mantiene il campionamento casuale alle temperature più alte e per le richieste con probabilità personalizzate. La modifica si applica alle esecuzioni su CPU e ai percorsi che usano grammatiche o budget di ragionamento.

## I fatti

- Data di rilascio: 7 ottobre 2026
- Nuova funzionalità: selezione greedy per le sequenze a temperatura zero

## Perché conta

Gli sviluppatori possono ottenere risultati più prevedibili quando serve generare testo in modo deterministico, senza configurazioni aggiuntive.

## Fonti e riferimenti

1. [ggml-org/llama.cpp b11472](https://github.com/ggml-org/llama.cpp/releases/tag/b11472) – llama.cpp, 2026-10-07

Ultimo aggiornamento: 2026-10-07
