# llama.cpp adopte le choix glouton à température zéro

> La bibliothèque open source llama.cpp sélectionne désormais le token le plus probable lorsque la température est réglée sur zéro, pour générer des réponses plus prévisibles.

Oossa · 2026-10-07 · https://oossa.com/fr/llama-cpp-adds-greedy-sampling-for-zero-temperature-runs

Le projet ggml‑org/llama.cpp a publié une nouvelle version le 7 octobre 2026. Le fonctionnement de l’échantillonneur change : lorsque la température est égale à zéro, le modèle choisit toujours le token le plus probable (sélection gloutonne). La mise à jour conserve l’échantillonnage aléatoire pour les températures plus élevées et les demandes personnalisées de probabilité. Ce changement s’applique aux exécutions sur CPU ainsi qu’aux parcours qui utilisent une grammaire ou des budgets de raisonnement.

## Les faits

- Date de sortie : 7 octobre 2026
- Nouvelle fonctionnalité : sélection gloutonne lorsque la température est égale à zéro

## Pourquoi c'est important

Les développeurs peuvent obtenir des résultats plus prévisibles lorsqu’ils ont besoin d’une génération de texte déterministe, sans configuration supplémentaire.

## Sources et références

1. [ggml-org/llama.cpp b11472](https://github.com/ggml-org/llama.cpp/releases/tag/b11472) – llama.cpp, 2026-10-07

Dernière mise à jour: 2026-10-07
