# llama.cpp、温度0で貪欲サンプリングに対応

> オープンソースのLlama.cppライブラリは、温度を0に設定すると貪欲選択を使うようになり、ばらつきの少ない生成が簡単になった。

Oossa · 2026-10-07 · https://oossa.com/ja/llama-cpp-adds-greedy-sampling-for-zero-temperature-runs

ggml‑org/llama.cppプロジェクトは2026年10月7日、新バージョンをリリースした。今回の更新ではサンプラーが変更され、温度が0の場合、モデルは最も確率の高いトークンを常に選ぶ（貪欲選択）。温度が0より高い場合や、確率をカスタム指定する場合は、従来どおりランダムサンプリングを行う。この変更はCPUでの実行に加え、文法制約や推論予算を使う処理にも適用される。

## 事実

- リリース日：2026年10月7日
- 新機能：温度0の処理で貪欲選択に対応

## なぜ重要か

開発者は追加設定なしで、決定論的なテキスト生成が必要なときに、より予測しやすい出力を得られる。

## 出典と参考資料

1. [ggml-org/llama.cpp b11472](https://github.com/ggml-org/llama.cpp/releases/tag/b11472) – llama.cpp, 2026-10-07

最終更新: 2026-10-07
