ggml‑org/llama.cppプロジェクトは2026年10月7日、新バージョンをリリースした。今回の更新ではサンプラーが変更され、温度が0の場合、モデルは最も確率の高いトークンを常に選ぶ(貪欲選択)。温度が0より高い場合や、確率をカスタム指定する場合は、従来どおりランダムサンプリングを行う。この変更はCPUでの実行に加え、文法制約や推論予算を使う処理にも適用される。
なぜ重要か
開発者は追加設定なしで、決定論的なテキスト生成が必要なときに、より予測しやすい出力を得られる。
オープンソースのLlama.cppライブラリは、温度を0に設定すると貪欲選択を使うようになり、ばらつきの少ない生成が簡単になった。
短信著者: OossaOossa公開日: 1 分で読める
ggml‑org/llama.cppプロジェクトは2026年10月7日、新バージョンをリリースした。今回の更新ではサンプラーが変更され、温度が0の場合、モデルは最も確率の高いトークンを常に選ぶ(貪欲選択)。温度が0より高い場合や、確率をカスタム指定する場合は、従来どおりランダムサンプリングを行う。この変更はCPUでの実行に加え、文法制約や推論予算を使う処理にも適用される。
開発者は追加設定なしで、決定論的なテキスト生成が必要なときに、より予測しやすい出力を得られる。
Oossa · ニュースレター
今週のAIを、わかりやすく
毎週月曜日、知っておきたいニュースをやさしい言葉で。無料・スパムなし。