# llama.cpp 为零温度运行加入贪心采样

> 开源 Llama.cpp 库现已在温度设为零时采用贪心选择，简化低随机性文本生成。

Oossa · 2026-10-07 · https://oossa.com/zh/llama-cpp-adds-greedy-sampling-for-zero-temperature-runs

ggml‑org/llama.cpp 项目于 2026 年 10 月 7 日发布了新版本。此次更新调整了采样器：当温度为零时，模型总是选择概率最高的 token（贪心选择）。温度较高或用户指定概率时，仍沿用现有的随机采样方式。这项改动适用于 CPU 运行，也适用于使用语法或推理预算的路径。

## 事实

- 发布日期：2026 年 10 月 7 日
- 新功能：温度为零时采用贪心选择

## 为什么重要

开发者无需额外配置，就能在需要确定性文本生成时获得更可预测的输出。

## 来源与参考

1. [ggml-org/llama.cpp b11472](https://github.com/ggml-org/llama.cpp/releases/tag/b11472) – llama.cpp, 2026-10-07

最后更新: 2026-10-07
