ggml‑org/llama.cpp 项目于 2026 年 10 月 7 日发布了新版本。此次更新调整了采样器:当温度为零时,模型总是选择概率最高的 token(贪心选择)。温度较高或用户指定概率时,仍沿用现有的随机采样方式。这项改动适用于 CPU 运行,也适用于使用语法或推理预算的路径。
为什么重要
开发者无需额外配置,就能在需要确定性文本生成时获得更可预测的输出。
开源 Llama.cpp 库现已在温度设为零时采用贪心选择,简化低随机性文本生成。
简讯作者: OossaOossa 发布日期: 1 分钟阅读
ggml‑org/llama.cpp 项目于 2026 年 10 月 7 日发布了新版本。此次更新调整了采样器:当温度为零时,模型总是选择概率最高的 token(贪心选择)。温度较高或用户指定概率时,仍沿用现有的随机采样方式。这项改动适用于 CPU 运行,也适用于使用语法或推理预算的路径。
开发者无需额外配置,就能在需要确定性文本生成时获得更可预测的输出。
Oossa · 新闻简报
一周 AI,讲明白
每周一,用通俗的语言讲清值得知道的新闻。免费,无垃圾邮件。