Oossa

llama.cpp 为零温度运行加入贪心采样

开源 Llama.cpp 库现已在温度设为零时采用贪心选择,简化低随机性文本生成。

简讯作者: Oossa 发布日期: 1 分钟阅读

ggml‑org/llama.cpp 项目于 2026 年 10 月 7 日发布了新版本。此次更新调整了采样器:当温度为零时,模型总是选择概率最高的 token(贪心选择)。温度较高或用户指定概率时,仍沿用现有的随机采样方式。这项改动适用于 CPU 运行,也适用于使用语法或推理预算的路径。

为什么重要

开发者无需额外配置,就能在需要确定性文本生成时获得更可预测的输出。

这篇文章有帮助吗?
分享

继续阅读

Oossa · 新闻简报

一周 AI,讲明白

每周一,用通俗的语言讲清值得知道的新闻。免费,无垃圾邮件。