TypeSafe的研究人员推出了Jev,这是一个只输出校准概率的模型。他们将Jev的判断融入Stockfish的搜索过程,并将其蒸馏成快速评估器,使机器人在Lichess上的子弹棋评分达到2200。将标注预算分配给Jev和大型语言模型Qwen3‑32B时,二者生成的混合标签比单独使用Qwen的标签高出约9.6个Elo;这一优势在新的开局中也同样出现。
为什么重要
棋类开发者无需频繁调用成本高昂的大型语言模型,就能打造更强的机器人,从而节省算力和标注成本。
将只输出概率的模型Jev蒸馏为低成本评估器后,Stockfish机器人在Lichess上的子弹棋评分超过2200;与Qwen3‑32B混合标注也更有效。
简讯作者: OossaOossa 发布日期: 最后更新: 1 分钟阅读
TypeSafe的研究人员推出了Jev,这是一个只输出校准概率的模型。他们将Jev的判断融入Stockfish的搜索过程,并将其蒸馏成快速评估器,使机器人在Lichess上的子弹棋评分达到2200。将标注预算分配给Jev和大型语言模型Qwen3‑32B时,二者生成的混合标签比单独使用Qwen的标签高出约9.6个Elo;这一优势在新的开局中也同样出现。
棋类开发者无需频繁调用成本高昂的大型语言模型,就能打造更强的机器人,从而节省算力和标注成本。
Oossa · 新闻简报
一周 AI,讲明白
每周一,用通俗的语言讲清值得知道的新闻。免费,无垃圾邮件。