TypeSafeの研究者らは、較正された確率のみを返すモデル「Jev」を発表した。Jevの判断をStockfishの探索に組み込み、高速な評価器に蒸留した結果、ボットはLichessで弾丸レーティング2200に到達した。ラベル付けの予算をJevと大規模言語モデルQwen3‑32Bで分けた場合、両者を組み合わせたラベルはQwenのみを使う場合より約9.6 Elo高い性能を示し、新しいオープニングでも同様の効果が確認された。
なぜ重要か
チェス開発者は、高価なLLMの呼び出しを抑えながら、より強いボットを開発できる。計算資源とラベル付けのコスト削減につながる。