Forschende von TypeSafe haben Jev vorgestellt, ein Modell, das ausschließlich kalibrierte Wahrscheinlichkeiten ausgibt. Indem sie Jevs Einschätzungen in die Suche von Stockfish integrierten und zu einer schnellen Bewertungsfunktion verdichteten, brachten sie den Bot auf eine Bullet-Wertung von 2200 auf Lichess. Wird ein gemeinsames Labeling-Budget auf Jev und das große Sprachmodell Qwen3‑32B aufgeteilt, sind die kombinierten Labels etwa 9,6 Elo besser als Labels, die nur mit Qwen erzeugt wurden. Dieser Vorteil zeigt sich auch bei neuen Eröffnungen.
Warum es wichtig ist
Schachentwickler können stärkere Bots entwickeln, ohne auf teure LLM-Aufrufe angewiesen zu sein, und so Rechen- und Labelingkosten sparen.