8 октября 2026 года Ханвэнь Ли и его коллеги опубликовали статью о VoS (Value of Steering — «ценность коррекции»). Система анализирует большую таблицу контрфактических запусков и определяет, на каком этапе следует скорректировать агента на базе большой языковой модели (LLM). VoS можно запускать онлайн или офлайн; механизм с порогом допустимого вреда помогает не вмешиваться в успешные запуски. В 12 сочетаниях тестов и агентов VoS повысила результаты в среднем на 7,8 балла и в 11 случаях превзошла пять существующих триггеров, основанных на оценке неопределённости.
Почему это важно
Для разработчиков ИИ-ассистентов VoS предлагает практичный способ вмешиваться только тогда, когда это, вероятно, принесёт пользу, повышая надёжность без чрезмерного ручного контроля.