Hanwen Li와 동료 연구진은 2026년 10월 8일 VoS(Value of Steering)를 설명한 논문을 발표했다. VoS는 대규모 반사실적 실행 결과를 학습해 LLM 기반 에이전트의 어느 단계에서 개입해야 할지 판단한다. 오프라인과 온라인 모두에서 작동하며, 성공적으로 진행 중인 실행을 방해하지 않도록 피해 예산(harm-budget) 기준을 활용한다. 12개 벤치마크·에이전트 조합에서 VoS는 점수를 평균 7.8포인트 높였고, 기존 불확실성 기반 개입 기준 5종 가운데 4종을 11개 사례에서 앞섰다.
왜 중요한가
AI 비서 개발자에게 VoS는 효과가 있을 가능성이 높은 경우에만 실용적으로 개입해, 과도한 수동 감독 없이도 신뢰성을 높이는 방법을 제공한다.