이연서(Yeonseo Lee)가 이끄는 연구팀은 시각·언어·행동(VLA) 로봇 모델에 가볍게 추가할 수 있는 TempoBridge를 소개했다. TempoBridge는 지시문에서 ‘빠르게’, ‘천천히’ 같은 속도 지시를 읽어 동작 속도를 실시간으로 조절한다. 이 방식은 학습이 고정된 VLA 표현을 사용하므로 템포 관련 시연 데이터를 추가하거나 미세 조정할 필요가 없다. LIBERO 벤치마크 테스트에서 템포 성공률은 52.6%에서 89.7%로 높아졌고, 전체 작업 성공률도 높은 수준을 유지했다. 실제 로봇 실험에서도 시스템이 템포 지시를 따르는 것으로 나타났다.
왜 중요한가
새로운 학습 데이터를 추가하지 않아도 사용자가 “빠르게” 또는 “천천히”라고 말하는 것만으로 로봇의 작업 속도를 조절할 수 있다.