Oossa

Robo-COP, 배치된 로봇이 스스로 성능 개선

새로운 Robo-COP 시스템은 로봇의 정책과 이를 조정하는 오케스트레이터를 함께 학습시킨다. 시뮬레이션 성공률은 73.8%, 실제 환경 성공률은 50%까지 높아졌다.

짧은 소식작성: Oossa 게시일: 1 분 읽기

연구진은 로봇이 실제로 사용되는 동안 비전·언어·행동 정책과 오케스트레이터를 함께 미세 조정하는 방법인 Robo-COP를 선보였다. 시스템은 스스로 실수 데이터를 수집해 정책을 업데이트하고, 학습에 사용한 작업에서 성능이 더 좋다는 점이 확인된 뒤에야 새 버전을 적용한다. 시뮬레이션 환경의 RoboLab 작업 10개에서는 성공률이 64.8%에서 73.8%로 올랐고, 실제 환경 작업 3개에서는 38.3%에서 50.0%로 상승했다.

왜 중요한가

서비스 로봇이 현장에서 스스로 성능을 높일 수 있어, 사람이 자주 수동으로 재프로그래밍할 필요가 줄어든다.

이 기사가 도움이 되었나요?
공유

다음 읽을거리

Oossa · 뉴스레터

이번 주 AI, 쉽게 정리

매주 월요일, 알아둘 만한 소식을 쉬운 말로. 무료, 스팸 없음.