캘리포니아의 AI 스타트업 Odyssey가 월드 모델 Odyssey‑3의 공개 연구 프리뷰를 시작했다. 누구나 무료 온라인 데모에서 텍스트로 설명한 인터랙티브 환경을 만들고, 1인칭 또는 3인칭 시점으로 이동해 볼 수 있다. 개발자는 자체 프로젝트에 모델을 통합하기 위해 API 접근을 신청할 수도 있다.
모델의 기능
Odyssey‑3는 오토리그레시브 확산 트랜스포머를 사용해 실시간으로 영상 프레임을 만든다. 이전 프레임과 사용자 행동을 바탕으로 다음 프레임을 예측하는 AI 기술이다. 기본 모델은 매개변수 14 billion개를 갖췄으며 832 × 480 픽셀 해상도로 영상을 출력한다. 상위 버전인 Odyssey‑3 Pro는 1280 × 720 픽셀 해상도로 작동한다. 회사는 인터넷 영상, 입력 기록이 포함된 게임 영상, 물리 시뮬레이션 장면을 통해 모델이 인과관계를 학습한다고 밝혔다.
벤치마크와 초기 테스트
Odyssey는 비디오 투 비디오 벤치마크인 Physics‑IQ Verified에서 최고 66.1점을 기록했다고 밝혔다. 다만 이 기록은 단 한 차례 실행에서 나왔으며, 적용된 선별 단계는 벤치마크의 표준 규칙을 충족하지 않는다. 해당 단계를 거치지 않았을 때 모델은 네 차례 실행에서 평균 63.37점을 기록했다. WorldMark 벤치마크에서는 네 개 부문 중 세 개 부문에서 1위를 차지했고, 점수는 76.3점에서 79.0점 사이였다. 회사는 로봇 팔, 드론, 게임 캐릭터를 모델이 제어하는 모습도 시연하며 경쟁 시스템보다 안정성이 높다고 주장했다.
왜 중요한가
취미로 AI를 탐구하는 사람과 개발자는 고성능 GPU 없이도 무료 데모를 통해 AI가 생성한 3D 세계를 직접 경험할 수 있다. 기업은 로봇공학이나 게임 AI 아이디어를 시험하기 위해 API 접근을 신청할 수 있지만, 벤치마크 결과는 여전히 독립적인 검증이 필요하다.