2025년 스트라테고 세계 챔피언십 시범 경기에서 새로운 AI 아타락소스는 대회 참가자들을 상대로 40판 중 38판을 이긴 데 이어, 스트라테고 역사상 가장 많은 업적을 쌓은 선수인 요한 니메이어도 꺾었다. 세계 챔피언 타이틀 4회 보유자이자 랭킹 1위를 600주 넘게 지킨 니메이어는 3주간 이어진 시리즈에서 약 85%의 승률을 기록한 아타락소스에 패했다. 경기는 온라인으로 중계됐으며, 아타락소스의 경기 방식은 읽기 어렵고 위험한 블러핑도 마다하지 않는 것으로 평가됐다.
아타락소스는 어떻게 승리했나
아타락소스는 스스로 대국하는 방식으로만 학습했고, 매 수를 두기 전에 상대의 숨겨진 말을 추측하는 신념 네트워크를 사용했다. 연구진은 초반에 AI가 첫 배치를 다양하게 바꾸도록 했는데, 정규화라고 부르는 이 기법은 AI가 예측 가능한 패턴에 안주하지 않도록 했다. 학습에는 Nvidia H100 GPU 16개로 1주일, GPU 4개로 추가 4일이 걸렸으며, 2025년 기준 비용은 $8,000 미만이었다. 이는 DeepMind가 앞서 개발한 DeepNash 시스템에 투입한 컴퓨팅 자원의 약 1/500 수준이다.
왜 중요한가
보드게임을 즐기는 사람들에게 이번 결과는 모든 말을 볼 수 없는 게임도 이제 AI가 다룰 수 있게 됐으며, 인간이 뚜렷하게 우위를 보이던 마지막 영역 가운데 하나가 사라졌음을 보여준다. 금융이나 협상처럼 정보가 숨겨진 현실의 문제에도 비슷한 AI 기법을 적용할 수 있다는 가능성을 시사한다. 다만 논문은 현재 방식이 컴퓨팅 자원을 더 늘린다고 해서 성능이 저절로 향상되는 것은 아니라고 지적한다.