I en uppvisningsmatch under Stratego-VM 2025 vann den nya AI:n Ataraxos 38 av 40 partier mot turneringsspelare och besegrade senare Johan Niemeijer, den mest meriterade Stratego-spelaren någonsin. Niemeijer, som har fyra VM-titlar och har toppat rankningen i mer än 600 veckor, förlorade den tre veckor långa serien med en vinstprocent på omkring 85. Matcherna sändes på nätet, och AI:ns spelstil beskrevs som svårläst och benägen att ta riskfyllda bluffar.
Så tog Ataraxos hem segern
Ataraxos lärde sig enbart genom att spela mot sig självt och använde ett belief-nätverk för att uppskatta motståndarens dolda pjäser inför varje drag. Forskarna tvingade AI:n att variera sina öppningsuppställningar i början, en teknik som kallas regularisering och som hindrade systemet från att fastna i ett förutsägbart mönster. Träningen tog en vecka på 16 Nvidia H100-GPU:er och ytterligare fyra dagar på fyra GPU:er. Med 2025 års priser kostade den mindre än $8,000 – ungefär 1/500 av den beräkningskraft DeepMind lade på sitt tidigare system DeepNash.
Varför det spelar roll
För vanliga brädspelsentusiaster visar resultatet att AI nu kan hantera spel där man inte ser alla pjäser – ett av de sista områdena där människor tydligt hade övertaget. Det antyder också att liknande AI-tekniker skulle kunna användas för verkliga problem med dold information, som finans eller förhandlingar. Artikeln påpekar dock att den nuvarande metoden inte blir bättre bara genom att man tillför mer beräkningskraft.