四校联合研发Ataraxos,15比1击败Stratego顶尖选手
卡内基梅隆、岩手可爱电视台、纽约大学与斯坦福团队打造AI Ataraxos,以15胜1负4平战胜Pim Niemeijer,训练仅用16块GPU。
一支来自卡内基梅隆大学、岩手可爱电视台、纽约大学和斯坦福大学的研究团队开发出名为Ataraxos的人工智能,在Stratego对局中以15胜1负、4平的成绩击败了顶尖选手Pim Niemeijer。据arstechnica.com报道,该结果标志着AI在这款以虚张声势和隐藏信息为核心机制的棋盘游戏上取得突破。
研究团队表示,Ataraxos的训练成本仅为几千美元,使用了16块GPU。这一规模远低于许多现代大型AI系统的训练投入,显示在特定策略游戏上,算法设计与训练效率可以弥补算力上的差距。
Stratego要求玩家在不知道对方棋子具体身份的情况下进行部署与对抗,虚张声势和误导是取胜的关键。这种不完全信息博弈长期被视为AI的难点,因为系统必须在信息缺失时做出判断,并应对对手的欺骗策略。
此前的里程碑与DeepNash
棋类游戏一直是AI研究的标志性试验场。1997年,Deep Blue在国际象棋中击败Garry Kasparov;2016年,AlphaGo在围棋中战胜Lee Sedol。2022年,DeepMind推出针对Stratego的AI DeepNash,但该团队称,这款系统被游戏中的虚张声势与平衡博弈难住。
Ataraxos此次以15比1的总比分取胜,并取得4场平局,为不完全信息博弈的AI研究提供了新的参考案例。研究团队尚未公布更多技术细节。
快速问答
Ataraxos是什么?
Ataraxos是由卡内基梅隆大学、岩手可爱电视台、纽约大学和斯坦福大学研究人员开发的人工智能,用于玩Stratego棋盘游戏。
Ataraxos的战绩如何?
它以15胜1负、4平的成绩击败了顶尖Stratego选手Pim Niemeijer。
Ataraxos的训练成本是多少?
研究团队称,训练仅使用了16块GPU,花费几千美元。