⚡
SnapTool
← 返回情报列表
📌 2026-10-03·Hacker News

军棋(Stratego)因信息高度隐蔽长期难倒 AI,如今终被攻克

#AI#博弈#研究
  • **历史背景**:1997 年深蓝击败国际象棋棋王卡斯帕罗夫,2016 年 AlphaGo 战胜李世石,扑克 AI 多年前也已战胜职业选手,但 Stratego(军棋/陆战棋)长期坚守阵地,连预算雄厚的 DeepMind 也未能造出能稳定击败顶尖人类的机器。
  • **最新突破**:来自卡内基梅隆、MIT、纽约大学和斯坦福的研究团队开发的 AI “Ataraxos”,以 15 胜 1 负、另有 4 平的成绩击败了公认史上最强 Stratego 棋手 Pim Niemeijer。
  • **低成本训练**:训练仅使用 16 块 GPU,花费几千美元。
  • **游戏特性**:Stratego 中每方有 40 枚棋子,代表从元帅到间谍的军衔,外加炸弹和军旗,以夺取对方军旗获胜;对手知道棋子位置却不知道其身份,只有两子交战时才揭示身份并移除较弱一方,属于不完美信息博弈。
  • **研究者解读**:纽约大学研究员、研究共同作者 Eugene Vinitsky 表示:“Stratego 有非常独特之处——海量隐藏信息在非常长的时间尺度上逐步展开。”
  • **对比扑克**:MIT 计算机科学家、另一位共同作者 Gabriele Farina 指出,德州扑克中“你只有两张暗牌”,隐藏信息量远小于 Stratego。