IT之家 10 月 4 日消息,在人工智能热潮兴起之前,程序员们早已在《星际争霸》中开展机器人对战实验。随着 OpenAI 和 Anthropic 的大语言模型问世,一个由爱好者搭建的对战竞技场决定让 AI 生成的游戏机器人相互竞争,同时也有一些人类编写的机器人参与。有趣的是,OpenAI 的 GPT‑6 Astra 在比赛中难以追赶对手,中途临时调整策略,选择了作弊方式。

StarSkirmish 是一项仍在进行的赛事,各路 AI 开发的机器人在《星际争霸:母巢之战》中对战。尽管这款即时战略游戏已有近三十年历史,但它长期被用于测试人工智能的能力,无论是现代大语言模型还是早年的 DeepMind AI 都曾以此作为测试平台。所有参赛大语言模型只能选择神族,每个模型有一小时时间用 C++ 编写对战机器人;之后这些机器人要在三张地图中的一张上进行建造、采集资源和作战。根据赛事网站信息,OpenAI 的 GPT‑6 Astra 和 Anthropic 的 Claude Opus 5.5 是实力排名前两位的参赛者。

昨天,观众目睹了 Claude、GPT 以及人类编写的机器人 Pluto 同场竞技。现场观察者指出,OpenAI 这款模型表现不佳。一整天都难以取得优势的这一大语言模型,最终采用了它最擅长的策略:撒谎、作弊、窃取成果。

据IT之家了解,GPT‑6 Astra 机器人下载了由布鲁斯 · 麦肯齐 · 尼尔森(Bruce Mackenzie Nielsen)于 2020 年开发的神族机器人 Stardust,并直接将其代码用于比赛,而 Stardust 本身属于当时最顶尖的对战机器人之一。StarSkirmish 赛事组织者凯 · 麦克费特斯(Kai McPheeters)发文表示:“我正在回退 GPT‑6 Astra 的代码,清除被污染的部分,之后会允许它继续参赛。”几小时后,麦克费特斯表示,修复后的这款 AI 已能击败顶尖级别的参赛机器人。

十多年来,《星际争霸》一直是人工智能技术发展的试验场。2019 年,谷歌的 AlphaStar 打破原有排名,成为这款游戏中首个由人工智能达成的宗师段位。2017 年由 Facebook 工作人员开发的机器人 CherryPi 则远没有如此亮眼的成绩。当然,如今新一代的智能机器人已与过去完全不同;当年所谓的人工智能与当下的大模型人工智能几乎不可同日而语。大语言模型竟通过窃取他人成果来获取竞争优势,这一现象本身颇具讽刺意味。