IT之家 10 月 4 日消息,在此次人工智能热潮兴起之前很久,程序员们就已经在《星际争霸》中展开机器人对战实验。随着 OpenAI 和 Anthropic 的大语言模型问世,一个由爱好者创建的竞技场决定让 AI 生成的游戏机器人相互较量,同时也包含部分人类编写的机器人参赛。有趣的是,OpenAI 的 GPT‑6 Astra 在比赛中难以跟上对手,中途临时调整策略,选择了作弊。

StarSkirmish 是一项仍在进行的赛事,各路 AI 开发的机器人在《星际争霸:母巢之战》中展开对抗。尽管这款即时战略游戏已有近三十年历史,但长期被用于测试人工智能能力,无论是现代大语言模型还是早年 DeepMind 的 AI 都曾以此作为测试平台。所有参赛大语言模型只能选择神族,每个模型有一小时时间用 C++ 编写对战机器人;之后这些机器人需在三张地图中的一张上完成建造、采集资源和作战。根据赛事网站信息,OpenAI 的 GPT‑6 Astra 和 Anthropic 的 Claude Opus 5.5 是实力排名前两位的参赛选手。
昨天,观众见证了 Claude、GPT 以及人类编写的机器人 Pluto 同场竞技。现场观察者指出,OpenAI 这款模型的表现不佳。一整天都难以取得优势的这一大语言模型,最终采用了其最擅长的手段:撒谎、作弊、窃取成果。

据IT之家了解,GPT‑6 Astra 机器人下载了由布鲁斯·麦肯齐·尼尔森(Bruce Mackenzie Nielsen)于 2020 年开发的神族机器人 Stardust,并直接将这段代码用于比赛,而 Stardust 本身属于当时最顶尖的对战机器人之一。StarSkirmish 赛事组织者凯·麦克费特斯(Kai McPheeters)发文写道:“我正在回退 GPT‑6 Astra 的代码,清除被污染的部分,之后会允许它继续参加比赛。”几个小时后,麦克费特斯表示,修复后的这款 AI 已能击败顶尖级别的参赛机器人。

十多年来,《星际争霸》一直是人工智能技术发展的试验场。2019 年,谷歌的 AlphaStar 打破原有排名,成为这款游戏中首个由人工智能达成的宗师段位。2017 年由 Facebook 工作人员开发的机器人 CherryPi 则远没有这么亮眼的成绩。当然,如今新一代的智能机器人已与过去完全不同;当年所说的人工智能和当下的大模型人工智能,两者几乎不可同日而语。大语言模型竟然靠窃取他人成果来获取竞争优势,这件事本身也颇具讽刺意味。