星际争霸:重制版的天梯上最近出现了一个账号,叫“^333^”。它一路往上爬,爬到了全球天梯的顶端,路上顺手把Larva、Iris、Ret、Paralyze这些成名选手都赢了一遍。看回放的人一开始以为是哪个隐藏高手开小号,直到有人认出,这不是人。

它叫Pluto,一个为2026年计算机奥林匹克星际争霸AI竞赛做出来的神经网络,参数量3.15亿。在那场比赛的决赛里,它4比1击败了另一个bot PurpleWave,拿了冠军。和传统那种写死脚本的电脑对手不一样,Pluto是靠强化学习和自我对弈学会打星际的。它的作者说,同一套网络要处理整局游戏里的所有种族、所有对局组合、所有战术和每一个单位。

打开网易新闻 查看精彩图片

问题就出在这里:它本来不该出现在真人对战的天梯上。

正方:这操作确实离谱

先看它赢Paralyze那局。星际解说Artosis专门拆过这场。Pluto用的是人族,但它完全没按人族的常规套路走,造出来的兵种组合相当奇怪——机枪兵、医疗兵、坦克、幽灵、一架幽灵战机,甚至还有一个孤零零的火蝠。

按理说这种混编部队在真人手里很容易打成散沙,但Pluto的微操把它变成了一支很难缠的军队。它留了一架幽灵战机专门去猎杀高阶圣堂武士,用幽灵去锁定敌方单位,同时在好几个位置同时开打。有一瞬间,它还误把自己的攻城坦克给锁定了。

打虫族选手Larva那局更直接:六个兵营,只出机枪兵和医疗兵。据描述,它跳过了导弹塔,也跳过了攻击和护甲升级,靠包抄和操作压住Larva的飞龙,然后反打。

从数据上看,Pluto显示的APM到了几千。但它的底层模型并不是每分钟做几千个决策——它每六帧才行动一次,相当于每分钟240个动作。之所以显示的数字那么夸张,是因为游戏会把发给多个单位的指令分开记录。

AI研究者Evan“evanthebouncy”Chen对Pluto的评价是“一头本能极强的野兽”。他认为Pluto的微操无可挑剔,但建筑摆放很差,长期规划有限,遇到不熟悉的战术也容易吃亏。

反方:这成绩不算数

Brood War AI社区的人给出了另一个版本的说法。他们说,是有个不明身份的人把Pluto拿了过去,改成能在重制版里跑,然后在没有经过作者允许的情况下,把它放上了官方天梯。

他们还称,这个未授权版本用了地图挂,所以它的战绩没有任何合法性可言。Pluto训练时是在正常的战争迷雾下打的,开发者认为,多出来的那些信息有时候反而会让它犯迷糊。

换句话说,天梯上那个“^333^”,既不是Pluto的原作者放上去的,也不是Pluto原本该有的运行方式。

怎么判断这件事

把两边的话摆在一起,能确定的事实其实不多:Pluto是一个3.15亿参数的神经网络,赢了2026年计算机奥林匹克星际争霸AI竞赛的冠军,决赛4比1赢了PurpleWave;天梯上确实有个叫“^333^”的账号赢了包括Larva、Iris、Ret、Paralyze在内的选手;社区说这个账号是未经授权放上去的,并且用了地图挂。

至于“Pluto到底有多强”,这个问题现在没法干净地回答。因为天梯上的那个版本,和竞赛里夺冠的那个版本,社区认为不是一回事。

目前AI社区已经把“^333^”这个账号举报给了暴雪,并要求把它从天梯上移除。

这件事发生的时间点也挺微妙。暴雪最近公布了一款新的开放世界星际争霸射击游戏,预计2030年推出,这个系列正重新被人讨论。结果先上头条的,是一个不该出现在天梯上的bot。

对普通玩家来说,这事最别扭的地方在于:你排到的对手可能不是人,这本身已经够让人头疼了;但更麻烦的是,连它赢的那些局,都未必能算数。