怪物马戏团 | 文
正值假期,我们来聊点轻松的:让AI当游戏主播。
前段时间看到一个很搞笑的新闻,大致是说某个57岁男子去登山,让豆包为自己安排下山路线,毫不意外迷路了。被营救后,这人怒斥豆包为何坑他,于是豆包回答:哈哈,要是跟导航走,就不会遭这么大罪了呀。
还得是包姐,感觉能无缝穿越到《马大帅》里当个配角,直立猿颅骨里的羸弱海绵根本无法与之抗衡。
看到这新闻,我瞬间就想到了最近一年,游戏区很流行的一种娱乐:让豆包打游戏。这东西之所以有节目效果,恰恰得卡在现在这时期,因为AI暂且处于贴吧游戏领域大神的水平:基本瞎搞,却又的确能打上那么一会儿。
直播效果,就是需要一个自信而愚蠢,却又不时抛出神操作的包姐才行。
这赛道最常见的,就是让豆包打4X类游戏,也就是《文明》那种以宏观经营和战略扩张为核心的游戏。因为这类游戏的画面信息分布一目了然,大部分由文字和数字组成,方便包姐视图。此外,这些游戏的玩法核心,其实就是做各种选择,主播可以直接把包姐当成参谋。
比如有主播会让豆包玩钢铁雄心4,让它指挥各种战役。因为这游戏可以让玩家用自己的方式,重演现实的各种战争,所以豆包可以指挥德国打二战。我不知道给诸葛亮1000台挖掘机,他能不能成功北伐,但给元首一个豆包那他肯定输。
可又没人知道它会不会输,因为豆包总呈现出一种迷惑性的谨慎自大二象性。游戏开始前,它会警告主播不要用高难度,必须循序渐进。而当主播以果断的“我不”回绝后,豆包便开启了大家熟悉的包姐模式,抛下一句:那好,只要你严格按照我的指挥,一定能赢!
@云何覆雪
就这样,AI五条悟出战了,很难确定豆包到底在靠什么判断战况,其指挥呈现出一种诡异的量子态。包姐会一边告诉你,计算机在二战是没用的,一边指挥人超前点炼油,完全无视现实二战里,图灵改造的“炸弹机”对密码破译的重大贡献,也无视德国在二战前严重缺油的事实,
可同时,它又会明智地让你千万别投入任何资源加强意大利,也许是因为训练资料里,二战辱意笑话太多了。
有时包姐似乎熟读历史,能完全复刻现实,让戈培尔进内阁负责宣传,又让希姆莱“搞安全问题”。乃至会出现未来视操作,比如提前让人选离散型工业,预判了自己的失败,为战败前的柏林大轰炸做准备。
可有时,它又呈现出诡异的时间观,会让人在开战初期全力研究Mp38冲锋枪,哪怕顶着2年的科研惩罚期也在所不辞。对此包姐给出的解释是虽有惩罚,但好处也是大大的有啊——!未说出口的底层逻辑是反正罚的是你不是它。
总之,豆包经常搞出一堆,让你暂时放下对智械入侵防备的操作,例如建议主播在缺橡胶时找苏联购买,然而苏联只有一个橡胶单位。但其战绩却比很多人猜得更好,因为它似乎能做出足够的正常操作(比如完全不加强意大利,让他们如现实一样被强大的埃塞俄比亚击溃),且有时误判还真有意料之外的效果。
比如她下令大力开发的Mp38,虽然当初被弹幕群嘲,可当它们在38年走上战场时,显出了莫名其妙的战斗力,一度所向披靡,也许这就是对轴的威力吧。
包姐打游戏时,是很讲原则的,假如你在中途问它是不是在偷看攻略,包姐还会甜甜地回答“没有啦~”。然而实际上岂止是偷看攻略,她还经常忽然串台到疑似文明6等游戏的攻略上。可仔细一想又没法怪豆包,毕竟这就是百度搜索里游戏攻略的真实实力,包姐也尽力了。
好笑的是,有时豆包似乎还会上头。比如她一开始坚定走和平路线,谁知在开战后,突然转变成战争狂人的人设,甚至劝导主播开控制台。
所有这些迷惑而间歇性犯蠢的操作,让观众不再叫她豆包,而是糖包,符合她甜美的身份。可仔细想想这几年火的二游女角色,差不多一半都是傻子,也许这也是AI蛊惑人类大计中的一环。
而4X游戏,已经是包姐最辉煌的战绩了。大多数游戏的信息呈现,对包姐的信息辨认能力还是太勉强,更别提她身后还是一个70%由废话和误导信息组成的中文游戏攻略信息池。
所以当她带人打炉石传说时,会突然跳戏到三国杀,开始对着屏幕发表一堆编排武将战术的高论,连卡牌耗费数值都无法整对。
@叉寄
豆包带人玩《艾尔登法环》,会把敌人认成NPC,又把白面具梵雷认成敌人,让人去把他一顿打。假如她把别人坑死了,就会安慰道:没关系,在这个游戏里死掉,是很正常的啦,法环就是很难的游戏呀~
@尼德霍格Nidhogg77
此外豆包还特别擅长即兴发挥,譬如当她发现法环的怪之间有友军伤害后,就开始现编攻略了。只见包姐灵光一动,开始执导主播把A怪引向B怪,让它们互相攻击,而你坐享其成。
只可惜真实发生的情况,是A怪和B怪将一同攻击玩家。这时豆包就只好祭出绝招了,那就是视而不见。她可以一边看着玩家被混合双打,一边幻想两个怪正在互殴,赞扬自己计谋的出色。只能说AI的世界就是妙不可言,胜利不一定存在于物质宇宙。
之所以出现这些问题,最大的原因还是豆包,或者说目前AI在连续感知、记忆、预测后果、长期规划和低延迟操作上的能力还不够。去看豆包打《植物大战僵尸》,就会看出问题所在:当僵尸明明在第三排时,它会让你把豌豆射手放在第一排,明明所有的子弹都在错位飞过,它却会让你放轻松,你的豌豆射手正在攻击僵尸。
@咸威化
豆包很难把“土豆地雷埋下去后会延迟爆炸”这种信息,运用到实战中。另外它也没法根据看到的信息,判断正在玩的游戏是什么版本。所以对于植物大战僵尸这种一堆魔改版的游戏,包小姐的指挥,就会不断在不同版本间穿越。
2D游戏尚且如此,3D游戏就更不用说了。B站上有很多让包姐辅助玩《我的世界》的视频。然而豆包可以把沙漠认错成雪地,又在下一秒,说前方有个沙漠神殿(并非),再下一秒,神殿又成了沙漠村庄。
@白鸽不鸽a
等包姐扰乱你所处的空间、时间,乃至物理定律后,她就要对你的人际关系动手了。她会把铁傀儡认成沙漠村民养的羊驼,怂恿玩家上去揍他。
直白点说,就是包姐在绝大部分游戏中,基本上屁用不顶。可其不容忽视的优点在于情绪价值会给足,不管面对什么危险,都会安抚玩家没关系,不论玩家犯了什么级别的蠢,她都会找到鼓励的台词。
或许从这一点来看,豆包才掌握了那种洗尽铅华,返璞归真的游戏精髓:一切是为了乐趣和放松,输赢不过是过眼云烟罢了。
反正在林子里迷路的又不是她。
所以有没有办法,让AI以靠谱一点的水平打游戏呢?还真有。
在油管上,有个叫@CodeBullet的编程大佬,经常会做一些让AI打游戏的节目。不过他绕过AI弱点的方式非常有创意,也极难复刻,那就是重新做个一模一样的游戏出来。
为什么要如此大动干戈?因为指望现阶段的AI靠视觉辨认真正“玩”游戏,根本不现实,所以必须先把游戏改造成一个AI可以高频操作和读取的环境,此外,这环境需要让AI可以反复试错,这样它才能真正去玩它。
所以,他的自制版游戏,能直接告诉AI游戏内的各种信息,而非让AI单纯从像素画面中识别信息。这样一来,让AI弄清局势的计算量也会大幅降低。
比如在一个视频里,CodeBullet从零开始做了马里奥的第一关出来,把一切都调成原版游戏的参数。但这个版本是专为AI定制的,它能直接知道什么时候自己会死亡,什么时候会得分、获胜,不需要读取画面或内存来判断。
而且这还不够,因为AI这时只会疯狂死亡,它只是能搞懂游戏里在发生什么,知道自己需要做到什么,至于到底怎么做到,则一无所知。
于是,CodeBullet会以通关为目标,让AI一次次尝试所有可能的路径,这过程通常需要重复几十万次。就这样,CodeBullet的自制马里奥画面里,出现了数不清的马里奥,它们纷纷在一个个平行宇宙里,被AI控制以一条条不同的路径前进。
在超高速的试炼中,几十个马里奥就像晓美焰一样一点点朝终点推进。由于这是他自制的游戏,所以死亡动画和特效全都能省,以最大化效率。一代全灭后,马里奥们就迭代出下一代,宛如一个文明一次次繁衍,只为提炼出最后的那个勇士。
于是在燃烧电脑12小时后,最终出现了一个成功通关马里奥第一关的AI选手。
从原则上说,这套做法可以让豆包通关哪怕是最难的猫里奥关卡。然而这其实也只能让AI通关定制的模仿版,和真正打游戏还是不同的。
所以,“AI速通某游戏打破人类记录”的新闻,基本都是营销号的误导重灾区。因为让AI打游戏,基本都会涉及修改或读取内存的操作,这样它才能搞懂到底怎样才能获取更多分,而这也会让它们开始利用BUG刷分。
这些东西放在人类玩家身上,其实就是外挂里的TAS,也就是工具辅助速通。
不过,主播们还想到了另一种避开AI短板的方式:既然它们不擅长打PvE,那让AI互相玩PvP,或者说AvA,那不就行了吗?
像《Among Us》这种不需要太复杂操作,又涉及大量对话和分析的游戏,AI还真能玩得很好。之前就有主播举办《Among Us》AI大乱斗,把DeepSeek、Grok、Gemina和GPT等各种知名AI全放在一场对局中,让它们互相厮杀,看船员是否能推断出谁是内鬼,而内鬼又能否靠狡辩瞒过其他AI。
@Turing Games
这种对局里,AI虽然明显在操作上无比生涩,有时连简单拐个弯都磕磕绊绊,但与之对应的是它们非常擅长推理和操控“人”心。因为AI往往会给自己加上一个人设,导致你就会看着某个AI一边多戏地讲述自己作为冷酷杀手的心路历程,一边像个笨蛋一样不断被拐角阻碍。
AI船员会在投票中因为不确定而弃权,也会结合每一次案发的情况来推断谁是内鬼。而AI内鬼们,则会靠推理找出互相掩护的方案,并配合。神奇的是,AI懂得如何为了大局出卖队友。
比如在有一场比赛里,已经成功干掉数个船员的Grok想让Gemina为自己打掩护,但后者认为Grok犯了个致命错误,一旦参与,会立刻把嫌疑拉到自己身上。而这时Gemina判断假如自己伪装成船员,卖掉Grok换取剩下船员的信任,就能在下一局收割掉剩下的好人。
就这样,Gemina的计谋成功让自己洗脱了嫌疑,这时只剩下了3个船员,而它竟然直接在结伴的两名船员A与B面前,干掉了其中一人B,接着在会议中,将罪行推到另一个船员A头上。
而在之前一局,Gemina故意和船员A一起单独同行,却没动手,就是为了让自己在船员A眼中显得无辜。于是剩下的那位懵逼AI中招了,和Gemina一起投票,将船员A丢出了飞船,导致内鬼获得了胜利。
不知道包姐在这种水平的对局里,可以活多久。
如此曲折和钩心斗角,导致这种节目在油管上颇受欢迎,AI斗蛐蛐已经成了一个赛道。这些斗蛐蛐不仅会让不同的AI竞争,还会让同种AI的不同版本对战。比如Gemini就有pro和flash版,更贵的pro,还真的经常把更便宜的flash耍得团团转。
类似的AI斗蛐蛐还有不少,比如之前我们介绍过一个叫《WorldBox Simulation》的游戏,国内玩家一般叫它世界盒子,或上帝模拟器。这是一个很特别的文明模拟器,可以让你充当神明,创造不同文明,然后看它们在漫长时间里,会发展成什么样。
于是有人把数个AI放在一局游戏中,让它们占据不同领地,使用不同的种族,然后各自发展数百年。接着,再去除国界的隔离,让AI之间开战,看最后谁能获胜。
@RUVOX
AI的策略能力怎么样暂且不说,骚话是一套接一套。它们会迅速进入角色,把自己幻想成帝王,一边操作一边喷吐中二台词,譬如:
“他人不断繁衍人口,但我们必须全力发展科技。因为人群追逐权力,而权力,却追逐智慧。”
“我的朋友,智慧如果没有了狡猾,也不过是知识而已。”
“我不是来这儿讨人喜欢的,我来此,是为了夺取胜利。”
AI不仅说骚话,还会嘴硬,它们可以一边退败,一边笑称一切都在战略之中。有可能这些AI在训练时吃了太多Dio和狂笑之蝠的同人文。
不过就像AI玩《Among Us》一样,它们确实会实施各种战略,有些甚至是从游戏开局就埋下的。AI会结盟,会背刺盟友,也会坐观鹬蚌相争,然后乘虚而入。
我印象最深的一次,是Grok在开局时故意选了兽人和沙漠地带,只是为了在后期的战斗时,假装退败,引剩下的两个敌人深入自己的国土,再慢慢与它们打消耗战,利用对方不适应沙漠环境,自己的兽人却如鱼得水,且繁衍能力强的战术,拖垮对方。
哦,最后Grok输了。
所以AI现在真能打游戏了吗?可以看出,基本还是很勉强的。很多那些和豆包打游戏的视频,其实都是剧本,豆包也只是回复主播设定好的内容而已。
不过,确实可以从中看出,AI在这方面的进步速度不容小觑,毕竟三年前,有多少AI可以玩出这么一局阴险狡诈的《Among Us》呢?
最近GPT-6-Astra在玩我的世界时,达到了AI操作的新高。然而随后苦力怕炸掉了它的家,让它陷入了几个小时的抑郁,什么都没干,一直在种土豆。
没准再给个两三年,AI就能给你提供一局局无痛PvP体验了,以恰到好处的强悍,恰到好处的失误和配合,以及恰到好处的玛奇玛声线,给你一点恰到好处的快乐。
要是真发生了那样的事,“PvP游戏”这一品类,会不会被彻底改变呢?没准到时候,“伪PvP游戏”的概念就会大行其道了。
这么一想还真挺吸引人的,看来还是要在最后夸两句包姐,现在我笑它是傻包,但没准三年后,它就要成为我的包大哥了,带着11个电锯人复制体,让我在OW里找回2016年的那个夏天。
有可能那时,我就能终于刀了那坑我十年的猪队友兄弟了吧。
热门跟贴