IT之家 9 月 7 日消息,一名 AI 和大语言模型爱好者近日进行了一项实验,让 OpenAI 的新模型 GPT-6 Astra 自主通关了 Valve 旗下 3D 解谜游戏《传送门》。
从结果来看,这对大语言模型而言无疑是极具突破性的进步,也是对多模态“AI 智能”的一次颇具说服力的展示。不久之前,AI 甚至还会在 Atari 2600 国际象棋游戏中输掉比赛,而如今已经能够自主通关整个 3D 解谜游戏。
这次《传送门》通关过程共进行了 3336 次工具调用,按照 API 价格计算,成本达 571.18 美元(IT之家注:现汇率约合 3,838 元人民币)。
实验发起者 CozyBlaze 随后澄清称,这些成本实际上由其每月 200 美元(现汇率约合 1,344 元人民币)的 Codex Pro 订阅服务覆盖。
CozyBlaze 解释称:“模型通过 MCP,也就是 Model Context Protocol,以及经过修改的 SourcePauseTool 来控制《传送门》。模型思考时,游戏会保持暂停状态;当模型发送一组输入指令后,SPT 会解除暂停并执行这些操作。”
在 AI 进行思考期间,系统会向其提供游戏截图以及玩家角色所在位置等信息。随后,游戏恢复运行,GPT-6 Astra 按照自己规划好的步骤执行移动和其他操作。
这也解释了为什么经过剪辑的精彩视频长度约为 2 小时,但 GPT-6 Astra 游玩《传送门》的完整视频直播记录加起来却长达约 24 小时。
对于这次实验成果,CozyBlaze 的态度相当务实。他承认,目前仍然存在许多需要解决的问题,这次通关过程也不应该被视为 AI 能力的标准化基准测试。
不过,他表示:“但看到一个通用型智能体能够自主探索游戏世界,并最终一路完成整个游戏,会让人感觉最初的愿景正在逐渐成为现实。”
CozyBlaze 所说的“最初愿景”,指的是 OpenAI 早在 2016 年提出的一项长期目标。当时,OpenAI 曾设想,未来能够打造一个单一 AI 智能体,让它解决各种不同类型的游戏任务。
GPT-6 Astra 于本月早些时候成为 OpenAI 的新旗舰模型。OpenAI 表示,新模型代表了“新一代智能”,并且在计算机操作、网页浏览、软件工程、网络安全、科学研究以及专业工作等领域达到了当前最先进水平。
预计在未来几天里,会看到 Astra 大展其强大的智能能力。
热门跟贴