这两天我打开B站,首页直接被各种“赛博斗殴”刷屏了——《剑星》女主跑去参加快乐向前冲、哨兵在巷子里大战、都市异能随手砸穿半条街……随手点开一个视频,弹幕飘着整齐的“不像AI”“什么时候能跑团本”。但在满屏整活之下,我看到不少游戏圈的朋友表情明显不太一样:不是单纯的乐,而是牙疼一样的酸爽。

因为他们一眼就认出了这些视频背后那条真正要命的线——即梦 Seedance 2.5,两天前悄悄上线了。玩家在玩梗,但开发者在盘算:这种稳定程度如果能量产,“手搓”的好日子可能真的要走到头了。

打开网易新闻 查看精彩图片

我索性自己打开即梦试了一下,越试越觉得头皮发麻。这次 Seedance 2.5 的升级,根本不是小修小补,而是一整套把专业活儿往“平民化”硬掰的动作。下面咱们挨个盘一盘它到底在哪些地方把门槛踩碎了。

第一刀:原生 30 秒,叙事不用再硬拼
过去市面上大部分视频模型,一次只能吐 15 秒左右的片子。15 秒够干嘛?一个华丽的技能特写都播不完,更别提讲清楚“谁在哪儿干啥”。所以我们那时候拼长视频,只能像拼乐高一样一段段接,接完人物脸都换了三次,看着就出戏。

Seedance 2.5 直接原生支持 30 秒,等于一口气把叙事空间翻了个倍。我用大白话随手扔给它一段武侠打斗的提示词——没有参考图,也没有任何分镜描述——结果它给出来的东西让我愣了一下。它不但有完整的打斗动作,还自己安排了开场环境、人物登场、动作爆发,镜头运动比我自己脑子里想的都要像回事。那种影视剧式的空间建立和节奏感,我这种业余玩家平时根本组织不出来。

这意味着啥?意味着以前必须靠剪辑和关键帧硬凑的连贯感,现在模型可以自己顶上去了。对做游戏宣传片、剧情过场的人来说,这能省掉的返工时间不是一点半点。

第二刀:局部编辑,终于不用重开全图了
搞过 AI 视频的都知道,最崩溃的瞬间不是抽不到好卡,而是你抽到了 99 分的神作,偏偏角落里有个鬼影要不得。在过去,你想改掉那个局部瑕疵,基本等于重新抽卡,改一个模型手指头,可能整个场景的色调都给你换掉。

即梦官方宣传片里有一段局部编辑的演示,弹幕直接高潮了。视频里不但能替换某个视觉元素,还能转换镜头、反转整个环境的氛围,而原本的人物状态、镜头结构全都被稳稳保留着。这相当于把 AI 视频的修改方式,从“重开一局”变成了“精准微调”。对于游戏宣发物料这种反复修改重灾区来说,这个能力简直救大命了。

第三刀:白模素材直接渲染,3D 流程被捅了一刀狠的
这一刀最让游戏开发圈破防。即梦 Seedance 2.5 是全球第一个支持白模素材参考的视频模型,而且它直接给 3D 软件开了接口,接入了 Maya 和 Blender 的插件。

简单说就是:你拿一个灰白色的原始建模视频丢进去,配上提示词和参考图,它就能直接输出一段已经完成材质、灯光、镜头渲染的成品。官方手册里的案例很直观——一段简易的 3D 白模运镜,经过模型处理后,直接变成了一个光影真实、细节丰富的完整场景。

干过 3D 美术或者对接过外包的兄弟都知道,从白模到最终成片,中间隔着一长串又贵又慢的工序:材质、贴图、灯光、渲染、合成,每一个环节都得靠专业软件和专业人手堆上去,一个小改动可能就是从头来一遍。现在 Seedance 2.5 这手,等于直接往中间流程里插了一根加速带——验证概念、沟通效果、前期迭代的那一堆中间成本,很可能大幅缩水。而且它还能理解白模传递的空间关系和镜头运动,连机位调度的逻辑都会自己找,这对 3D 动画里最头疼的“机器不知道你镜头要往哪转”的顽疾,算是一次精准打击。

第四刀:游戏开发圈已经不是在讨论“能不能用”了
可能很多人觉得,这些能力再强,也就出个视频,跟游戏开发本体还隔着一层。但年初 Seedance 2.0 上线的时候,我身边就有不少开发者开始把 AI 视频塞进实际流程了。长期研究 AI 视频与游戏融合的制作人吉川明静当时就说,2.0 给人的感觉就是“这么强的模型,居然在这个时间点就出现了”。他把那个版本比作六边形战士,综合能力一出来就压了其他模型一头。

而现在 2.5 这一轮升级,最可怕的地方不是单个指标的提升,而是它开始从整个制作流程下手去优化痛点。原生 30 秒解决叙事连续性,局部编辑解决修改随机性,白模渲染解决 3D 验证成本,这三招连在一起,直接逼得开发者把思考从“能不能实现”推到了“什么环节可以交出去”的阶段。

过去我们觉得 AI 视频在游戏行业就是个概念图生成器、创意辅助工具,但这次 2.5 带来的能力变化,很可能让视频模型第一次真正摸到开发管线里花钱最多的那几个环节。对于还没开始尝试把 AI 视频融进流程的团队来说,这次看到的不只是惊艳,还有一种“再不跟上又要追版本”的辛酸。

顺便说一句,以上所有这些功能,目前都聚合在即梦的同一套入口下,操作门槛一如既往地低。我试的时候全程没用任何专业术语,就是日常大白话描述加随手拖图,输出质量却像已经迭代了好几轮的效果。这种“抹平专业审美差距”的能力,越是外行越能感受到它的锋利。

当然,现阶段它依然不是万能钥匙。30 秒的片子里偶尔还会出现逻辑跳跃,白模渲染对提示词和参考图的配合度要求不低,局部编辑也还没有做到百分百可控。但问题是,这次它迈出的这几步,恰好都踩在了游戏内容生产最耗人耗钱的节点上。以前我们说“AI 替代手搓”还像句玩笑,现在看看自己硬盘里还没渲染完的白模序列,再想想 2.5 生成一段完整视频的功夫,笑不笑得出来就真的因人而异了。