盯着屏幕看几秒:提示词一变,巫师手里那条龙,成了一片叶子。这不是剪辑,是模型在生成过程中实时改写了画面。

这段演示来自 PixVerse R2,官方给它挂的标签是 #PixVerseWorldModel。演示里没有解释技术细节,只给了一个动作——改提示词,画面里的物体跟着换。龙和叶子之间没有过渡动画,是直接替换。

打开网易新闻 查看精彩图片

提示词成了剧情遥控器

真正被推到台前的是另一个东西:Zero Mark。官方对它的定义是"互动电影式冒险",由 PixVerse R2 驱动。玩家要做的事很具体——用提示词去引导故事,故事会随着你的输入往下走。

官方给出的说法是"接下来这个魔法世界会发生什么,由你决定"。这句话把传统视频生成的使用方式翻了个面:以前是你写一段提示词,等模型吐出一段固定视频;现在是你一边看,一边改提示词,画面跟着改。

演示里那个龙变叶子的瞬间,就是这套逻辑最直观的样子。提示词是输入,画面是输出,中间没有暂停键。

互动叙事换了一种驱动方式

互动叙事不是新概念。游戏里的分支剧情、互动剧里的选项按钮,都是让观众参与故事走向的老办法。Zero Mark 的差别在于驱动方式:不是点选项,是写提示词。

选项是有限的,提示词是开放的。官方演示里没有展示提示词的边界在哪里,也没有说明哪些输入会被接受、哪些会被拒绝。能确认的只有一件事:提示词在这套系统里不是生成前的准备工作,而是叙事过程本身的一部分。

这也解释了为什么演示要强调"随着提示词变化"这个动作。它想让人看到的不是某个画面有多精致,而是画面可以被持续改写。

打开网易新闻 查看精彩图片

世界模型这个词被摆上了台面

官方给这段演示配的标签是 #PixVerseWorldModel,"世界模型"这个说法被直接写进了传播物料里。这个词在行业里通常指向一类能力:模型不只是生成一段画面,而是维持一个可以持续交互、前后一致的环境。

Zero Mark 被描述成一个"魔法世界",玩家用提示词在里面推进故事。这个设定和世界模型的思路是对得上的——故事要能往下走,画面就得在多次改写之间保持连贯。

不过演示只给了一个镜头、一次变化。龙变叶子之后会发生什么,官方没有展示。世界模型这个标签目前承载的,更多是一个方向,而不是一份已经摊开的能力清单。

观众的位置被重新定义了

传统视频生成里,观众是接收端。你输入提示词,等待结果,然后观看。Zero Mark 想做的事是把观众挪到驾驶位上——故事 unfold 的过程中,你随时可以插手。

官方那句"接下来会发生什么,由你决定",说的就是这个位置变化。它没有承诺故事有多长、分支有多复杂,只承诺了一件事:你的提示词会起作用。

演示里那条龙变成叶子的瞬间,就是这句话的视觉证据。至于这个证据能撑起多大的故事,得等真正上手才知道。