Seedance 2.5正式推出之后我写过好几篇,这个模型最能打的能力之一,是它能拿视频当参考素材——尤其对白模的参考,这一代提升得很明显。
上周刷到影视飓风那条《太卷了!改变视频行业的AI又迭代了什么?》,里面有一段是拿一条3D预演素材去生成的:泰坦尼克号那样的甲板,光头男人扶着栏杆,女人站在他身后,右下角画中画放着原始的3D素材,人物的站位和手扶栏杆的姿势一模一样。
这个一模一样的构图真有点震到我了。
于是我自己也试了试。下面这条上下同框,上面那条灰白的是我先做出来的白模——一块悬空的水泥板、几根护栏、一个蓝色人形;下面是把它丢给Seedance 2.5生成的成片,赛博朋克雨夜天台。
你可以盯着人和镜头看:他什么时候走到护栏边、镜头什么时候从他背后绕到侧面、最后一段从多高俯下来,上下两条严丝合缝。这些全是我事先在3D场景里排好的,不是模型自己想的。
白模视频我是用AI视频平台updream做的,它这两天上了个新功能叫预演台:传一张场景图,它自动重建出一个3D白模场景,你在里面摆人物、调机位、排走位,把镜头设计好之后录一段视频,再丢给Seedance 2.5渲染成片。不用会建模,也不用写代码。
这几天我拿它完整跑了一遍,从一张图到成片,做了组对照实验,也把它推到了我目前能想到的难度上限:15秒、四个机位、中间还要求镜头做升降。这篇讲讲整个过程和它每一步怎么用。
一、抽卡抽的到底是什么,白模又从哪来
这个月初我写Seedance 2.5那篇的时候,夜里跑的几条片子全部一次过,零重抽。你可能会问,那还折腾什么白模,直接写提示词不就完了。
这两件事其实说的是两个东西。一次过,指的是模型能不能出可用的画面,画质、物理、人物一致性这些,它确实没什么可挑的。抽卡抽的是另一件事:它出的东西,和你脑子里那个镜头能对上几成。
就拿我这次要拍的一个镜头举例,我想要镜头从水晶吊灯的高度往下降,一边降一边往前穿过大厅,人物在画面中央慢慢变大。写成提示词交出去,模型很可能还你一条金碧辉煌、人物自然的片子,但镜头是平推的,高度一点没变。这条片子质量完全达标,作为你的分镜完全废掉。质量达标和意图达标是两回事,提示词能保住前者,很难锁住后者。
这两件事在剧组里本来就是两个人在管。导演决定这个镜头从哪儿起、往哪儿走、什么时候切到下一个;摄影师负责把它拍出来,拍得好看。你写一句提示词丢出去,其实是把这两个活儿一起外包了——你给 的是「金碧辉煌的大厅,一个男人走向楼梯」,剩下的机位摆哪、镜头多高、什么时候切,全是模型替你定的。它定得其实不差,Seedance 2.5这一代的构图审美挺能打的,只是那成了它的机位,不是你的
原因也很简单,你脑子里的镜头是具体的空间关系,交到模型手上要过两道翻译:先压缩成文字,再由模型把文字展开成画面。每道都在丢信息,而且第二道你完全插不上手。
学界早有结论:给模型一个看得见的空间条件,可控性立刻上一个台阶。ControlNet那篇论文的出发点就是这个,今年CHI 2026还有篇PrevizWhiz,讲的就是用粗糙3D场景引导视频预演。白模就是那个空间锚点,Seedance 2.5这一代把它做成了官方能力,还配了套白模提示词规范。
问题只剩白模从哪来。在预演台之前有三条路:学Blender,影视工业的正路,代价是几个月起步的学习成本;ComfyUI加ControlNet搭工作流,门槛不比学代码低多少;让AI写代码,这是我自己一直在用的,让Claude Code写Three.js拼几何体、写运镜函数、渲成白模视频,前几天我还用这条路做过一个巴黎街头追车的六镜头白模——它对我成立是因为我有顺手的coding agent,但调一版运镜要改参数重渲,来回也挺折腾。
预演台给的是第四条路:传一张图,等几分钟。
二、宴会厅:把预演台完整用一遍
我拿一个宴会厅的镜头来讲整个流程,它是我这轮做得最完整的一条,后面第四节会给它的成片数据。
第一步:一张图变成一个3D场景
updream的主界面是个无限画布,预演台只是画布上的一种节点。入口有两个:空白处右键选「新建预演台」;或者你已经有一张场景图,右键那张图片节点选「创建预演台并连线」,一步到位。
参考图我是在同一个画布上生的,Seedream 5.0 Pro,25秒出图,画的是一座空无一人的宴会大厅——水晶吊灯垂在中央,双层拱廊环绕,尽头是铺红毯的大理石旋转楼梯。
进了预演台点「创建场景」,选一张主参考图(也能现场传,最多三张)。
然后是六步的建模进度:提交任务、分析参考图、搭建场景、检查并优化、修正细节、生成最终版本。官方标的是4到7分钟,我这轮三个场景实际花了4到12分钟,复杂的明显更久,这个过程关掉页面不会中断。
宴会厅出来是112个部件。柱子是柱子,拱廊是拱廊,楼梯是楼梯,每一个都是能单独选中的独立物体(默认锁着,防你误拖)。空间层次、纵深、遮挡关系跟参考图基本对得上。
不会建模的人第一次拿到一个能直接用的三维场景,这个体验确实挺妙的。
第二步:认识这个片场
进去之后界面分三块,理解了这三块就基本会用了。右侧图层区等于片场里有什么,场景模型、人物、机位、灯光都在这儿,点谁右边就出谁的属性。底部时间轴等于排戏,每个对象一条轨道,轨道上是路径片段和一排菱形关键帧。右上角那个小窗是机位监视器,显示当前选中机位的画面,也就是你最后会录下来的东西。
监视器顶上那排开关有一个要特别注意:「人物名牌」务必关掉,它会把人物头顶那个「人物1」的黑色标签烧进录制画面,每一帧都有,对后面的生成是纯干扰。
第三步:放个人,让他真的走起来
左栏点「新建人物」,人就出生在场景中心。属性面板里体型、身高、辨识颜色都能调,重点是「基础姿势」那个下拉,里面有自然站立、行走、跑步、坐姿、蹲下这些预设。
要走路的人必须把基础姿势改成「行走」,否则他是站着的姿势在地上平移,看着像滑行。白模的全部作用是给模型一个运动控制信号,一个站着不动的人形等于什么都没给。
走位的画法是:图层面板里选中人物(视口里点容易点到机位的取景框),点左栏的「绘制轨迹」,在地面上按住拖一笔,松手之后时间轴上自动出现轨道、路径片段和关键帧。透视视角下点地面容易误选到屋顶和柱子,先切顶视图、再把显示模式从「实体」改成「半透」,就没这问题了。
第四步:摆机位,以及让镜头升降
机位的建法有个很顺手的设计:先用鼠标把视口调到你想要的构图,再点「从当前视角创建机位」,机位就照着这个构图生成了。参数是真实相机的语言,摄影机型号、镜头系列、焦距、光圈,宴会厅第一个机位我用的24mm全画幅。
机位属性里有个「看向」,选一个人物,相机的角度会自动算好对准他。但它不是持续锁定,是一次性对准——把你点的那一瞬间的角度写死,相机沿轨迹移动的时候朝向并不跟着人转。我第一轮就理解错了,结果相机走到弧线另一端,人早就偏出光轴了。
正确的做法是用关键帧。时间轴上每条「空间轨迹」行中间有个◇按钮,在播放头位置插入一个轨迹点,点中任意一个菱形,右侧就出「轨迹点」面板:位置XYZ、水平角、俯仰角、横滚角、单点看向,两点之间自动插值。
这个面板是整个预演台里最有用的东西。逐个航点设「看向」,相机才会全程锁定主体;更关键的是,只有关键帧建的路径尊重高度——用「绘制轨迹」画出来的机位路径是贴着地面走的,机位属性里那个Y值只在机位静止时生效。所以crane down、crane up这类升降运镜,画是画不出来的,必须用关键帧。宴会厅第二段从吊灯高度往下降穿过大厅,Y从9米降到1.8米;第四段反过来,从1.5米升到7.5米。
第五步:四个机位=四个镜头
宴会厅这条15秒的片子里有四个机位和一个人物。人物的路径片段是0到450帧(全程走),四个机位的路径片段在时间轴上一段接一段排开:0-120、120-255、255-360、360-450,帧数是30fps算的,450帧就是15秒。
这个排法就是这条片子的分镜:
时间
机位
运镜
0-4秒
机位1
吊灯高度横移,俯瞰整个空厅,人在画面下方很小
4-8.5秒
机位2
从吊灯高度下降,同时向前穿过大厅
8.5-12秒
机位3
齐眼高度跟随,平视跟着人走向楼梯口
12-15秒
机位4
升起并后拉,停在楼梯口上方
第六步:录制,然后交给Seedance
顶栏「录制」里有两个选项,全局录制是导演视角,当前轨道录制是当前监视器里那个机位的画面,要用的是后者。录制不花积分,15秒导出大概一分钟,录完自动回到画布上变成一个视频节点,1920×1080、30fps、整整450帧。
最后一步是生成成片。右键添加视频节点,从它左边的⊕拖到源节点身上建立引用,白模录制和场景参考图各连一条。模式选「全能参考」,模型Seedance 2.5,时长在底栏那个「16:9 / 15S / 720P」里改。
提示词有一条我认为是这套流程里最关键的经验:必须写清楚两个素材各自负责什么。我的写法是这样开头的:
素材职责:白模视频只提供四段机位的切换时刻、机位的高度变化、镜头的推进与后拉、人物横穿大厅走向楼梯的路线与速度;它的灰白几何体与蓝色人形不保留。图片2定义全部美术——水晶吊灯、双层拱廊、大理石旋转楼梯、红毯、金色装饰与暖光。
不写这段,模型会把白模那身灰白配色也当成一种风格继承过去。后面还有按时间轴逐段写的镜头说明,和一段「保持一致」的约束(同一个人、切点严格对齐、用硬切不要转场)。
这条15秒720P的成片扣了3,525积分,是整条流水线上唯一真正花钱的一步。
三、对照实验:白模到底锁住了什么
上面那套流程走下来,一条片子的成本是一张参考图加十几分钟。它到底买到了什么,我在最开始用一个4秒的小实验测过。
场景是黄昏的美术馆长廊,混凝土方柱、落地窗斜阳,一个人沿着柱廊纵深奔跑,镜头在侧面平行跟拍。我先在预演台里把这个镜头排出来录成白模,挂上参考图去生成。
两条并排逐帧看,人物出现的位置、他穿过哪根柱子、镜头推进的速度全部对得上。最让我意外的是一个细节:白模里人物在3秒半左右跑出画面,成片里他也在3秒半跑出画面,只剩一条空柱廊和斜阳。连人什么时候离开画面这种时序信息都被白模锁死了。
对照组是这么设的:同一张参考图、同一段提示词,只把白模那个引用摘掉,其余一个字没改。出来的片子质感同样在线(黄昏、柱廊、奔跑都有,光影甚至更华丽),但镜头是模型自己的主意——机位贴得很近,人物大半身特写,从头到尾在画面里跑着。我要的那个远景纵深里穿柱奔跑,还有人在3秒半出画,一样都没有。
两条都是质量达标的片子,只有一条是意图达标的,差别就是那一个引用。参考图和提示词管的是这里有什么、什么风格,白模管的是人和镜头在空间里怎么动。后者你写多少字都写不准,挂一段白模上去就解决了。
白模买到的东西,说到底是确定性:你在预演台里排的那场戏,到成片里还是那场戏。
四、再往难里推:同场景,多机位
4秒单机位只是下限测试。在同一个场景内用多个机位拍摄主体运动的视频我做了三条,开头那条赛博雨夜是其中之一,另外两条在这儿,方向和它都不一样。
宴会大厅,就是第二节全程讲的那条。
这条是三条里对得最齐的。四段镜头之间有三个切换点,我拿白模和成片逐个比了一遍,最大的一处差了不到一帧——你按暂停一格一格看,都很难挑出毛病。第二段那个一边下降一边往前穿过,还有第四段的升起后拉,也都老老实实做出来了,这两下是我最没把握的,「镜头一边降一边往前」这种话写在提示词里,模型多半会理解成平推。
地下神殿,一座圆形下沉竞技场,穹顶破口射下一道光柱,人从光柱中心走向外侧柱廊。四段分别是高处俯瞰、正面后退跟拍、贴地环绕、柱廊远景。
回头再看开头那条赛博雨夜。
三条都是一发出片,没有为质量重抽过。返工都发生在白模那一侧,而白模录制不花积分,重录的成本只有时间。
五、什么时候值得开预演台
按我这几天的体验给个实操建议。
值得开的:镜头和人物有相对运动关系的(跟拍、环绕、穿过);有明确空间调度的(人物走特定路线、在特定时刻到达特定位置);需要升降的运镜;一条片子里要切多个机位、且机位之间的空间关系必须成立的。这类镜头的共同点是空间关系就是内容本身,文字怎么写都在丢信息。
不用开的:单镜头的简单动作,一个人说话、产品特写旋转这类,文字提示词加一张参考图就够了,开预演台反而多花十几分钟。
还有一类我建议你别用它:光影本身就是全部内容的镜头。剪影横移、光线扫过这种,视频模型本来就做得很好,给它一个白模等于多此一举。
六、最后说一句
其实4月updream刚内测的时候我就写过它,当时我还许愿说,希望它以后能把我上传过的视频、我的口播风格自动导入分析。
四个月后它给我的是白模控镜,和我当时许的愿完全是两个方向。说实话第一反应是有点落差的。但把这次实测跑完,我倾向于认为它选的这个方向可能更对——更懂我是个无底洞,先让创作者对镜头说了算,是个能一步步兑现的工程问题。
回到影视飓风那句「这个运镜和原素材完全一样」。那句话真正的意思是,镜头这件事从今往后可以不用赌了。我这种没学过Blender的人,用一张图和二十分钟,就能排出一个四机位、带升降、切点误差在一帧以内的15秒镜头,然后让模型照着拍。
对了,updream正在搞一个「白模创作千万积分挑战赛」的活动,用预演台做白模创作可以参与瓜分积分,规则在他们官网和官方号能找到,赶上这波的话,实测成本还能再降一截。
预演台入口:updream.cn,画布里右键就能新建。
热门跟贴