同样一句提示词,有人生成的AI舞蹈视频能刷屏,有人做出来的却像PPT翻页。差别到底在哪?宝玉在Manus视频合集的最后一条里,拆解了一套AI舞蹈视频的完整制作流程,答案可能和你想的不太一样。

一条视频背后的三段流水线

这套方案的核心是多模型协作。策划和代码编写交给大模型(Opus/Sonnet)完成,角色动画生成由Seedance负责,最后一步是把代码生成的视觉特效叠加上去,对齐节拍完成合成。

也就是说,一条看起来流畅的AI舞蹈视频,背后至少跑通了三个环节:想清楚要什么、让角色动起来、把节奏游戏风格的视觉特效贴上去。任何一环掉链子,成片都会露怯。

提示词只是方向标

很多人把精力全押在打磨提示词上,但宝玉的结论是:提示词仅决定方向,成片质量高度依赖素材选择、工具链组合以及后续的迭代过程。

这句话值得反复读。方向对了,不代表结果就好。素材本身的质量、工具之间能不能接得上、愿不愿意反复调,才是拉开差距的地方。

换句话说,提示词是起点,不是终点。把提示词当成万能钥匙,大概率会失望。

这套流程能复用到哪

从这条推文透露的信息看,这套组合拳的适用范围不止舞蹈视频:

  • 需要角色动画的场景,可以交给Seedance生成
  • 需要节奏感、特效叠加的部分,用代码来补
  • 策划和代码编写,交给大模型分担

真正决定成片上限的,是你能不能把这几段拼成一条顺畅的流水线,并且在每一段都舍得花时间迭代。