一条7分56秒的动画,全部由Wan 3.0生成。发布者くりえみ在帖子里说得很直接:因为整条片子都用Wan 3.0做,成本被压住了。
这条动画原本是准备放进机器人嘉年华活动的作品,作者自己觉得不满意,最后没采用,发出来算是"供養"——把废稿放出来透口气。但恰恰是这条没被选中的片子,把制作方式讲清楚了。
打开网易新闻 查看精彩图片
声音是两段拼的
画面之外,声音的处理也拆成了两部分:像的部分直接沿用,不对劲的部分再叠上IrodoriTTS重新配音。也就是说,一条完整动画里,语音并不是一次性生成的,而是先判断哪里能用、哪里不能用,再对问题段落做二次处理。
这种做法谈不上优雅,但很实用。它把"全流程AI生成"拆成了"AI生成+人工判断+局部重做"的组合,成本控制的关键也在这里。
成本是怎么省下来的
- 画面:全部由Wan 3.0生成,没有走传统动画制作流程
- 声音:相似部分直接保留,异常部分用IrodoriTTS覆盖
- 整体:作者明确表示,正因为全片用Wan 3.0,成本才被压住
从"没采用也愿意发出来"这个动作看,这条片子的制作门槛并不高——高到需要反复权衡投入产出,才会让一条废稿显得可惜。
废稿反而说明了问题
一条被作者自己否掉的动画,仍然有7分56秒的完整时长,仍然配了音,仍然能拿出来公开发布。这本身就说明,用Wan 3.0做一条这个体量的动画,已经不再是需要下很大决心的事。
帖子发出后拿到435次浏览,数字不算大。但作者在开头写的那句"interesting idea",以及把没采用的片子拿出来分享的选择,比浏览量更能说明他对这套流程的态度。
热门跟贴