8月24日,阿里巴巴的视频生成大模型Wan3.0正式上线。这次更新最直观的变化在数字上:单次生成时长从10秒拉长到30秒,输入格式也不再局限于文字和图片,doc、xls、ppt、pdf、md等多种文档都能直接作为生成素材。

公测期间,不少创作者和企业用户给出了“最惊喜的一次”的评价。反复被提到的三个关键词是:稳定、真实、有质感。这三个词放在AI视频赛道里,恰好对应着长期没被解决的痛点。

打开网易新闻 查看精彩图片

角色一致性:告别“抽卡”式调试

用过AI视频工具的人大多经历过这种崩溃:人物脸型在第三秒就变了,道具位置对不上,画面风格前后割裂。Wan3.0在长时序叙事中重点解决了这个问题——人物、车辆、环境在30秒内能保持高度一致,避免了频繁“抽卡”和反复调试。对追求生产力的企业用户来说,这意味着更高的效率和更低的返工成本。

真实感:去掉“油腻感”

AI视频常被诟病的“油腻感”和千篇一律,在Wan3.0上有了明显改善。模型对真实世界的物理属性做了针对性还原,包括眼球反射、毛发细节、水面光泽等容易被忽略的微观特征。五官和皮肤细节的刻画更敏锐,人物情绪表达更自然,微表情和肢体动作的协调性也更好,最终呈现出“千人千面”的效果。

镜头美学:风格化融合能力

除了技术参数,Wan3.0在视觉表达上也有自己的思路。它注重色彩的和谐搭配,同时保持画面信息的流畅传递。模型能够理解并融合风格化参考图,快速适配设定的视觉风格,营造出具有纵深感的舞台剧效果。这种能力让它在广告、短剧等对画面质感有要求的场景中更容易落地。

商业化进展:已进入生产流程

公测期间,Wan3.0已经不只是实验室里的演示品。它开始进入企业的实际生产流程,在短剧、影视、广告、文旅等领域参与规模化出片。行业评价认为,Wan3.0的核心价值不在于单帧画面的视觉冲击力,而在于稳定、连续、可落地的内容生产能力——这恰好是AI视频从“能看”走向“能用”的关键一步。

从10秒到30秒,从单一输入到多格式支持,从“AI感明显”到“真人质感稳定输出”,Wan3.0补上了AI视频长期缺失的一环。对于正在寻找高效视频生产工具的团队来说,这次更新值得实际测一测。