阿里云旗下视频生成模型Wan3.0正式上线Magnific平台。用户输入文本、图片或网页内容,即可在30秒内生成一段电影质感的视频片段。
这一消息由阿里云官方账号于8月24日通过社交媒体发布,并同步放出了Model Studio与Qwen Cloud两个API接入入口,方便开发者和企业用户调用模型能力。
多模态输入,一条视频30秒出片
从官方公布的信息来看,Wan3.0的核心卖点在于输入方式的多样性。与常见的文生视频模型不同,它支持三种输入形态:
- 文本输入:直接描述画面内容,模型自动生成对应视频
- 图片输入:上传静态图片,模型将其动态化,生成连贯镜头
- 网页内容输入:输入网页链接或页面内容,模型据此生成视频
输出端则统一为30秒的“电影级”视频。这一时长设定在同类生成模型中属于中等偏上,既能承载完整的叙事片段,又不至于因生成时间过长而影响使用体验。
双API通道同步开放
阿里云此次为Wan3.0提供了两条接入路径。一条是Model Studio,另一条是Qwen Cloud。两条通道均面向开发者开放,意味着无论是个人开发者还是企业团队,都可以将Wan3.0的视频生成能力集成到自己的应用或工作流中。
从产品定位来看,Wan3.0瞄准的显然不只是短视频创作者。网页内容转视频的能力,让它在营销素材制作、产品演示、内容摘要等场景中有了更实际的用武之地——输入一个产品页面,就能得到一段动态展示视频,这比传统的图文转视频工具在信息密度和画面质感上都要高出一截。
视频生成赛道竞争加剧
Wan3.0上线Magnific,是阿里云在AI视频生成领域的一次重要落子。当前,视频生成模型赛道已经聚集了多家头部玩家,各家在输入方式、生成时长、画质表现上各有侧重。阿里云选择以“多模态输入+30秒成片”作为差异化切入点,试图在工具链的易用性上建立优势。
对于普通用户来说,这类工具的普及意味着视频创作的门槛正在被进一步拉低。过去需要团队协作、专业设备才能完成的视频制作,现在通过一个模型接口就能实现。而对于开发者而言,双API通道的开放也降低了集成成本,让视频生成能力更容易嵌入到现有产品中。
目前,Wan3.0的具体生成效果、支持的语言种类、计费方式等细节尚未完全公开,实际表现还有待开发者上手验证。但可以确定的是,多模态输入正在成为视频生成模型的新方向,而阿里云已经在这一方向上率先亮出了自己的牌。
热门跟贴