世界模型赛道再升温,智象未来发布交互式世界模型

打开网易新闻 查看精彩图片

AI视频生成领域的竞争,正在从生成一段画面升级到生成一个能交互的世界。8月18日,智象未来发布交互式世界模型HiDream-O1-World,让模型不仅能生成视频,还能理解并回应交互。同一天,AI视频生成平台Higgsfield宣布从高盛、英特尔等处融资4亿美元,估值达54亿美元。世界模型这个前沿赛道,正在成为资本和技术的下一个焦点。

世界模型到底在解决什么

传统视频生成模型只能播放,世界模型强调理解。HiDream-O1-World这类交互式世界模型,目标是让AI理解物理世界的运行规则,包括物体的持久性、因果关系和空间关系,从而生成可交互、可预测的连贯画面。这对自动驾驶、具身智能、游戏引擎和影视制作都有直接价值:机器不再是复制画面,而是理解场景。

打开网易新闻 查看精彩图片

资本为何重新押注视频生成

Higgsfield拿下4亿美元、估值54亿,高盛和英特尔进场,说明视频生成和世界模型的商业潜力被重新定价。这笔钱的意义不在于金额,而在于投资方的结构:既有金融资本,也有芯片厂商。英特尔押注,看中的是世界模型对算力的持续拉动;高盛进场,看中的是AI视频在营销、广告、短剧等内容产业里的变现空间。

世界模型的落地路径也在清晰化。短期看内容创作,中期看游戏和影视的实时生成,长期看具身智能和自动驾驶的世界理解。每一个方向都是千亿级的市场,这正是资本愿意提前下注的原因。

国产世界模型的机会窗口

智象未来选择在此时发布交互式世界模型,踩在了一个微妙的时间点。全球范围,世界模型仍处于早期,没有绝对领先者。国产模型厂商在视频生成上已经积累了一批技术储备和人才,加上国内短剧、电商、广告对AI视频的旺盛需求,让世界模型有真实的应用土壤。从能生成到能理解,国产厂商能否在这个窗口里跑出来,值得持续关注。

值得一提的是,这场竞赛的胜负手不在模型参数,而在数据与场景。世界模型要理解物理规律,就需要大量真实世界的视频数据做训练,而国内在短视频、直播、自动驾驶路测等场景里沉淀的数据量级,恰恰是得天独厚的优势。谁能先把这些数据变成可交互的世界模型能力,谁就能在下一个阶段的具身智能和自动驾驶里占据先手。对普通用户而言,这一天也许比想象中更近,当短视频里的角色开始记住你的选择、按你的操作改变剧情,世界模型就已经悄悄走进了日常。

当AI开始理解物理世界,你会最先在哪个场景感受到变化?是自动驾驶、游戏还是影视,欢迎评论区聊聊你的判断。

【信源】极新 | 枢途、微灵完成融资,智象未来发布HiDream-O1-World | 2026-08-18