2026年9月8日,智象未来(HiDream.ai)旗下内容创作智能体vivago R1全球上线,国内版本「够搭」全新升级发布。
今年7月,vivago R1 于 WAIC 2026 首次亮相。作为全球首个无限时长内容创作智能体,R1 引起 AI 视频领域广泛关注。今天,R1正式面向全球用户开放。
vivago R1 的核心突破,在于实现了从一句成片时代的 “生成片段” 到 “完全交付作品” 的范式跃迁。它依托智象“基础模型 + 智能体”双轮驱动技术战略,让创作者以自然语言对话的方式,即可完成从创意表达到高质量成片交付的完整创作流程。
R1的上线,标志着AI视频创作进入“单反级交付时代”。每一位普通创作者,都能独立完成专业团队级的品质大片。
01 从Sora的15秒,到R1的五分钟
Sora 用15秒视频惊艳世界,成为 AI 视频生成的重要转折点。但时至今日,15-30秒的片段式生成依然是行业主流。R1 的突破在于,能够一次性稳定输出5分钟高质量视频,并支持无限次多轮延长。
长视频的难点,不只是把时长拉长,而是让故事在多镜头、多角色、多场景之间持续成立。R1 通过 Agent 系统对长任务进行规划与调度:主 Agent 拆解创意,子 Agent 协同完成脚本、分镜、角色、场景与音效,确保角色形象、场景风格和叙事节奏在多段落中保持一致。
同时,依托智象自研 HD-AgentOS 的全流程调度与治理能力,R1 内容有效可用成功率提升至85%,显著降低“抽卡”概率,让视频创作更具确定性。R1 还优化了跨镜头角色一致性和场景过渡自然度,弱化 AI 视频常见的“塑料感”和“瞬移感”,实现更自然的运镜衔接与音画对齐,让长视频更接近实拍质感。
02 Chat-First (对话优先):让创作回到表达本身
好的创作工具,应当顺应人的表达本能。对于视频创作而言,起点不应是节点、画布和参数,而应是创作者想要表达的内容。
R1因此选择 Chat-First (对话优先)路线。因为对话是人类最自然的表达方式,也是 AI 最友好的创作入口。
当前 AI 视频工具大致有两条路线:一类是画布式、节点式工作流,将模型、工具和参数交给用户自行连接和调试,自由度高,但门槛也高;另一类是 R1 的对话式路线,用户只需用自然语言描述需求,R1 即可自动生成视频,并支持在对话中持续调整和迭代。
这种体验背后,是“做后”与“做厚”两条原则。“做后”,是把专业创作者的判断、审美和经验编码进 Agent 编排能力,形成强大的中后台;“做厚”,是构建 SkillHub,将抽象 AI 能力转译为产品广告、角色视频、故事短片、品牌内容等真实创作场景,让用户更容易理解能做什么、如何开始。
在完整流程中,用户只需表达目标,Agent 负责拆解和执行,SkillHub 则作为翻译层,自动匹配并编排所需 Skill 组合,将用户意图转化为可执行任务序列。
R1 的对话式创作,不是把复杂消灭,而是把复杂藏在简单背后。它让创作从“灵感闪现”到“进入执行”,缩短到只剩一句话。
03 原生全模态基础架构,让 AI创作走向项目制
视频生成的另一大挑战,是一致性:同一个角色、同一种声音,如何在数十个镜头、多次生成转换中始终如一。智象未来的解法,是以基础模型与智能体系统双轮驱动,共同支撑复杂视频创作。
一方面,智象自研的原生全模态世界模型技术理念,为 R1 提供多模态理解与生成基础能力。它能将文本、图片、视频、参考资产、文档说明和历史创作结果纳入同一任务语境,让 Agent 理解“任务全貌”,而非单点指令。
另一方面,智能体系统负责将模型能力组织为可持续推进的创作流程,在脚本、分镜、角色、场景、镜头和音效之间进行规划与调度,确保复杂叙事中的角色形象、声音特征和风格前后一致。
这让创作不再是一次次孤立生成,而是围绕同一项目持续推进。用户可以“说不清的直接给”,R1 则在统一上下文中理解、组织、执行并持续迭代。
同时,R1 推出资产库功能,沉淀用户生成、筛选并认可的内容,并可在后续创作中复用。一次创作不再只是一次性输出,而会成为下一次创作的素材基础。
基础模型决定能力上限,智能体系统负责把能力转化为稳定、可控、可复用的作品交付。
04 全球创作者用作品说话:R1 让表达成为生产力
在今天举办的vivago R1「够搭」沉浸式工作坊活动上,来自全球不同领域的创作者们,采用线上和线下的方式,分享R1的使用心得,并展示他们制作的作品。
近期,AI 版《西游记》上线后引发热议。活动现场,一位创作者也用 R1 尝试了这一经典题材的再创作,并生成近 5 分钟西游题材作品。从角色造型、场景氛围到东方奇幻质感,R1 对经典文本的视觉转译能力得到直观呈现。
在真人质感上,R1 同样表现出色。另一位创作者带来一支励志短片,讲述体育老师周岚从迟疑到重新出发的过程。画面中,奔跑时的肌肉震颤、汗水光泽,以及脚步压过塑胶跑道的颗粒质感都被细腻还原,让人物情绪更具真实感。
提示词:
体育老师周岚在训练与接力比赛中面对自己的迟疑。来到第二道弯,她一度想停下,却继续迈步,坚持跑向终点。次日清晨,她主动再次接过接力棒。影片将人物转变放进呼吸、步伐与交接棒等具体动作,以持续奔跑呈现重新出发的过程。
提交提示词后,R1 会自动理解人物关系、情绪转折与动作节奏,生成对应角色、场景与关键画面。创作者无需复杂操作,只需通过对话补充想法,即可推进内容生成。
在商业广告片制作上,R1 也展现出较强适配能力。现场一位 AI 创作者分享了红色折叠手机广告案例。R1 根据提示词理解产品、人物与场景关系,生成手机多视图、女设计师造型、工作室与户外生活场景,以及包袋、色卡、草图等视觉资产,呈现从创作、出行到回归设计的日常灵感流动。
提示词:
一位年轻女设计师在一天中穿梭工作室、城市街道、咖啡馆和海边,用红色折叠手机记录色彩、构图与生活中的灵感,再将所见带回工作台。影片围绕手机开合、拍照和查看素材的使用动作,串联从创作到出行、再回到设计的日常。
现场之外,多位海外创作者也通过线上连线分享创作体验。一位创作者表示:“视频创作的终点,就是一次表达。”这也道出了许多体验 R1 用户的共同感受:当复杂流程被隐藏在对话之后,创作者可以更专注于表达本身。
05 开创视频Agent新标准:CHATS
R1的实践充分表明,当产品真正进入专业场景,行业需要的就不再是零散的能力清单,而是一套可衡量、可依赖的交付标准。智象提炼出一套面向视频 Agent 的评估框架——CHATS,用于衡量一个视频 Agent 是否具备真正的作品交付能力:
C(Consistency)一致性:角色、场景、风格在多镜头中保持稳定;
H(Human Intent)意图理解:准确理解用户创意,并能在多轮对话中持续推进;
A(Audio & Visual)视听完整度:不仅生成画面,也能组织声音、节奏与整体视听体验;
T(Timeline & Tale)时间线与叙事:让故事在多个镜头、多个段落中持续成立;
S(Stability)稳定交付:降低反复生成和返工成本,提高内容可用率。
这五个维度,不是实验室里的理想指标,而是 R1 在真实创作内测场景中被众多内测用户反复验证过的能力边界。智象希望通过构建一个用户视角的标准,推动AI Agent产品的更好发展。
2024年5月,vivago.ai 上线,成为全球最早一批公开可用的 AI 视频生成产品;今年5月,vivago.ai登顶Product Hunt日榜第一;今天,vivago.ai全球用户突破7000万。两年时间,智象从“第一个可用”走到第一个“单反级交付”。
这就是 vivago R1 中 “R” 所承载的意义:一面是 Reasoning,用深度推理把灵感变成作品;一面是 Rock,致敬 “The Show Must Go On” 的创作精神——无论如何,创作终将继续。
在AI视频时代,vivago R1 希望让创作从一次生成,变成持续对话:The CHATS must go on。只要对话继续,故事就不会停下。
立即体验
vivago.ai
够搭 goudaai.com
够搭,你的 AI 创意好搭子。
热门跟贴