来源:猎云精选,文/王非
2025年春天,AI行业迎来了“DeepSeek时刻”。到了2026年夏天,“时刻”正在变成“节奏”——7月31日,国产大模型一场罕见地集体亮相,注定被人铭记。
稍早前的7月16日,月之暗面发布了Kimi K3,并于7月27日放出完整权重。Kimi K3完整权重开放后的第四天,也就是7月31日,其他几家厂商的新产品集中登场:
上午09:04,MiniMax正式发布新款通用全模态生成模型H3;中午13:43,字节跳动发布新一代视频创作模型Seedance 2.5;下午14:56,DeepSeek正式上线DeepSeek-V4-Flash-0731 API公测;与此同时,智谱的GLM Coding Plan也在7月31日当天,恢复订阅并推出团队版。
这不是一次计划好的“联合发布”。四条不同的AI战线——开放权重、视频生成、Agent能力与订阅商业化——在算力受限的现实里同时向前推进。它们从不同的时间节点出发,在7月31日这一天站到了一起。
而这也标志着,国产大模型的竞争已经越过单点跑分阶段,模型、应用、渠道、价格和开放生态开始以产品矩阵的方式协同出击,一场“交付竞赛”的大幕正在开启。
MiniMax、字节同日上新,快手还会远吗
“去年是DS(DeepSeek),今年是SD(Seedance 2.0)……”这是对于2025年、2026年春节前夕,两款国产人工智能大模型火爆的形象概括。
随着Seedance 2.0突然爆火,其竞品快手可灵3.0也借势出圈,两者共同掀起了一场关于“AI导演革命”的全民创作浪潮。AI视频竞争已从“单帧画质”升级为“工作流整合”,掌握多模态调度能力者将定义下一代创作标准。
从2025年5月的1.0版本,到2025年12月的1.5 Pro版本、2026年2月的2.0版本,字节跳动旗下Seedance的更新时间均不超过半年。
如今,距离Seedance 2.0在春节爆火恰好小半年。于是在2026年7月31日,Seedance 2.5正式发布:可单次生成30秒视频片段,并支持多轮延长;支持用户单次输入最多30张图片、10段视频、10段音频作为参考素材;支持精准的时间戳控制,可定向编辑视频内容。
当前,Seedance 2.5正在陆续上线即梦AI、豆包专业版等平台,API服务也将在近期上线火山方舟。官方同步宣布,徐工集团、小鹏汽车、智元机器人、灵初智能、微分智飞、穹彻智能、Xspark AI(无界智航)等多家企业已与火山引擎达成合作意向,将率先接入Seedance 2.5。
与春节期间,字节跳动Seedance 2.0与快手可灵3.0同台较量不同的地方在于,这一次Seedance2.5的发布,正好撞上了MiniMax H3。
同样拥有视频生成能力的两款新模型,少不得被拿来作为对比。
据介绍,MiniMax H3,支持对文本、图像、视频、声音组成的多模态上下文的统一理解能力、能够输出具备原生双声道的音视频,最高可支持15s 2K分辨率。
当前,MiniMax H3已登陆海螺AI、API及Runway、fal、OpenRouter等全球渠道。
MiniMax、字节跳动同日上新,快手还会远吗?
早在2024年6月,快手便推出了视频生成模型可灵“可灵”。随后在2025年4月,快手高级副总裁、主站业务与社区科学线负责人盖坤,用极高的评价为快手在视频生成领域的成绩定调:“‘可灵’吹响了整个视频生成赛道的挑战哨。”“在我们之后,各个厂商都开始发视频生成模型。”
截至2026年2月可灵3.0上线,快手在20个月内陆续更新了8个大小不一的模型版本。按照平均速度来看,快手可灵新版本,应该已经上线了。外界为何会有“快手还没动静”的错觉?首先,快手近期的重心在于内部融合与商业变现(如广告生成式推荐、短剧素材自动化);其次,7月初,可灵业务顺利落地近30亿美元首轮融资,投后估值达180亿美元。
当前,市场对于可灵的关注点,仍集中在融资。新模型的微调发布,或许不会太远了。
集体上新背后:三个共同趋势
7月31日,MiniMax、字节跳动、DeepSeek集体上新之前,智谱GLM-5.2、Kimi K3已相继亮相。其中,Kimi K3更是一举成为全球最大的开源模型,在全球科技界引发广泛关注与讨论。
就在8月3日,阿里巴巴刚刚发布新一代旗舰大模型Qwen3.8-Max:模型总参数量2.4万亿,Qwen3.8-Max在编程(Coding)和专业协作(Cowork)方面能力大幅提升,整体性能处于全球大模型前列。
而这,无疑再次加重了“2026年夏季成为国产大模型迭代最集中窗口期”的分量。
和以往单纯比拼参数规模不同,这一轮集体上新背后,是国产大模型行业从技术验证走向商业落地的关键转折,各家厂商不再挤在同一条赛道上内卷,而是基于自身禀赋走出了差异化的发展路径。
尽管各家模型的技术路线和应用场景各有侧重,但这轮集体上新仍展现出几条清晰的共同趋势。
第一,开源成为标配。
Kimi K3在发布后即宣布开源完整模型权重,成为全球首个落地的3万亿参数级开源大模型;MiniMax H3也宣布于8月3日开源,成为MiniMax推出的首款开源多模态生成模型;DeepSeek V4-Flash则以MIT许可证开源。开放权重正在成为厂商生态路线的重要分化方向,黄仁勋联合微软、Meta等机构公开支持开放权重路线,OpenAI随后也签署了相关公开信。
第二,多模态能力全面升级。
无论是语言模型还是视频模型,多模态都是本轮更新的关键词:Kimi K3原生支持视觉理解;MiniMax H3是一个通用型全模态生成系统,可统一理解文本、图像、视频和音频组成的多模态上下文;Seedance 2.5延续了统一的多模态音视频联合生成架构。
第三,性价比成为核心竞争力。
当前,各家都在用更低的价格提供更强的能力:DeepSeek V4-Flash输入价格仅1元/百万token,输出2元/百万token;MiniMax H3的2K视频生成价格为0.8元/秒,仅为业内同类旗舰模型的三分之一;Kimi K3也推出了缓存命中后低至2元/百万token的输入定价。
需要注意的是,字节跳动则依仗强大能力“涨价”。7月31日,Seedance 2.5上线当天,字节跳动公布的API价格显示:包含视频输入42元/百万tokens;不含视频输入70元/百万tokens。
作为对比,上一代Seedance 2.0(输出分辨率720P)包含视频输入28元/百万tokens;不含视频输入46元/百万tokens,新版本涨幅分别达50%、52%。
四条差异化技术路线,更是四条商业化路径
在相同的趋势下,各大厂商自然也选择了更适合自身、不同的突围路径。其中,Kimi堆参数、DeepSeek抠效率、MiniMax打通模态、字节跳动深耕场景,成为典型代表。
一直以来,月之暗面走的都是“大就是强”的路线。其最新发布的Kimi K3总参数达到2.8万亿,拥有100万token上下文窗口,是目前全球参数最大的开源模型。在Frontend Code Arena全球AI大模型榜单中,Kimi K3以1679分超越Claude Fable 5位居第一,实现了开源模型首次超越头部闭源模型登顶。
与Kimi形成鲜明对比的是,DeepSeek“少即是多”的路线。V4-Flash总参数2840亿、激活参数仅130亿,仅用Pro预览版六分之一的总参数和不到四分之一的激活参数,便在九项智能体与代码基准上全面超越Pro预览版。稍早前在业内流传的内部交流录音中,梁文锋也对于当下热门赛道“视频生成、3D、世界模型”不为所动,他认为,“这些跟智能的上限没关系。我们不做。”
作为MiniMax的关键词之一,其最新发布的MiniMax H3,打破任务边界,支持对文本、图像、视频、声音组成的多模态上下文的统一理解能力、能够输出具备原生双声道的音视频,最高可支持15s 2K分辨率。在Artificial Analysis有声视频编辑榜单中,H3以1130分的Elo成绩位列全球第一。该版本的发布也被视为“开源领域终于有了一个真正意义上的‘全模态’统一模型”。
Seedance 2.5则侧重“长叙事,从创意走向生产力”——其单次可生成30秒高质量视频片段,相比上一代的15秒翻了一倍。用户一次最多可输入30张图片、10段视频和10段音频作为参考素材。模型还支持精准的时间戳控制,可定向编辑视频内容。Seedance 2.5正在从“生成内容”走向“理解世界”,从“辅助创意”走向“提升生产力”。
技术路线的不尽相同,自然也决定了各大模型厂商,差异化的商业化路径。模型集体上新背后,正是一场关于如何把技术转化为收入的竞赛。
在定价上,Kimi K3走高端路线,输出定价100元/百万token,远超DeepSeek V4-Pro等竞品,其License模式也在探索开源模型的商业空间。值得一提的是,Kimi K3发布后,该公司融资节奏进一步加速——完成超35亿美元F轮融资,投后估值达350亿美元,原定8月开始的新一轮融资已提前启动,投前估值升至500亿美元。据传,其最快可能在未来6个月内登陆港股市场。
DeepSeek依靠极致性价比,同步加速推进全球化布局。V4-Flash的极致低价正在推动欧美公司将其嵌入工作流处理普通任务,仅在最复杂任务中调用高端模型。同时,DeepSeek率先引入了峰谷定价机制,高峰时段价格为平时的2倍。这种精细化的定价策略,既优化了资源利用效率,也为商业化提供了更多弹性。稍早前在业内流传的内部交流录音中,梁文锋也曾提到公司的定价原则:按10个月收回设备成本定价(约6倍利润),不追求需求弹性下的高价。
MiniMax的商业化则有两条腿:一是海外C端市场。其旗下AI陪伴应用Talkie已是全球领先的应用之一,截至2025年9月,累计用户达1.47亿,月活跃用户达2760万,付费用户数在2025年前9个月达177.16万。二是视频生成的成本优势,H3在768p分辨率下的价格约为同业一半,2K分辨率下仅为同业三分之一。该版本发布后,港股MINIMAX-W次日涨超10%。
稍早前,MiniMax曾在5月28日披露,过去两个月,公司年化经常性收入(ARR)实现超过100%的增长。按今年2月ARR超1.5亿美元计算,其最新ARR已超3亿美元。公司的收入结构也从2025年C、B端起三分,转为各占一半。
在所有国产视频模型中,字节跳动的商业化进展最为瞩目,Seedance也被誉为最赚钱的视频模型,在AI短剧、漫剧工具赛道中占据超过80%的市场份额。某分析师曾透露Seedance 的6月份流水在18-21亿元(此前业界传闻其单月收入超过10亿元,火山引擎总裁谭待公开辟谣称外界传闻都是错误的,比实际收入偏高)。2026年,火山引擎已将MaaS业务全年营收目标提升至150亿元,是2025年实际营收的十倍。
作为对比,2026年第一季度,快手可灵AI产生的收入超过6.5亿元,同比增长超过300%。2026年3月,可灵AI的年化收入运行率(ARR)近5亿美元。
值得关注的一条暗线在于:字节跳动的组织架构调整——飞书产品团队与豆包产品团队整合,成立新的豆包产品团队;飞书GTM团队与火山引擎团队整合,成立新的ToB GTM组织“创造力服务平台”。这一调整意味着,字节跳动正在将AI能力深度嵌入生产力场景,试图打通从模型到应用再到商业化的闭环。
不难看出,2026年夏天,正在成为AI应用产业的关键转折点。
当前,国产大模型的能力正在接近全球主流模型第一梯队,而商业化的竞争才刚刚进入深水区。谁能在技术、成本、生态和场景之间找到最优解,谁就能在这场长跑中率先撞线。
注:部分内容由AI总结。
热门跟贴