Kimi K3引发的全球AI震荡还在继续。

717日凌晨,月之暗面正式发布迄今最强模型Kimi K3,总参数2.8万亿,成为全球最大开源模型。

当时,马斯克在相关测试的评论区留言:令人印象深刻。

仅仅一天后,他就把Kimi当成了新目标。

马斯克在X上发布推文,宣布SpaceXAI下一代2T模型,将在下周完成初始训练。

紧接着,他说这个新模型可能能够超越Kimi

打开网易新闻 查看精彩图片

以往马斯克面对GPTClaudeGemini时,动辄放出“必将碾压”“全方位领先”的狠话,但这次反倒只用了“可能”,不敢打包票。

这或许是他有史以来,对中国模型最高的一次评价。

打开网易新闻 查看精彩图片

被马斯克点名追赶的Kimi K3,到底有多强?

先来看看第三方权威榜单排名:

Artificial Analysis综合智能指数评测中,K357分排名全球第三,仅次于Claude Fable 560分)和GPT-5.6 Sol59分),领先于Claude Opus 4.8GPT-5.5

这份指数由智能体任务、代码编写、科学推理、通用逻辑等9大维度加权测算得出,覆盖数百款主流模型。

K3作为开源产品冲进全球前三,直接击碎了行业流传已久的偏见:国产开源模型综合能力,永远比不上海外闭源巨头。

打开网易新闻 查看精彩图片

能力的大幅提升,主要来自于Kimi K3选择了一条和竞品完全不同的技术路线。

前两年,全球AI陷入疯狂参数竞赛,厂商一味扩张模型规模,相信参数量越大、算力越强,模型性能就必然提升,却忽略算力成本暴涨、推理效率持续下滑的行业通病。

Kimi没有跟随行业老路,直接从底层Transformer框架切入重构创新。

此前团队发布的注意力残差论文,直接修复原生架构长期存在的信息稀释问题,同等算力下训练效率提升25%,这套自研技术也完整落地到K3身上。

Kimi K3采用自研KDA混合线性注意力和稀疏混合专家架构,2.8万亿的总参数规模看似体量庞大,但模型不会在每次调用时激活全部模块,实际上只激活了896名专家中的16位。

对比上一代产品,整体扩展效率提升了约2.5倍。

底层架构的革新,给超长文本能力铺平了道路,这也是Kimi从初代产品延续至今的王牌优势。

Kimi K3拥有100token的超长上下文窗口,百万字工程手册、全套学术论文、完整项目代码库、上百份商事合同,都能一次性完整读取、梳理、复盘,逻辑全程不脱节。

如果说长文本是基本盘,代码能力就是K3彻底甩开对手的杀招。

在由伯克利研究人员打造的编程盲测竞技场Code Arena上,K3拿下1679分,大幅超越GPT-5.6 SolClaude Fable 5两大闭源巨头,登顶全球编程模型第一。

在前端开发7大细分赛道中,K3拿下6项第一,代码胜率大幅甩开海外竞品。

该测试汇聚了全球数百万开发者的真实反馈,任务全部是真实的前端工程需求,随机两个模型配对PK,用户全程看不到模型名称、标识,盲测投票,是行业公认最贴近真实前端开发的第三方编程榜单。

打开网易新闻 查看精彩图片

不过,Kimi官方也坦然表示,Kimi K3的整体表现仍落后于最强的闭源模型 Claude Fable 5 和 GPT-5.6 Sol。

打开网易新闻 查看精彩图片

K3问世冲击全球资本市场,全球AI巨头估值遇冷

K3发布后,市场反应极其直接。

717发布当天,美股迎来明显波动纳斯达克综合指数收跌1.4%费城半导体指数一度重挫5.7%,收市仍跌1.6%

CNBC、华尔街日报、福克斯财经、彭博社等多家海外主流媒体,都把本轮科技股抛售行情与Kimi K3发布绑定,认为它是直接催化因素。

其中,彭博社将此次发布称为新的“Kimi时刻”,对标去年DeepSeek引发市场冲击的“DeepSeek时刻”,并发文点评,直言Kimi K3的综合性能,已经具备对标OpenAI、Anthropic顶级产品的实力。

CNBC解读称,美股半导体板块走出年内最差单周行情,创下2025年4月以来最大周度回撤,Kimi K3落地是本轮下跌直接导火索。

高盛更是抛出警告,持续多年的算力疯狂扩张时代,或许即将走到尽头。

资本市场情绪直接传导至头部AI企业估值,Polymarket数据显示,Kimi K3发布后,市场押注Anthropic年底估值突破1.5万亿美元的概率直接下滑11%,仅剩 67%。

打开网易新闻 查看精彩图片

此前资本市场对Anthropic超高估值,高度绑定Claude系列模型在通用智能、工业落地的绝对领先性,市场默认它很难遭遇同级对手。

K3的全方位突围,直接打破了这一估值溢价根基。

打开网易新闻 查看精彩图片

成立3年跑出黑马,已计划赴港上市

能造出撼动全球市场的Kimi K3,背后的月之暗面成立至今仅仅3年。

2023年,月之暗面在北京成立,创始人杨植麟1992年出生,本科毕业于清华大学,博士毕业于美国卡内基梅隆大学,师从苹果AI研究负责人拉斯·萨拉克赫蒂诺弗和谷歌首席科学家威廉·科恩。

公司成立仅2个月,就完成近20亿元的天使轮融资,截至目前,月之暗面斩获红杉中国、腾讯、阿里、IDG等顶级资本重仓。

今年6月,媒体消息称月之暗面启动新一轮融资,投前估值突破315亿美元,折合人民币超2000亿元。

三年时间估值一路暴涨,但不是靠故事撑起来的。

截至6月中旬,月之暗面的年度经常性收入正式突破3亿美元。3月破1亿,5月破2亿,6月中旬破3亿三个月完成三倍跃升。

更关键的是收入结构的变化,API企业服务收入已占整体七成以上,摆脱了早期对C端个人订阅的单一依赖,进入了高粘性、高复购的B端规模化变现阶段

全球化布局同样超出市场预期,海外市场付费用户与API调用收入同步实现400%同比激增,产品落地覆盖全球200多个国家和地区。

据媒体消息,Kimi已通知投资者调整公司架构,筹备赴港IPO,最快可能6个月内就能完成上市。

打开网易新闻 查看精彩图片

国产AI从追赶者,变为全球巨头的对标目标

两年前,全球AI舆论场的主旋律国产大模型追赶海外头部GPTClaudeGemini牢牢掌握技术、榜单、生态话语权,国内厂商只能复刻成熟技术、缩小性能差距。

而马斯克此次公开对标Kimi K3,是整个行业格局反转的标志性事件,三大变化正在重塑全球AI竞争逻辑

第一,开源赛道国产全面领跑。Kimi K3DeepSeek开源系列包揽全球开源模型第一梯队

第二,专项能力实现全方位反超。长文本、工程编程、稀疏架构创新等赛道,国产模型多次在第三方盲测榜单碾压海外旗舰模型,同时K3在综合智能指数上稳居全球前三,硬实力跻身全球顶级梯队;

第三,海外巨头研发路线被迫国产创新看齐谷歌Anthropic近期迭代计划全部加码超长上下文、MoE稀疏架构,本质是借鉴Kimi验证成功的技术路线,侧面承认国产技术路线具备全球参考价值。

过去全球AI竞争,比拼的是谁能复刻海外成熟方案;如今比拼谁能做出底层原创创新,走出差异化路线。

月之暗面作为本土创业公司,没有大厂海量流量、固有业务兜底,纯粹依靠算法创新、开源普惠路线突围,代表国产AI全新成长样本。

全球AI效率大战已经拉开帷幕,以Kimi为代表的国产大模型,手握底层创新、顶级综合智能、开发者生态三张王牌,在全球产业竞争中站稳脚跟。

中国AI不再是跟在身后的追赶者,而是全世界巨头紧盯、全力追赶的领跑者。更大的技术博弈与资本故事,才刚刚开始。