AI · 深度观察
Kimi K3 冲击波
2.8 万亿参数、登顶全球编程榜、把“中美差距”从一年压到三个月——一款中国开源模型,第一次让华尔街因为中国 AI 而紧张。
综合新华社、彭博社、月之暗面官方技术博客、华尔街见闻及多家权威报道 | 2026-07-19
7 月 16 日深夜,上海,WAIC 2026 开幕前夜。没有发布会,没有预告片,月之暗面把 Kimi K3 悄悄挂上了官网。然后,全球炸了。
三天后,彭博社发出一篇报道,标题很克制,但分量不轻:《Moonshot 的 Kimi,颠覆了“美国领先中国”的固有认知》。同一周,费城半导体指数跌入技术性熊市,华尔街把这一幕称为“Kimi 时刻”。
一个中国开源模型,为什么能让大洋彼岸的科技股抖一抖?这篇稿子,我们把官方说法、国内通稿、外媒、学者、华尔街、半导体分析师和资本市场的话都摆出来,看看这场“冲击波”到底冲击了什么。
一先把事说清楚:K3 是什么
7 月 16 日,月之暗面正式发布 Kimi K3;17 日凌晨起,它已经在 Kimi App、Kimi Work、Kimi Code 和 Kimi API 全线上线。官方给它的定位是“迄今能力最强的模型”。
几个硬指标,均来自月之暗面官方技术博客:2.8 万亿参数、MoE 架构、100 万 token 上下文、原生视觉理解;新架构 Kimi Delta Attention(KDA)加注意力残差(AttnRes),官方称扩展效率比 K2 提升约 2.5 倍;两个变体分别是 K3 Max(对话与智能体)和 K3 Swarm Max(大规模并行)。
最关键的一句:完整权重将在 7 月 27 日前开源。官方称它是“全球首个开源的 3T 级(万亿参数)模型”,也是“目前全球参数最大的开源模型”——据公开资料,它一步跨过了 DeepSeek V4、百度文心大模型 5.0 等此前最大的开源模型。新华社的通稿里,也用了“标志着我国人工智能模型发展迈出新的一步”这个表述。
二技术上,它做对了什么
参数大不等于能力强。历史上不少“大模型”参数堆上去,性能却原地踏步,被业内调侃为“大而无当”。Kimi K3 不同,它在架构上动了两处关键手术。
第一处:KDA 混合线性注意力。传统 Transformer 处理超长序列时,计算量会随序列长度平方增长,业内叫它“注意力税”。KDA 用线性注意力替代了其中一部分二次计算,让 100 万 token 的上下文窗口从“纸面参数”变成推理中真正可用的资产。
第二处:注意力残差(AttnRes)。这是 Kimi 今年展示的架构成果,思路借鉴了让深度学习过去十年脱胎换骨的残差连接(ResNet),把同样的手法用到了注意力机制上,让超大模型训练得更稳。Kimi K3,是这项成果第一次完整落地。
两处创新叠加,官方给出的结论是:相比 K2,整体扩展效率提升约 2.5 倍——也就是说,同样的算力投入,K3 能榨取出比 K2 多得多的能力。
三跑分:它真的能打吗
先看最炸的数据。在第三方榜单 Frontend Code Arena(arena.ai)上,Kimi K3 拿到 1679 分,排第一,超过 Claude Fable 5 的 1631 和 GPT-5.6 Sol 的 1618。这是有史以来,第一次有开源模型在这个榜单上登顶。
但这里得泼盆冷水:这个排名,Arena 自己标的是 “Preliminary”(初步结果)。伯克利的 Ion Stoica 也说,初步结果、尤其在编码上,K3 才和 Fable、GPT-5.6 Sol “处于同一水平”。所以别看到“第一”就上头。
把官方公布的基准表摊开看,K3 是“多点开花”,不是“全面碾压”:
(数据来源:月之暗面官方技术博客,经第三方报道整理;另据高盛引述 arena 数据,K3 在 Frontend Code Arena 的多个细分方向上,7 个里拿了 6 个第一)
但 FrontierSWE、GDPval 这些项目上,它和 Fable 5 还有明显差距。第三方机构 Artificial Analysis 给的综合智能指数约 57 分,和 Opus 4.8、GPT-5.5 同档,落后于 Fable 5 与 GPT-5.6 Sol。
有意思的是,月之暗面自己在博客里列了三个“认怂”的地方:一是对思考历史敏感,智能体框架没回传完整历史就可能翻车;二是太主动,模糊指令下会替你做预期外的决定;三是整体用户体验,和 Fable 5、GPT-5.6 Sol 比还有可感知差距。一个发布当天就坦白短板的公司,反而让人更信它的跑分。
四马斯克第二次点赞
7 月 17 日凌晨,K3 发布的消息传到海外。特斯拉 CEO 马斯克在相关评测报道的评论区留下了四个字:“Impressive.”(据多家媒体报道)
这已不是他第一次公开肯定 Kimi。在开发者社区,更多人把它比作又一个“DeepSeek 时刻”——这个词在 2025 年初 DeepSeek R1 发布时被广泛使用,指的是中国团队以远低于预期的成本,做出逼近全球顶尖水平的开源模型,引发全球 AI 格局震荡。Kimi K3,被许多人认为具备同等量级的影响力。
当然,“Impressive”是褒奖,不是认输。K3 整体仍落后于两款最强闭源,这一点连月之暗面自己都没回避。
五华尔街的恐慌与辩论
7 月 17 日,K3 发布的消息传导至美股。费城半导体指数(SOX)当日收跌 1.63%,较 6 月 22 日创下的历史高点累计下跌 20.2%,正式跨入技术性熊市门槛;英伟达从高点回落超 20%,美光、Arm、英特尔等芯片股均出现显著回撤。彭博社直接将这一定义为“Kimi 时刻”。
高盛 · 悲观派
合伙人、股票业务负责人 Rich Privorotsky 将本轮下跌定性为“去杠杆事件”,警告“算力扩张时代”或已走到尽头。他的核心判断是:一家无法匹配西方最大规模预训练算力的中国实验室,靠架构创新、合成数据、强化学习和后训练迅速缩小了差距——“这并非证明扩展定律失效,而是表明扩展不再是唯一的制胜路径”。
高盛 · 7/18 报告 · 另一面
同一家投行两天后的报告却给出了积极解读:K3 标志中国开源模型智能水平已触及全球大规模普及的临界点,定价能力随之提升。据其估算,K3 成本较同类美国顶级模型低约 40%。
有意思的反差就在这里:Kimi 这次没走 DeepSeek 那种“便宜到离谱”的路线。官方 API 定价缓存命中输入 0.30 美元、未命中 3.00 美元、输出 15.00 美元 / 百万 token——业内估算,这比国产模型此前的低价策略提价约 2 到 3 倍,却仍比美国旗舰便宜近一半。月之暗面押的注是:靠编码和高利润智能任务的硬实力,收更高的价。
同一事件,两套叙事,同一个事实:华尔街正在重新评估中国 AI 的含金量。
六开源:把刀柄递给全世界
K3 最让业界震动的决定,不只是性能,而是它的开源承诺。完整模型权重将于 7 月 27 日前开放,企业、政府可在自有系统上定制部署、微调,无需向月之暗面付费。
过去业界有个默认认知:开源模型永远在追赶闭源,且至少落后一代——等开源追上,闭源又往前迈了一步。K3 第一次把这条鸿沟压到了“肉眼可见的近处”。一个能力逼近全球前沿的模型,愿意把权重完整交出来,这不只是商业策略,更像一种宣言:开源与闭源的差距,可能从“年”被压缩到“月”。
数据印证着这股势头。据 Hugging Face 季度报告(经多家媒体引述),中国开源模型的全球下载量占比已反超美国(报告给出的数字约为 58% 对 28%)。K3 的到来,会进一步改写这张地图。而对很多把“合规”当命门的企业,模型能私有化部署、数据不出域,比省那点调用费更打动人。
七新华社通稿里的深意
一个值得注意的细节:K3 发布当天,新华社即发了通稿。通稿写道:“新一代模型 Kimi K3 于 16 日发布,参数规模达 2.8 万亿。这是目前全球参数最大的开源模型,标志着我国人工智能模型发展迈出新的一步。”
同一个节点,2026 世界人工智能大会(WAIC)于 7 月 17 日在上海开幕,国家领导人出席开幕式并发表主旨讲话,主题正是“携手构建公正合理的全球人工智能治理体系”,讲话中明确提出“鼓励开源开放、合作共享”。国家级平台为开源模型背书,与 K3 的开源姿态,形成了时间点上的呼应。
八它意味着什么
第一,对中国 AI 而言:从 DeepSeek V4 到 Qwen 3.7,从智谱 GLM-5 到 Kimi K3(据行业梳理),中国 AI 正在完成从“追赶者”到“并跑者”的切换——参数规模、性能表现、开源生态、定价能力,四个维度同步推进。不过,虎牙 CEO 黄俊洪在 WAIC 腾讯 AI 应用创新论坛上给了另一视角:“当前 AI 领域模型能力的差距正持续收窄,但工程化能力的差距正在逐步拉开。”技术追赶只是第一关,真正的决战或在工程落地与规模化应用。
第二,对全球 AI 格局而言:OpenAI、Anthropic 凭借“规模 + 闭源”建立的护城河,正在被开源社区以更低成本、更快速度填平。如果开源模型能提供八成以上的性能且完全免费,闭源模型凭什么收溢价?答案必须是:持续不断地创新。这种压力,客观上会加速整个行业的进步。彭博还点出一个反直觉变量——OpenAI、Anthropic 迫于美国审查压力推迟发布,这种“放缓”反而可能给中国留出追赶窗口。
第三,对每一个普通人而言:K3 已在 Kimi App、Kimi Work、Kimi Code 和 Kimi API 全面上线。写代码、做分析、处理长文档、读懂复杂图表——这些曾需要专业技能的工作,正以极低的门槛向所有人敞开。AI 的普惠化,正以 K3 这样的产品为节点,一步一步发生。
九收尾
写完这篇,我反而觉得最该记住的,是月之暗面自己那句坦白:K3 整体仍落后于 Fable 5 和 GPT-5.6 Sol。不神化,才看得清。
2025 年初,DeepSeek R1 让全球 AI 圈第一次正视中国团队。2026 年 7 月,Kimi K3 让华尔街第一次因为中国 AI 而感到紧张。从“追赶者”到“冲击波”,这条路,中国 AI 走了不到两年。
下一个“时刻”,会是什么?
参考资料(均为公开权威报道与官方信息)
新华社 / 财联社 通稿(2026-07-16/17):Kimi K3 发布,2.8 万亿参数、全球最大开源模型
月之暗面官方技术博客(Kimi K3 技术报告):架构、基准、定价、局限、开源计划
彭博社 Bloomberg(2026-07-18):Moonshot's Kimi Upends Conventional Wisdom on US Lead Over China
arena.ai(Frontend Code Arena):K3 登顶,标注 Preliminary(初步结果)
Artificial Analysis:K3 综合智能指数约 57,与 Opus 4.8 / GPT-5.5 同档
华尔街见闻、腾讯网、东方财富网(2026-07-17/18):SOX 技术熊市、“Kimi 时刻”、高盛“去杠杆事件”与“扩展不再是唯一制胜路径”
IT之家、科创板日报:上线信息、张予彤关于 ARR 的表态
澎湃新闻:港股 IPO 传闻与 ARR 数据(公司未正式回应)
新华网 / 央广网:WAIC 2026 开幕式与主旨讲话(强调“鼓励开源开放、合作共享”)
上证报(东方财富引述):虎牙 CEO 黄俊洪 WAIC 论坛发言
SemiAnalysis:KDA 与硬件需求分析(高效架构反而刺激 GPU/HBM/网络长期需求)
CSDN(引述 Hugging Face 季度报告):中国开源模型全球下载量占比反超美国
为伟大思想而生!
AI+时代,互联网思想(wanging0123),
第一必读自媒体
热门跟贴