Kimi K3全面开源
中国大模型企业月之暗面宣布全面开源,K3背后的技术细节也随之浮出水面。
7月27日,月之暗面(Kimi)宣布发布Kimi K3的模型权重、技术报告,并开源支撑Kimi K3模型训练的关键Infra技术:MoonEP、Flash KDA和Agent Env,希望以此加速前沿智能的部署与普及,促进AGI研究。
Kimi介绍,在并不宽裕的算力条件下,K3凭借Kimi Delta Attention、Attention Residuals以及MoonEP等一系列技术创新,实现模型规模化效率提升2.5倍,即在算力最优意义下,单位算力产出智能约等于原来的2.5倍。
此前7月16日,Kimi推出2.8万亿参数的Kimi K3,成为全球参数最大的开源模型,瞬间震动全球——发布48小时后,用户请求量逼近集群承载极限。7月19日晚,月之暗面发布公告,暂停C端新用户订阅,将全部算力优先保障已付费老用户。
目前,K3已经实现全面开源。据介绍,每个人都可以下载并部署Kimi K3模型,无论是用于内部研发,还是嵌入面向终端用户的产品中,均可自由使用。“我们相信,对于AGI这样具有深远影响的技术,一个广泛、开放的生态系统是最适合承载它的土壤。为此,我们将继续贡献自己的力量。”Kimi表示。
海外媒体和开发者盛赞K3
对于K3此次开源,外媒分析,这是对AI大厂的有力挑战,尤其是Anthropic和OpenAI。这两家公司最新的模型分别是Claude Fable和GPT系列模型,K3性能紧随其后,其运行成本似乎只有它们的1/2-1/3;如果特定查询被缓存,成本甚至可以降低至十分之一。
另有外媒报道称,美国公司正在迅速采用Kimi模型,目前中国人工智能模型已占OpenRouter等平台上整体使用量的60%。与闭源模型相比,Kimi K3还展现出卓越的成本效益,每投入一美元可以完成更多任务。外媒称,人工智能的基础设施特性决定其必须采用开源才能产生广泛的经济影响,因为闭源会阻碍应用和定制,最终开源会更受青睐。
Hugging Face首席执行官Clement Delangue表示,K3发布后很快登上Hugging Face趋势榜首,社区反响非常强烈。
北美AI基础设施创企Osmantic AI的创始人兼CEO Ahmad发文,将Kimi K3称为“本地版Fable 5”,并称“知道为什么Anthropic讨厌开源AI吗?Kimi K3免费且可下载,让他们的万亿美元估值失去意义。”
7月28日,据Design Arena在社交媒体发文,Kimi K3在“Python-PPTX Slides”幻灯片竞技场以Elo评分1379分登顶,领先第二名Claude Fable 5(1303分)76分。帖文将Kimi K3称为“无限制级模型”,并称其以该榜单所见“最大优势”获得第一名。
月之暗面Kimi创始人杨植麟 视觉中国 资料图
Kimi创始人杨植麟曾多次公开表达对开源的态度。
“当前闭源模型仍占据一部分市场份额,而开源正在持续解锁更多的市场空间。最终如果模型能力达到同等水平,开源会是绝对的胜利者。”此前在接受澎湃新闻等媒体采访时,杨植麟表示,开源的核心竞争力在于其构建了生态共赢的合作模式,所有参与者都能在技术迭代与产业落地的过程中获得收益,进而催生海量的应用场景与渠道,形成完整、自循环的产业生态。
“开源生态的市场总量,最终会达到远超闭源模式的水平,这也是中国AI产业当下最重要的发展思路与机遇。”杨植麟提到。
2026年7月20日,上海,2026世界人工智能大会上,月之暗面旗下新一代模型Kimi K3发布 视觉中国 图
K3技术亮点在哪里
澎湃新闻记者梳理Kimi K3公布的技术报告显示,此次K3全面开源有三大核心亮点:
第一,这是全球首个开源“3T级”模型。
报告显示,Kimi K3总参数2.8万亿(2.8T),每次回答实际激活1040亿参数,支持100万token上下文窗口,原生支持图片和视频理解。这是全球第一个开放全部权重的3T级模型,此前开源模型大多停留在1万亿参数级别。
从综合性能来看,K3只输两个最强闭源模型(Claude Fable 5、GPT-5.6 Sol),但稳定超过Claude Opus 4.8、GPT-5.5等其他所有参评模型。这也意味着,继DeepSeek之后,中国公司再次用“开源”冲击全球AI前沿水准。
第二,K3体现AI“自我进化”能力。
报告中提到,K3在一次无人干预的48小时连续运行中,用开源EDA工具设计并验证一款AI推理芯片原型(nano-KPU):4平方毫米面积内集成146万个标准单元,仿真推理速度超每秒8700个token。
此外,K3从零开发名为MiniTriton的编译器,从编程语言前端到英伟达显卡底层代码生成全链条贯通,在其基准测试中几何平均性能超过PyTorch官方两种模式。报告还披露,K3的一个早期版本在开发后期已经承担公司内部大部分GPU内核优化工作。
第三,超高性价比。
根据BrowseComp(网页浏览智能体测试)显示,K3拿到全场最高分91.2%,而每个任务成本仅2.03美元,这是GPT-5.6 Sol的一半,比Claude系列便宜约一个数量级。
在编程测试Kimi Code Bench 2.0中,Kimi得分只比Claude Fable 5低4分,成本只有对方的38%。而根据知识工作测试GDPval-AAv2,Kimi与GPT-5.6 Sol差距在50个Elo分以内,成本低13%。
在结构创新方面,报告披露,K3采取KDA+AttnRes结构替代传统注意力结构(如Transformer)。在此次更新中,K3自研的Kimi Delta Attention(KDA)起到关键作用:KDA能实现“速记式”线性注意力,不管上下文多长,记忆成本不变;剩下1层用Gated MLA做“全文精读”,保证关键处不丢精度。
重新定义“开源”和“商业”
除了技术层面,此次Kimi发布的K3许可证也受到业内广泛关注,其中有两个关键要素:
一,经营模型即服务(Model as a Service)业务,且自身及关联方年营收超过2000万美元的公司,需要另行签订商业协议。
二,如果任何商业产品或服务的月活跃用户超过1亿,或者月收入超过2000万美元,则需要在界面显著位置展示"Kimi K3"标识。
这也意味着,“开源”不等同于“免费”,Kimi正在尝试定义开源开放和商业回报之间的衡量方式。
在Kimi宣布开源后,国内云计算大厂在第一时间响应并适配。
华为计算发文表示,此次Kimi K3一经开源发布,昇腾即实现0day(指在产品正式发布或系统上线当天“第0天”就能完全兼容和正常运行的能力)适配:在训练侧,基于MindSpeed MM在Atlas 800 A3、Atlas 900 A3 SuperPoD上完成训练复现,在算子、并行加速、显存优化等方面进行专项优化;在推理侧,通过vLLM Ascend与SGLang开源推理引擎实现快速部署。同时,昇腾950超节点支持FP8、MXFP8、MXFP4等全系列数值精度格式,原生支持Kimi K3的mxFP4量化权重。
2026年7月17日,上海,在2026世界人工智能大会上,阿里巴巴展示旗下平头哥研发的新一代训推一体AI芯片“真武M890” 视觉中国 图
阿里云宣布,真武M890超节点实例已Day0适配Kimi K3,这是国内首个成功运行近3万亿参数模型的超节点。该超节点通过ICN Switch高速互联芯片,将64张平头哥真武M890芯片以800GB/s全互联,显存规模达9TB,单实例即可支撑大规模万亿级MoE模型的专家并行需求。
为提升运行效率,阿里云、平头哥与Kimi团队从软件栈、算子层面进行了深度联合适配,优化后首Token时延降低约35%,单卡解码吞吐提升1.8倍,可稳定支持1M长上下文。千问AI平台和阿里云百炼将同步提供Kimi K3的模型API。阿里云表示,该适配验证了国产算力已具备支撑超大参数模型大规模应用的能力。
热门跟贴