• Kimi K3发布两天即暂停新订阅,因需求超出算力承载。
  • K3免费开放权重,部分表现可比甚至优于GPT和Claude。
  • 其崛起加剧中美前沿AI竞争,也引发对出口管制效果质疑。
  • 分析称中美模型差距已缩至3至6个月。

打开网易新闻 查看精彩图片

还记得DeepSeek吗?这家中国人工智能初创公司曾以一款训练成本远低于同行、性能却几乎追平领先对手的模型震动美国科技业。

如今,中国可能又做到了。

最新引发关注的中国人工智能模型,来自一家知名度较低的初创公司“月之暗面”。该公司在模型发布仅两天后,就因需求超出算力承载能力,暂停了新用户订阅。

外界对“月之暗面”Kimi K3模型的热情,源于它能够免费提供与美国最先进竞争对手相当、在某些情况下甚至更优的表现。

打开网易新闻 查看精彩图片

这些对手包括OpenAI最新版本的GPT,以及Anthropic的Claude。

Kimi K3的崛起,正在加剧中美之间本已激烈的前沿人工智能竞争。近年来,华盛顿不断加强对华出口限制,试图放缓中国在人工智能和可用于军事的芯片领域的发展。

Kimi K3发布后,美国官员和Anthropic再次指责“月之暗面”对美国模型进行了“蒸馏”。所谓“蒸馏”,是指用一个人工智能模型的输出结果来训练另一个模型。“月之暗面”否认了这一说法。

不过,美国企业和政府官员中蔓延的不安,凸显出这场人工智能竞争的分量,以及它对经济、国防和国家安全的深远影响。

与多数美国闭源模型不同,Kimi K3以开放权重模型形式发布。这意味着开发者可以免费下载、修改,并在自己的服务器上运行它,从而更容易被采用,也更容易在全球范围内打开市场。

打开网易新闻 查看精彩图片

与美国企业相比,中国企业在人工智能硬件和投资方面获得的资源更有限,因此中国更倾向于发展所谓开放模型;而美国竞争对手的大多数模型仍主要依赖付费订阅。

晨星金融服务公司高级股票分析师切尔西·谭表示:“许多机构看重开放模型可自行部署的能力,这样它们可以掌握模型权重,并控制敏感数据,而不是完全依赖闭源模型提供商。”

谁推动了中国最新一轮人工智能突破?

“月之暗面”由杨植麟于3年前创立。杨植麟30岁出头,来自中国东南部城市汕头,是一名颇受关注的软件工程师。

他在清华大学求学时就已显露潜力。其导师是唐杰——这位教授后来于2019年创办了另一家知名人工智能初创公司智谱。

2014年,唐杰在为杨植麟申请奖学金时写道:“他是我近年来遇到的最有天赋、最出色的学生。”

此后,杨植麟前往卡内基梅隆大学攻读计算机科学博士,师从鲁斯兰·萨拉赫季诺夫。后者曾在Meta和苹果担任人工智能高管。

萨拉赫季诺夫回忆,到杨植麟学业结束时,他曾拒绝了一位直接向蒂姆·库克汇报的苹果高管提供的工作机会。

萨拉赫季诺夫在X平台发文说:“我记得他当时告诉我,如果不至少尝试创办自己的公司,他会后悔一辈子。我尊重这一点,而且他是对的。”

打开网易新闻 查看精彩图片

杨植麟后来表示,回国创业主要基于两点考虑。他在2024年接受中国官方媒体采访时说:“第一是环境。我们看到了巨大的机会,从政府和风险投资支持,到中国过去几十年在教育上的进步,这些都为人工智能初创企业创造了有利条件。第二,我们相信人工智能代表着一个巨大的机会。”

杨植麟在中国人工智能行业中受到关注,不仅因为他在32岁时创办“月之暗面”,成为中国最年轻的人工智能创业者之一,也因为他选择回到中国开启这项事业。

从一开始,杨植麟就抱有很大抱负。他在2024年的一档播客节目中说,公司名称来自他最喜欢的英国摇滚乐队平克·弗洛伊德专辑《月之暗面》,希望公司“能做成一件既能创造巨大价值、又极其困难的事——就像登月一样”。

“月之暗面”在2023年推出首个Kimi模型后迅速在中国走红。这个模型的名字取自杨植麟的英文名。根据他在2024年接受中国媒体采访时的说法,公司在2023年的前两轮融资中共筹集了近3亿美元。

这会是又一个“DeepSeek时刻”吗?

打开网易新闻 查看精彩图片

Kimi K3获得的国际关注,让人想起2025年初DeepSeek崛起时的情形。当时,该公司的R1推理模型在全球人工智能界引发震动。

这一次,K3在多项基准测试中的表现已接近OpenAI的GPT 5.6 Sol和Anthropic的Claude Fable 5等前沿系统,进一步缩小了中美人工智能模型之间的差距。

不过,分析人士认为,对“月之暗面”这一成绩的理解应有所区分。

DeepSeek曾挑战一种传统认知:开发先进人工智能模型必须依赖巨额资金和庞大算力,同时它还提供了有竞争力的价格。

但晨星董事伊万·苏表示,与前沿模型相比,K3的价格折扣远小于R1刚发布时的幅度,这意味着它的成本优势可能没有DeepSeek当时那么显著。

“你好,中国科技”通讯作者兼分析师赵颇表示,K3所展示的是,中国公司正在延续DeepSeek的成功,并继续缩小中美人工智能模型之间的差距。

他说:“更广泛的意义在于,DeepSeek越来越像是一种模式的开端。DeepSeek曾是一个意外,而K3则表明,中国的进步正变得越来越可复制。”

自DeepSeek之后,“月之暗面”、阿里巴巴和智谱等中国人工智能公司每推出一个新模型,都会获得更多关注,而且发布节奏也在加快。

市场研究公司Counterpoint Research首席人工智能分析师孙伟表示,随着K3问世,中国模型与美国模型之间的总体差距已缩小到3至6个月,不过不同任务之间差异仍然很大。

不过,也有分析人士对K3的真实能力持保留态度。

晨星高级股票分析师马利克·艾哈迈德·汗上周五在一份研究报告中说:“尽管K3代表着进步,但我们仍不愿将其在真实任务中的表现视为已接近美国前沿模型,例如Fable 5。”他解释说,过去许多开放模型开发者都曾围绕基准测试优化软件表现,以获得更好的测试结果。

这对美国构成威胁吗?

对于美国科技公司而言,像K3这样免费且性能可比的中国模型,可能削弱它们自身产品的竞争力。

美国主要人工智能公司Anthropic和OpenAI长期指责包括“月之暗面”、DeepSeek和阿里巴巴在内的中国实验室,从它们的模型中提取能力。随着K3出现,这类指控进一步升级。

“月之暗面”企业业务负责人黄振鑫周一在接受中国官方媒体采访时否认了“蒸馏”指控。

但这并未阻止华盛顿出现新的指责。

白宫科技政策办公室主任迈克尔·克拉齐奥斯周三在X平台发文称:“我们掌握的信息显示,‘月之暗面’在开发K3模型时蒸馏了Anthropic的Fable。”

不过,大多数分析人士表示,针对“月之暗面”的蒸馏指控不太成立。

Counterpoint Research的孙伟表示,在K3发布前,其竞争对手最新模型的可用性有限,“月之暗面”不太可能有足够时间利用这些模型来训练自己的人工智能模型。她还说,单靠蒸馏也无法解释Kimi K3为何能在某些方面超越对手。

她说:“从时间线上看,这种说法缺乏说服力。”

作者:约翰·刘

文章仅供交流学习,不代表本号观点

本文出处:What is China’s Kimi K3 and why is the US so rattled by it?