2026 年 8 月 20 日,《彭博社》发布《美国 AI 对中国领先优势正在迅速缩小》一文。
一批性能强劲、价格低廉的新模型接连发布,令中国在全球 AI 应用普及竞争中逐渐占据领先位置。
在 AI 企业实验室展开的全球技术竞争中,中国正迅速缩小与美国之间的差距。在使用量、成本等多项关键指标上,中国甚至已经取得领先。
对于 OpenAI 和 Anthropic 等美国 AI 企业而言,这一趋势日益令人担忧。两家企业都在寻求接近万亿美元级别的估值,而支撑这些估值的重要基础之一,正是市场对其技术能力领先和商业化前景的预期。
长期以来,美国政府一直试图通过限制向中国出口先进芯片,减缓中国 AI 技术的发展速度。
中国企业近期连续推出新模型,在编程和推理能力上均出现明显提升。
最新引发关注的是月之暗面推出的 Kimi K3。该模型的能力已经接近 Anthropic 最先进的模型,但使用成本只有后者的一小部分。
Kimi K3 正逼近美国最强 AI 模型。
多个独立性能测试显示,月之暗面的新模型已经跻身全球表现最强的一批 AI 模型。
为了呈现当前中美 AI 激烈竞争的整体情况,《彭博商业周刊》整理了一系列排名,对全球最先进的前沿模型进行比较,测试范围涵盖编程、金融、图像生成等多项能力。
《彭博社》还设计了一项定制化的“氛围编程”(vibe coding)测试,对部分主流模型的实际表现进行了评估。
Arena AI 最新发布的 Agent Arena 榜单显示,Claude 系列占据性能榜前列,其中 Claude Opus 5(High)以 12.3% 的净提升排名第一;Kimi K3(Max)以 10.5% 位列第四,是排名最高的中国模型,单任务中位成本仅 0.62 美元;OpenAI 的 GPT-5.6 Sol(xHigh)以 9.8% 排名第五,单任务成本为 1.39 美元。前 15 名中,Anthropic 模型占据 8 席,OpenAI 占据 4 席,Qwen-3.8 Max 排名第 14,Grok 4.5 排名第 15。
凭借定价策略,中国 AI 模型正对全球开发者和企业形成越来越强的吸引力。
在全球最主要的 AI 模型托管平台 Hugging Face 上,中国发布的生成式 AI 模型已经占据最大的单一下载份额。
越来越多美国企业也开始采用中国 AI 模型。
Airbnb、外卖平台 DoorDash 以及大型加密货币交易所 Coinbase,都已经开始使用部署在本地服务器上的中国模型。
今年 8 月,阿里巴巴披露,其开放权重模型在 6 个月内累计下载量已经超过 30 亿次,超过 Meta、Alphabet 以及中国其他竞争对手,成为全球下载量排名第一的 AI 模型家族。
中国 AI 模型在全球市场的普及,也引发外界对特朗普政府可能采取进一步限制措施的担忧。美国政府此前已经对中国电动汽车和太阳能产品实施进口限制,因此市场开始担心,美国可能以类似方式限制中国 AI 模型在美国市场的使用。
不过,目前已有接近 200 家美国企业公开反对禁止中国 AI 模型。这些企业认为,一旦禁止使用中国模型,其成本将会上升,同时削弱自身在国际市场上的竞争力。
执行此类禁令本身也存在难度。
Kimi K3 等中国模型采用开放权重模式,任何人都可以下载、复制,并在本地服务器上运行。因此,即使出台限制措施,实际执行也很困难。
AI 模型迭代速度极快。
Meta 首席执行官马克·扎克伯格曾将当前的 AI 竞争称为“可能是历史上竞争最激烈的一场技术竞赛”。在这种环境下,任何一家实验室都很难长期保持领先。
卡内基梅隆大学计算机科学教授 Ruslan Salakhutdinov 表示:“他们最终都会在某个时间点被其他人追上。”
Salakhutdinov 曾在月之暗面创始人杨植麟攻读卡内基梅隆大学博士期间担任其导师。
中美 AI 模型之间的差距缩小,恰逢美国 AI 企业进入关键资本阶段。
Anthropic 正考虑最早于今年 10 月进行首次公开募股,OpenAI 则正在考虑于明年上市。
Anthropic 在今年 5 月完成融资时的估值达到 9650 亿美元;OpenAI 在今年 3 月最近一轮融资中的估值达到 8520 亿美元。
相比之下,月之暗面的估值约为 350 亿美元,两者差距巨大。不过,就在一个月前,科技圈之外仍很少有人听说这家中国企业。
DeepSeek 则在 2025 年 1 月凭借推理模型 R1 的突然发布震动全球金融市场。目前,DeepSeek 正进行一轮大规模融资,并已经开始为最早于今年启动 IPO 做准备。
《彭博社》还与独立 AI 评测和基准测试平台 Vals AI 合作,对来自中国和美国前沿 AI 企业的 7 款模型进行了实际任务测试。
测试要求所有模型使用完全相同的提示词,创建一个虚构的咖啡电商网站“Brewberg”。
测试结果显示,尽管部分模型在设计细节上存在不足,但大多数模型在功能准确率方面都获得了 100% 的成绩。
真正明显的差异出现在价格上,达到相近功能效果的模型,使用成本存在巨大差距。
这次测试选择了 Anthropic 以及多家中国 AI 企业截至 7 月表现最好的模型,同时纳入了 OpenAI 和 Google 价格相对较低的模型。上述企业目前都提供不同价格和性能档位的产品。
云头条声明:如以上内容有误或侵犯到你公司、机构、单位或个人权益,请联系我们说明理由,我们会配合,无条件删除处理。
热门跟贴