你敢信吗,半年前还垄断全球AI市场的美国大模型,现在已经有近一半的企业调用量被中国开源模型抢走了。从硅谷初创公司到顶级科技巨头,就连英伟达老板黄仁勋都站出来帮中国大模型说话,这波操作谁看了不说一句绝。
今年7月中旬开始,这轮攻势就没停过。最先冲出来的是月之暗面的Kimi K3,2.8万亿参数全开源,发布当天就干到了Arena前端代码盲测榜第一,分数比当时的Claude Fable 5还高。更狠的是定价,百万Token才0.9美元,Claude要2.75美元,发布24小时用户需求就超过了算力承载,官方直接停了新用户订阅。
接着DeepSeek扔出了V4-Flash0731,直接把价格打在了地板上。同级别的Claude Opus 5百万Token要2.75美元,GPT-5.6 Sol要1.86美元,DeepSeek这款只要0.02美元,连百分之一都不到。价格卷成这样就算了,实测输出速度还比Claude Opus 5快了一半,性能只降了两成,普通日常任务用它完全够用。
它总参数2840亿,实际每次推理只激活130亿,官方打包的权重才160GB,比起别家动不动就上TB的模型,完全是轻量级选手。这个大小直接下探到消费级显卡就能部署,普通人花几万就能跑一个属于自己的私有大模型,把门槛拉到了前所未有的低。
最后压阵的是阿里巴巴的Qwen3.8-Max,刚官宣发布就冲到了Frontend Code Arena榜单第四,性能相当能打。价格还是一如既往的惊喜,只有Claude Opus5的四分之一,性价比依旧是断崖式领先。
现在三家中国模型定位分的清清楚楚,Kimi主打多模态前端长文本,Qwen主打政企多模态办公全栈,DeepSeek主打底层算法轻量化离线部署,三把刀精准扎进了美国AI市场,直接把原本被美国巨头垄断的蛋糕切走了一大块。
旧金山那家做AI自动化服务的初创公司Lindy,直接把全部生产流量都迁到了DeepSeek-V4。创始人接受采访时说,公司之前最大的成本支出就是Anthropic的API订阅,这次迁移完全是为了活下去。他们没直接用中国的API,是找美国本土云厂商AtlasCloud托管开源权重,该给DeepSeek的商业授权费一分不少,实打实的给中国厂商送钱。
不止小公司顶不住性价比诱惑,美国头部大厂也在用脚投票。加密货币交易所Coinbase做了智能分层调度,工程师日常研发场景优先调用Kimi和智谱的模型,只有极限复杂的任务才会切回GPT,改完之后API费用直接降了一半,九成一的工程师日常工作完全不用切回美国闭源模型,用着没任何区别。
美国头部外卖平台DoorDash把客服问答、订单文本解析、基础代码脚本这些高吞吐标准化业务,全换成了Kimi,只把复杂风控和财务预测留给本土模型。短租巨头Airbnb的客服对话、房源多语言文案、用户评论分析,早就切换成了阿里Qwen系列。
OpenRouter的统计数据很能说明问题,2025年初美国企业调用中国开源模型的Token占比峰值只有4.5%,到2026年7月这个数字已经涨到了46%。18个月涨了10倍,这还只是经过OpenRouter流转的数据,实际占比只会更高。
现在微软Azure、英伟达NIM、亚马逊AWS、谷歌云这些美国顶流云厂商,全部上架了DeepSeek和Qwen系列模型。云厂商本来就是做客户生意的,客户有需求自然没理由拒绝,刚好白宫最新的AI安全审查框架豁免了中国开源权重模型,这么做完全合乎美国法律,没人挑得出错。
对数据保密有要求的企业,之前不敢用第三方API,部署私有模型成本又高得离谱,根本用不起。现在DeepSeek V4-Flash的生产级部署只要百万以内,个人使用几万就能跑起来,还支持纯离线部署,完全不依赖外部网络和API,刚好符合数据安全要求,直接把这部分原本沉底的需求全盘活了。
这也就难怪黄仁勋一直站出来帮中国开源大模型说话,他做的是全球最大的显卡生意,中国大模型把私有部署的门槛降下来,越来越多的个人和企业都能养得起自己的大模型,这些都是实打实的显卡新增销量。不管是哪家的大模型,用到最后都要买英伟达的显卡,老黄稳赚不赔,当然帮着说话。
早些年ChatGPT刚出来的时候,全世界都为之疯狂,那时候中国AI的处境真的难。训练推理用的显卡被美国制裁,只能拿到阉割版,美国大模型一路堆算力砸钱,那时候中国AI弱小得像颗风里晃的豆芽,没人看好能追上来。
DeepSeek没多少算力资源可造,直接选了死磕MoE架构这条路,之前MoE架构理论上很好,但一直有“专家坍缩”的问题,门控总是偏爱少数热门专家,大部分专家长期闲置,还会带来负载不均、推理延迟波动大、调度难这些问题,没人能玩好。
DeepSeek一点点啃下来,搞出了优化后的DeepSeekMoE架构,又加了混合注意力机制,改了两阶段训练方式,硬生生把这些问题解决了。现在百万token上下文下,单token计算量只有之前版本的十分之一,KV缓存只要7%,上下文越长优势越明显。
技术做通之后,DeepSeek直接把全套技术开源,国内所有厂商都能免费复用,一下子拉低了千亿模型的训练成本。圈内大家互相借鉴,你用我的架构我用你的优化器,抱团就把整个国内开源大模型做起来了,这才有了今天的攻势。
反观美国头部闭源大模型,到现在还在死磕稠密模型,一路砸算力堆参数,算上这么多年的投入,已经快十万亿美元进去了,根本停不下来。中国大模型总算力投入还不到美国的十分之一,性能已经基本追平美国顶尖大模型,价格直接碾压,还能轻量化私有部署,三个维度把美国大模型逼到了墙角。
之前GPT-5.6突然宣布降价80%,直接震惊了全球AI圈,可就算降了价,OpenAI光2025到2026年就投了1200亿美元建算力中心,靠现在的API收入,不知道要什么时候才能收回成本。DeepSeek的斩杀线说穿了很简单,性能差不多价格比我高的没活路,价格差不多性能不如我的也没活路,直接把美国大模型原来那套高投入高价格的叙事逻辑砸得稀碎。
现在Anthropic和OpenAI天天游说白宫,想要封禁中国开源大模型,结果近两百家硅谷中小企业联名写信反对,警告禁令会直接摧毁美国的初创科技生态。黄仁勋也带着几十家科技巨头发声,反对一刀切封锁,说白了大家都是为了自己的利益。
初创企业不用中国大模型,高额API费直接拖死公司,反对封禁就是救自己的命。黄仁勋不管谁家的模型,用的多卖的显卡就多,当然反对封锁。美国人把咱们这套普惠AI叫做“AI共产主义”,说白了就是咱们只是把好模型卖了低价,让更多人用得起AI。
全世界的玩家都不傻,谁会跟性价比过不去,哪有那么多意识形态绑架,利益面前大家都用脚投票。现在中美AI对垒,中国赢面已经很大,我们也没硬来,都是美国企业自己选的,性能价格摆在这里,换你你会怎么选?
参考资料:新华网 全球人工智能产业发展观察