你敢信吗,中国AI一开源,好几个国家就立马掏出了自家“全新自研”的大模型,说性能已经追上甚至超过中国了。这事儿最先炸出来的是印度和韩国,两边一前一后开了发布会,吹得那叫一个热闹,各路媒体都跟着喊“AI自主突破”,结果不到一天就翻了车。
印度那边俩初创公司抢着发新品。一家叫萨尔瓦姆AI的,直接扔出来两个大模型,参数分别是300亿和1050亿,张嘴就说自己多项测试比中国DeepSeek R1还强。另一家叫169PI的也跟上,搞了个320亿参数的阿尔皮,说数学推理能力都压过DeepSeek V3一头。
韩国这边动静更大。LG直接扔出个7500亿参数的K-EXAONE 2.0,说是韩国有史以来最大的自研大模型。SK电讯同期也发了A.X K2,参数也有6880亿。
当时全网都在吹印韩AI崛起,说一下子就摸到和中国平起平坐的门槛了。结果这热闹连一天都没撑住,技术圈的网友就开始扒代码,越扒越尴尬。
169PI的阿尔皮,压根不是从零训练的,就是拿中国DeepSeek-R1和千问-32B做了蒸馏微调,换个名字就敢叫自研。萨尔瓦姆的模型架构,也被扒出来大量借鉴了DeepSeek的MoE设计,说白了就是DeepSeek的换皮作品。本来就是在原版基础上改,测试分高点也没什么可吹的。
韩国的情况也没好到哪儿去。LG和SK的模型参数堆得高,韩语测试成绩确实好看,拉到24项全球通用基准一测,平均分远不如DeepSeek同代模型。之前韩国政府办的国家级AI竞赛,五个入围队里三个的代码都和中国开源模型高度雷同,有的文件里还留着智谱和千问的版权标识没删干净。
这种套壳自研的操作,根本不是印韩独有,最近两年在全球AI圈都快成固定流程了。今年6月巴西里约热内卢市政府旗下的IT公司,发了个叫Rio 3.5的模型,吹成“里约之光”,说拿了多项测试的顶尖成绩。结果发布不到一天就被扒出来,就是中国Nex N2 Pro和阿里千问Qwen-3.5缝起来的。更搞笑的是,你把提示词里的“你是Rio”删掉,百分之七十九的概率它会自己说“我是Nex”。
今年三月日本科技巨头乐天,发了自家首款大模型Rakuten AI 3.0,吹得更凶,说是日本最大最强的自主国产AI,参数有七千亿。结果上线才十二个小时,就被发现核心架构全来自中国的DeepSeek-V3。更过分的是,乐天宣传里半个字都没提DeepSeek,还偷偷把MIT开源许可证给删了,连个署名都不想留,就想把中国技术的痕迹全抹干净。
为啥这么多国家都喜欢这么干呢?说穿了就是性价比摆在这里,中国开源模型的便宜好用,实在让人没法拒绝。DeepSeek的输入成本,每百万tokens才0.19到1.74美元,输出也就0.51到5.4美元。OpenAI的GPT同类产品,输入就要5到12美元,输出更是30到54美元,贵了快十倍。
很多普通基础任务,用美国贵价模型就像在市中心堵车开跑车,纯纯浪费资源。中国模型只需要十分之一的成本,就能做到接近顶尖闭源模型九成的能力,对全球中小开发者和发展中国家来说,这不选中国模型才奇怪。
除了便宜,更关键的是中国大模型基本都开源。企业想下就下,改完就能直接部署到自己本地服务器,数据全攥在自己手里。很多外国企业怕自家数据流出去,这种数据不出境的方案,可比用美国公司的闭源云服务安全太多了。
就拿印度来说,现在就挺有意思。政府一边砸大钱喊着要搞印度自研AI,吹技术主权,一边本土企业偷偷用了一堆中国开源模型。对印韩这种AI底子没那么厚的国家来说,技术主权是必须讲的政治故事,韩国政府砸了五千三百亿韩元搞国家级AI竞赛,就是想搞纯韩国血统大模型,挤进全球AI前三。印度也天天喊自主,要摆脱对外国技术的依赖。
短期内研发能力跟不上宣传的胃口,套壳换皮就是最省事的捷径。既能给国内民众交差,又能去资本市场讲故事,轻轻松松就能套来几十上百倍的估值,稳赚不赔的买卖谁不做。
很多人把这当成笑话看,其实这事对中国AI来说反倒是好事。中国AI企业爱走开源路线,本来就是冲着做生态去的,AI这个领域,生态吸引力比单点性能重要多了。模型越开放,用的开发者越多,攒出来的应用工具插件就越丰富,护城河也就越深。
DeepSeek创始人就说过,开源本身就是护城河,能把一个模型变成没人能替代的生态系统。而且中国企业的开源,本来就和国家的发展方向合得上,给全球尤其是发展中国家提供性价比高、能自己部署的AI方案,本来就是给全世界提供公共产品。用的人越多,中国AI在全球的基础设施地位就越稳。
现在这局面说白了,就是中国AI已经从追赶者变成了引领者,从被制裁的对象,变成了全球开发者绕不开的基础底座。印韩政府该喊口号还是会喊,本土企业该套壳还是会套壳,喊完口号转头还是得用中国模型。商业现实从来比政治叙事实在,在实打实的技术领先和性价比面前,那些花里胡哨的口号根本站不住脚,最终赢的还是做好生态的玩家。
参考资料:新华网 全球人工智能产业发展态势分析