最近AI圈炸出个大瓜,美国财长贝森特亲自下场对着中国AI模型放狠话,说要是查到我们偷了他们的技术,直接上制裁大棒。这事说起来有意思,没证据没结论没名单,啥实锤都没拿出来,就先把棍子举得高高的。这葫芦里到底卖的什么药,咱们今天掰扯清楚。
这事的时间点很巧,刚好撞在中国月之暗面放出Kimi K3之后没几天。这款模型参数有2.8万亿,还支持百万级上下文窗口,开放权重免费给开发者用,不管是编程还是推理测试,成绩都相当能打。美国媒体自己都承认,这下中国开源模型和美国头部闭源模型的差距又缩小了一大截。
真正让美国AI圈坐不住的,根本不是Kimi K3榜单上的排名,是它的玩法和成本。美国头部AI公司砸几十亿美元建算力堆出来闭源模型,赚钱靠按调用次数收钱,门槛高得离谱。我们中国公司出的开源模型成本低得多,还允许开发者免费下载修改,普通开发者都能轻松上手用。这不等于直接动了人家的蛋糕,把人家高收费的商业模式根基给撬松了嘛。
贝森特接受采访的时候说,他们在中国不少模型里发现了美国大模型的所谓水印,直接把AI行业常用的模型蒸馏技术说成了偷窃。问题是,检测水印的方法是什么,涉及哪些具体模型,证据能不能过第三方的检验,这些关键信息半个字都没透露。财长亲自出来放话,拿不出一点可查的实锤,说白了就是先放出来吹风,给后续动作铺路呢。
这事也不是突然冒出来的,今年2月美国AI公司Anthropic就公开指控过月之暗面、DeepSeek和MiniMax三家中国公司。说他们用两万四千多个假账号,跟Anthropic的Claude模型交互了一千六百多万次,拿这些输出训练自己的模型,光月之暗面就有三百四十多万次交互。但这些数字全都是Anthropic自己检测出来的,至今也只是这家公司的单方面说法,美国法院和监管机构都没给出过法律认定。贝森特把企业之间的商业纠纷,直接拉到了国家制裁的层面,这里头的门道可就多了。
很多人搞不清,模型蒸馏是不是真的等于偷窃,这里得给大家说清楚。蒸馏本身就是AI行业很常用的技术,就是用性能强的“教师模型”生成答案,训练规模更小的“学生模型”,美国公司自己也天天用这套方法。争议点其实在于,有没有用假账号绕开访问限制,违反平台规则,大规模拿别人的成果。贝森特直接把蒸馏全算成偷窃,这明显是政治话术,不是对技术本身的定义。
有意思的是,不管是Anthropic还是贝森特,都没明说最新的Kimi K3就是偷了Claude的技术。也就是说,现在说美国已经查实Kimi K3偷技术,完全是扯淡,证据差着十万八千里呢。再说了,我们中国AI这些年的进步大家都看在眼里,美国芯片出口都卡死了,我们不也照样搞出了这么多性能不错的模型。说我们要靠偷才能做出来先进模型,这不是明摆着看不起我们中国工程师的本事嘛。
现在美国政府翻来覆去说的制裁手段,除了财政制裁,还有把中国AI企业拉进商务部实体清单,限制在美国运营,逼美国企业公开说自己用不用中国模型。但这些全都还在讨论阶段,连统一的政策都没定出来。美国政府内部也不是一条心,不是所有人都想干这事。一部分人跟着闭源模型公司喊要严打,另一部分科技圈人看得门清,这就是OpenAI和Anthropic借国家安全的名头,让政府帮他们干掉便宜的竞争对手。
硅谷的生意人和华盛顿的政客,本来就各有各的算盘,这里头裂缝大着呢。之前白宫就已经发过文件,说中国“工业化规模”获取美国AI技术,Anthropic也一直推着美国加严芯片管制,不让中国企业碰美国前沿模型,还想着立法把恶意蒸馏直接定成违法。这次贝森特出来发声,说白了就是美国AI企业的要求,已经进到政策层面了,开始动真格要搞事了。
更有意思的是这个时间线,美国这边刚放出制裁威胁,转头9月还要跟中国开第一次正式AI对话,贝森特还要带队参加呢。先把棍子甩你脸上,再坐下来谈规则,这套玩法咱们太熟悉了,之前中美贸易战科技战的时候,都玩过好多次了。之前的关税大棒,最后买单的是美国自己的企业和消费者,芯片禁令反而逼得我们中国半导体加速自主研发。现在换到AI领域,美国还想按老剧本走,能不能管用还真不好说。
其实贝森特这番话,已经把美国的底给漏出来了。之前美国靠先进芯片、大算力和闭源模型躺着拿领先优势,现在我们中国企业在各种限制下,靠着开源路线、工程效率和低成本追得飞快。美国企业靠技术追不上了,就找政府出手,想用制裁、名单这些非技术手段拦着我们。说白了就是,硅谷搞创新搞不过,就找华盛顿帮忙压人。
这场吵着什么偷窃的争论,本质上就是两种技术路线的竞争,被包装成了知识产权纠纷。美国闭源AI的高收费模式,在我们低成本开源模型面前已经顶不住了,企业需要政府出手帮他们清场抢市场。贝森特出来说这番话,既是帮美国企业堵竞争对手,也是给9月的中美AI谈判提前攒筹码。至于证据够不够硬,在政治和生意需求面前,本来就不是最重要的。
参考资料:环球时报 美财长称若证实中国AI模型窃密或实施制裁
热门跟贴