打开网易新闻 查看精彩图片

陈柏珲 亚洲数字经济科学院院长

熊 伟 亚洲数字经济科学院助理研究员

7月24日,美国多家科技企业联署并发布《开放权重与美国人工智能领导力》文件。微软、英伟达、OpenAI、Meta、IBM、Hugging Face等企业和机构均出现在名单中。这份文件表面上是在讨论模型开放,实际上更像一份产业路线图。签署者担心的是:如果华盛顿以国家安全为名,限制开放权重模型,美国可能先失去的不是技术领先地位,而是AI在本土经济中的普遍使用。

在地球的另一端,中国月之暗面7月27日发布Kimi K3完整模型权重。一场围绕前沿AI能力应否开放、由谁控制的争议,已经在模型正式公开前升温。

AI产业正面临发展路线之争

美国科技企业这次站出来,并不意味着它们突然拥抱了技术理想主义。不同企业有不同的现实利益。

英伟达希望更多模型被训练、部署和运行,因为这直接带来GPU、服务器和推理基础设施需求。微软面对的则是企业客户:这些客户不愿把所有数据、工作流程和模型能力都交给单一API。Meta、Mistral和Hugging Face受益于开放模型生态,而IBM、Palantir等企业软件和系统服务商,也需要把AI部署到政府、金融、医疗和国防等对数据控制要求较高的领域。

各科企共同担心的是,如果「开放权重」被整体定义为安全威胁,先进AI能力就会集中到OpenAI、Anthropic等少数闭源公司手中。企业客户将失去选择,API成本和供货商锁定问题会加重,初创企业与大学实验室的创新空间也会受到挤压。

因此,这份文件反对的并不是追究非法技术窃取,而是把开放权重本身变成监管对象。文件提出,美国的AI领导力不应只用某一个模型的性能来衡量,更要看先进能力能否进入工厂、医院、学校和政府系统。

这是一种重要的竞争观变化。AI竞争不再只是比较谁的模型排名第一,也要比较谁的模型更容易被开发者采用、更便宜地运行,以及谁掌握芯片、云服务、开发工具和应用生态。

Kimi K3在Frontend Code Arena上的表现引起关注。公开排名显示,它在多个前端编程类别中超过了Anthropic的Fable 5。

不过,单一排名不能代表模型的全部能力。测试样本、提示词、工具调用方式和模型版本都会影响结果。K3在某些任务上领先,并不等于它已经全面超越美国闭源模型。K3的意义更在于它所代表的方向。

根据月之暗面官方资料,Kimi K3拥有约2.8万亿总参数和100万Token上下文窗口,采用Kimi Delta Attention、Attention Residuals以及稀疏混合专家架构。模型通过稀疏路由设计,每个Token只激活896个专家中的16个,以降低实际运行成本。

这里还需要区分「开放权重」和「完整开源」。开放权重意味着模型参数可以被下载、部署和修改,但训练数据、训练代码和完整开发过程未必公开。即便如此,K3仍然动摇了两个旧判断:开放模型未必只能靠低价竞争,中国模型也未必只能停留在追赶位置。

如果高性能模型可以被下载、部署并由不同开发者继续修改,它的影响就不会停留在开发公司内部。它可能进入云平台、企业服务器、大学实验室和边缘设备,形成不依赖单一公司的开发网络。模型一旦可以被下载,美国政府面对的就不再只是一家公司,而是一批可以自行运行和修改模型的开发者。

美国借口「蒸馏」施制裁欠理据

「蒸馏」本身是AI行业常用的训练方法。Anthropic在今年2月的声明中也承认,蒸馏可以把大型模型的能力转移到更小、更便宜的模型中;但该公司同时指控DeepSeek、月之暗面和MiniMax利用约2.4万个虚假账户,与Claude进行超过1,600万次互动,以提取模型能力。

因此,争议不应简单归结为「蒸馏是否合法」,而要追问几个更具体的问题:访问是否获得授权,是否使用虚假账户或绕过地区限制,相关输出是否被大规模用于训练竞争模型,以及这些行为是否违反合同或侵犯知识产权。

美国白宫科技政策办公室主任克拉齐奥斯指控,月之暗面为大规模蒸馏美国模型建立了复杂平台;财政部长贝森特也表示,若确认涉及工业级技术窃取,美国可能考虑制裁。

但在公开层面,目前仍主要是美方指控、月之暗面否认以及专家质疑,外界还看不到一条可以独立复核的完整证据链。

时间线也值得注意。Fable 5于6月9日发布,6月12日因美国政府的出口管制指令暂停访问,7月1日重新开放;Kimi K3则在7月中旬发布。在这么短的时间内完成大规模访问、蒸馏、训练、测试和发布,确实存在技术疑问。

在现有公开材料下,制裁仍需要更充分的证据支持。真正有价值的材料,应当包括访问日志、账户关联、请求模式、输出指纹和独立复现实验,而不是政治人物的公开指控或社交媒体上的模型对比。

模型传播势头不可阻挠

美国现在面对的难题,不是要不要开放,而是开放之后还能控制什么。

闭源模型的控制逻辑很清楚:开发者可以更新安全策略、追踪用户、关闭账户,必要时撤回服务。开放权重模型一旦发布,控制权就会转移到下载者手中。只要拥有足够算力,任何机构都可以在自己的服务器上运行模型,甚至修改原有的安全机制。

因此,美国政府未来能够直接施加影响的,主要是模型外围环节:芯片和服务器、云服务和数据中心、模型托管平台、企业采购以及供应链合规。

Axios披露,美国政府内部曾讨论实体列表、政府采购限制、网络安全警告,以及要求美国企业对托管中国模型承担安全责任等方案。

这些措施可以提高使用成本,却很难真正删除一个已经进入全球网络的模型。模型不像一批芯片,无法在边境被扣下;它更像一段已经被复制出去的代码,限制发布者并不等于能够收回所有副本。这正是开放权重与传统出口管制之间的差别。美国可以限制算力和服务器,却很难完全限制模型在全球范围内继续传播。

AI使用规则必须跟上模型开放。开放权重不会天然带来安全,它可以让更多研究人员参与审计、测试和漏洞修复,也可能让恶意使用者移除安全限制、复制模型并扩大攻击能力。

更现实的做法,是把技术开放与责任追踪分开处理。正常的模型研究、评估和经授权蒸馏应当继续进行;虚假账户、绕过访问限制和非法提取则应受到追究。前沿模型也应披露技术报告和风险边界,高风险应用则需要接受第三方测试和部署审计,责任应当更多落在访问方式、部署场景和实际伤害上,而不是简单按照模型国籍进行封锁。

来源:文汇评论