美国联邦调查局、国家安全局和网络安全及基础设施安全局联合警告说,包括深度求索(DeepSeek)、月之暗面和阿里巴巴在内的六家中国人工智能公司,涉嫌通过大规模“知识蒸馏”(knowledge distillation)提取美国先进模型的能力,以降低自身模型的研发和训练成本。

三家机构星期二(9月8日)发布的18页联合网络安全公告说,这些行动至少从2024年底持续至今,涉及数百万次交互或请求,以及从Claude、ChatGPT、Gemini和Grok等美国前沿模型取得的数十亿词元。
被公开点名的六家公司分别是深度求索、月之暗面、阿里巴巴、MiniMax、阶跃星辰和Z.AI。Z.AI的运营实体是北京智谱华章科技有限公司,通常也被称为智谱AI。
美方称,这些中国企业正在“以工业规模开展具有攻击性、恶意和针对性的蒸馏活动”,而且有关行动“很可能是在中国政府知情的情况下”进行。
中国外交部星期三否认美方指控。发言人毛宁说,中国人工智能的发展来自“高水平科技自立自强”,并敦促美国停止对中国进行“虚假指控和抹黑”。
这是首次由美国情报、执法和网络安全机构联合详细列出中国企业的名称、目标模型和操作方法,但公告没有说明中国政府具体如何参与,也没有公开可供外界独立核查的完整账户记录、服务器日志或其他底层证据。
美国国家安全局(National Security Agency)和美国联邦调查局(Federal Bureau of Investigation)等安全机构周二指控六家中国人工智能(AI)企业系统性地利用美方AI模型训练自家系统,并称这些中国公司开展了“工业规模般激进、恶意且有针对性的蒸馏活动”。
这里的关键词是“蒸馏”。通过这项技术,新的AI模型能够汲取现有模型的专业知识。美国总统特朗普(Trump)本月将与中国领导人习近平举行会晤,本文将梳理“模型蒸馏”这一问题,并探讨其将如何影响美中两国对AI主导地位的争夺。
什么是蒸馏?
不妨先从构建AI模型的基础说起。Anthropic和OpenAI等开发者会从互联网和书籍中收集所能找到的一切素材,再把这些素材投进一个带有复杂数学演算法的“大搅拌机”,进而构建出模仿人脑的神经网络。该网络通过具备不同权重参数的节点连接来建立词语之间的关联。如此训练出的模型就能通过逐词串联,生成读起来自然流畅的句子。
完成初始训练后,模型就像一个读遍了所有数学教材的学生,却从未有人教过它如何自然地探讨数学或解答问题。这个原始模型需要向专家拜师学艺,才能打磨出真正的能力。通常情况下,人类专家会向模型抛出问题并提供理想答案,或者对模型的回答进行评分和指导,直到它能作出恰当回应。
为了辅助人工并降低成本,AI工程师会向AI“教师模型”输入提示词,让其回答问题并解释其答案。随后,工程师利用这些由“问题-答案-推理过程”组成的数据集来微调“学生模型”并调整其权重。这种利用现有模型微调新模型的过程就被称为蒸馏。

中国AI开发者是否在蒸馏美国模型?
美国安全机构称,这些中国公司与包括Claude、ChatGPT、Gemini和Grok在内的美国前沿模型进行了数百万次交互。
蒸馏对中国有多大帮助?
今年7月,Anthropic的一位高管表示,蒸馏技术已帮助中国将与美国的差距从12到18个月缩短至大约6到9个月。美国安全机构则指出,从中国相关活动的规模来看,蒸馏已成为中国AI发展的“关键核心”,而非只是辅助手段。
中方对此持不同看法。受指控的公司未直接否认使用过蒸馏技术,但总部位于北京的月之暗面(Moonshot AI)一位高管在公司7月发布Kimi K3后告诉当地媒体,这款模型之所以能取得“突破性表现”,靠的是基础创新,而非蒸馏或抄袭。中国外交部一名发言人周三表示,美国应停止对中国进行不实的指责和抹黑。
包括OpenAI高管迪安·鲍尔(Dean Ball)在内的一些美国研究人员认为,在AI竞赛的早期阶段,蒸馏技术或许助了中国公司一臂之力,但这并非它们近期取得进展的主要原因。蒸馏算窃取吗?各方都认同,某些类型的蒸馏本身并无不妥。例如,像苹果公司(Apple)这样的企业会蒸馏自家模型,以生成可在智能手机上运行的精简版本。此外,对开放权重模型进行蒸馏也被广泛接受,这类模型通常可以免费下载和修改。当AI开发者蒸馏像Claude这样的封闭模型时,问题就变得更加棘手。一些法律专家认为,单就行为本身而言,这种蒸馏可能还构不上偷窃。他们表示,AI模型的输出内容不太可能被视为类似于书籍或电影的知识产权。即使被视为知识产权,蒸馏者也没有直接复制这些输出,而仅仅是拿来学习,就像一个有抱负的作家阅读书籍一样。
但美方称,中方的蒸馏手段属于非法行为。Anthropic今年2月曾表示,中国公司使用“虚假账号和代理服务大规模访问Claude,同时规避系统侦测”。
美国政府正采取何种应对措施?美国财政部长斯科特·贝森特(Scott Bessent) 7月份曾暗示,美国可能会将中国AI公司列入黑名单,以此作为惩罚。
“当中华人民共和国的企业进行隐蔽的、工业规模的蒸馏攻击,并越界构成知识产权盗窃时,制裁和列入实体清单都将提上日程,”贝森特在X平台上写道。

一名员工用镊子调整印刷电路板上的微芯片和电子元件。图片来源:Tingshu Wang/Reuters
上述美国安全机构呼吁企业和政府加强合作,共同防范大规模蒸馏行为,但未探讨针对中国的具体制裁措施。
美国公司能否起诉中国竞争对手?Anthropic的服务条款禁止中国公司使用Claude,其他美国公司也制定了类似规定。部分公司在用户政策中宣称,严禁出于开发竞品模型的目的进行蒸馏。
一些担任AI公司顾问的律师表示,美国公司可以起诉中国竞争对手违反服务条款。美方企业可以辩称,由于蒸馏技术让中国对手得以用更低的成本开发出极具竞争力的模型,这种行为实质上损害了美国公司的销售利益。
然而,收集确凿证据绝非易事,在中国公司借助海外中间方进行蒸馏的情况下更是如此。这些律师同时指出,在一个技术迭代快得惊人的行业里,陷入旷日持久的法庭拉锯战几乎没有任何好处。
蒸馏争议会有何影响?定于9月下旬在华盛顿举行的习特会可能会涉及AI议题。如果贝森特兑现他将中国公司列入黑名单的威胁,美国及其他地区的用户可能会发现自己无法访问中国模型。美方的制裁或诉讼也可能对中国开发者造成伤害。
英伟达(Nvidia)和微软(Microsoft)等公司在7月份的一封公开信中发出警告,呼吁不要“对在AI创新中发挥重要作用的技术实施一刀切的限制”。信中还称,任何非法的蒸馏行为“都应通过有针对性的法律和商业框架来解决”。