虎嗅

美国指控中国AI“工业规模蒸馏”:这不是知识产权战,是准入战

深度拆解:美国指控中国AI“偷师”,到底在争什么?

大家好,我是你们的财经记者兼经济学者。今天我们要聊一件看似“技术流”,实则“政治味”极浓的大事。

9月8日,美国国家安全局(NSA)、网络安全与基础设施安全局(CISA)和联邦调查局(FBI)三家“大佬”联合发了一份通告,点名DeepSeek、月之暗面、阿里巴巴等六家中国AI公司,指控它们搞“工业规模”的知识蒸馏,说白了就是“大规模偷师”美国顶尖AI模型的能力。

中国商务部回应得很硬气:“于事无凭,于法无据。”外交部更是直接说,这是中国科技自立自强的成果。

很多非专业人士可能会问:“蒸馏”是个啥?美国为什么突然对“学习”这件事这么生气?这背后到底藏着什么猫腻?

别急,咱们把这篇新闻揉碎了,用大白话给你讲清楚。

---

一、 什么是“知识蒸馏”?为什么美国觉得这是“偷”?

首先,我们要搞懂这个被指控的核心技术——知识蒸馏(Knowledge Distillation)。

你可以把它想象成“老师教学生”。

  • 传统训练:就像老师指着图片说“这是猫,这是狗”。学生死记硬背。
  • 知识蒸馏:老师不仅告诉你这是猫,还告诉你“我觉得它有80%像猫,15%像狗,5%像狐狸”。这种细微的、概率性的判断,叫“软标签”,里面藏着老师对世界关系的深刻理解(也就是所谓的“暗知识”)。

关键点来了:

1. 这是通用技术:蒸馏不是中国发明的,2015年诺贝尔奖得主Hinton就提出了这个概念。全球所有做AI的公司,包括美国巨头,都在用。

2. 合法 vs. 违规:如果你买了我的书,自己读,这是合法的。但如果你通过我的API接口(相当于我的在线问答服务),疯狂提问,把我的回答拿去训练你的模型,这就涉及违反用户协议的问题。

美国为什么急?

美国认为,中国公司不是在做正常的研发,而是通过“数百万次交互”,把美国顶尖模型(如Claude、GPT系列)的能力“吸”走了。

美国人的逻辑是:“你用比我少得多的钱和算力,靠‘抄作业’(蒸馏)追上了我的水平,这条路我不让你走了。”

这就好比:你花大价钱研发了一款独家配方,结果对手没去研发,而是天天去你家餐厅点菜,尝味道,然后回去复刻。虽然没偷你的锅,但确实“偷”了你的味道。

---

二、 美国的指控细节:从“物理封锁”到“知识封锁”

这次通告(AA26-251A)非常具体,甚至可以说是“实锤”式的指控。让我们看看美国掌握了什么“证据”:

1. 规模巨大:指控称中国企业进行了“数百万次”模型交互,获取了“数十亿个token”(可以理解为海量的数据量)。

2. 手段隐蔽:

  • 不仅用官方API,还通过第三方平台、代理渠道(Transfer Stations)访问。
  • 批量购买高级账户,多人共享,自动切换渠道以规避检测。
  • 甚至被指控“污染下游训练数据”——即故意给模型喂被干扰的数据,看对方反应。

3. 目标明确:被“蒸馏”的对象包括Anthropic的Claude系列、谷歌的Gemini系列、OpenAI的GPT系列以及xAI的Grok系列。

4. 能力提取:不仅仅是基础对话,还专门提取了法律专业能力、逻辑推理、智能体功能等高价值能力。

深层逻辑:封锁线的延伸

  • 2022年:禁芯片(物理入口)。
  • 2023年:禁光刻机(制造入口)。
  • 2026年(现在):禁模型输出(知识入口)。

美国发现,堵住了硬件,中国还能靠开源和算法优化追赶。现在,美国要堵住“知识流动”。芯片是身体,模型能力是灵魂。美国不想让中国AI“灵魂”里带有美国技术的影子,或者更准确地说,不想让中国通过低成本方式获得美国的高价值技术成果。

---

三、 中方的反击:这不是“偷窃”,是“合同纠纷”

面对指控,中方的回应非常冷静且有力,核心逻辑有三层:

1. 技术中性论:蒸馏是业内通行做法,不是中国独有。美国企业自己也在蒸馏中国开源模型(比如很多美国初创公司基于Llama或Qwen做微调)。你指责我,你自己也在干,这是双重标准。

2. 法律定性论:

  • 美方视角:这是“窃取知识产权”,是刑事犯罪,所以要动用国家安全机构。
  • 中方/法律界视角:蒸馏并不直接复制代码或原始训练数据,它模仿的是“知识形态”。这在法律上很难构成版权或专利侵权。最可能的法律基础是“违反服务条款”(合同违约)。
  • 区别巨大:违约是民事纠纷,赔钱就行;窃取知识产权是刑事犯罪,要坐牢。美方把“违约”包装成“犯罪”,是为了给后续制裁找借口。

3. 商业垄断论:美国企业通过用户协议设置“霸王条款”(如禁止用于训练竞品),然后由国家安全部门来“背书”执行。这本质上是用国家强权保护商业垄断。

一句话总结:中方认为,这是美国巨头为了维持市场垄断,把商业竞争上升为国家安全问题。

---

四、 时机与筹码:峰会前的“亮刀子”

这件事发生的时间点非常微妙:距离中美元首华盛顿峰会不到三周。

在国际谈判中,有一个经典战术叫“亮刀子”(Show the Knife)。

  • 动作:在正式谈判前,先展示强硬姿态,把筹码堆到最高。
  • 目的:

1. 试探底线:看中国会不会在AI领域做出让步。

2. 制造压力:让中国在谈判桌上感到压力,从而在其他领域(如贸易、地缘政治)做出交换。

3. 国内政治:向美国国内选民和国会展示“我们在保护美国科技优势”。

中方的回应也留了余地:“愿意对话”,但“如果实施遏压,必将反制”。

这说明双方都不想彻底撕破脸,但谁也不愿意先退让。这是一场“边打边谈”的博弈。

---

五、 未来影响:AI生态的“铁幕”落下?

这才是这件事最深远的影响。

1. 对“蒸馏”路线的打击

对于还在依赖美国模型API进行蒸馏训练的中国AI公司来说,这是一个红色警报。

  • 风险:未来美国可能会通过立法,将“模型输出”纳入出口管制。一旦实施,调用美国API训练模型可能被视为“非法获取受控技术”。
  • 结果:这条路可能走不通了。不是因为技术不行,而是因为政治和法律上不让走了。

2. 加速“脱钩”与“独立栈”

  • 国产替代加速:中国AI公司将被迫加速使用国产算力(华为昇腾等)和国产基础模型(如Qwen、DeepSeek、GLM等)进行训练。
  • 开源生态独立:中国可能会推动建立独立于美国技术栈的开源模型生态,避免被“卡脖子”。
  • 数据投毒风险:美国建议的“污染下游训练数据”意味着,即使你还能访问API,得到的数据也可能是“有毒”的,导致你的模型性能下降。这将迫使企业彻底切断对美国模型的依赖。

3. 全球AI格局分裂

如果美国真的把“模型能力”当作战略资源进行封锁,那么全球AI将分裂为两个阵营:

  • 美国阵营:闭源、高壁垒、高成本、高利润。
  • 中国阵营:开源、低门槛、高性价比、快速迭代。

结语

AA26-251A通告不仅仅是一份网络安全文件,它是中美AI竞争从“技术战”转向“规则战”和“生态战”的标志。

蒸馏本身是个技术问题,但这次事件告诉我们:在科技领域,没有纯粹的技术问题,只有地缘政治问题。

对于普通人来说,这意味着未来我们使用的AI产品,可能会因为“出身”不同,而呈现出完全不同的发展路径和限制。而对于中国AI行业来说,这是一次痛苦的“断奶”过程,但也是走向真正独立的必经之路。

记住:当对手开始封锁你的“知识入口”时,你就必须学会自己“造血”了。