中国商务部:于事无凭、于法无据,必要时予以反制

来源 | 《财经》杂志 作者 | 《财经》研究员 樊朔 编辑 | 朱弢  

2026年09月10日 17:34  

本文3328字,约5分钟

与此前的原则性警告更进一步,此次美方首次由三个安全部门联合发布公告,点名六家中国AI企业,并详细描述其所谓蒸馏路径和操作方式

9月9日晚,中国商务部新闻发言人表示,美方所谓中国人工智能(AI)企业从事“工业规模”蒸馏的指控“于事无凭,于法无据”,是将人工智能领域正常的技术和商业问题政治化、工具化。商务部称,如果美方以打击蒸馏为名,采取遏制、打压中国人工智能企业的行动,中方将采取措施予以反制。

当地时间9月8日,美国国家安全局(NSA)、网络安全和基础设施安全局(CISA)和联邦调查局(FBI)联合发布一份网络安全公告,指称六家中国人工智能企业对美国前沿大模型开展“工业规模”的知识蒸馏。

这是美国安全部门首次以联合公告形式,将模型蒸馏这一行业通行技术做法定性为“恶意活动”。被点名的企业包括深度求索(DeepSeek)、月之暗面(Moonshot AI)、阿里巴巴、MiniMax、阶跃星辰(StepFun)和智谱(Z.AI)。

美方称,自至少2024年末以来,这些企业通过数百万次请求,从Claude、GPT、Gemini和Grok等美国前沿模型中获取了数十亿Token的输出,用于训练和改进自身模型。

蒸馏是指利用大模型生成的输出来训练规模更小的模型,以较低成本获得接近原模型的能力,是学界和产业界普遍采用的技术路径。当前争议的关键并不在于蒸馏技术本身,而在于通过API获取模型输出并用于后续训练,在什么情况下属于正常的模型学习?又在什么情况下会被认定为“恶意蒸馏”?

六家企业被指蒸馏“数十亿token”

联合公告称,DeepSeek等六家中国企业,“自至少2024年底以来”,通过数百万次交互请求,从Claude等美国前沿模型中提取了“数十亿token”的数据。公告称,蒸馏“不是这些企业模型研发的补充,而是关键核心”,并称相关活动“很可能是在中国政府知情的情况下”进行。

公告对每家企业给出了具体指控。其中,DeepSeek被指自2024年底起有组织地蒸馏Claude3.7、Claude Sonnet4、GPT-4o、GPT-5、Gemini2.5Pro、Grok 4等模型,用于训练其R1和V3模型,并称其公布的560万美元训练成本“具有误导性”,因为未计入“通过恶意蒸馏获取数据的真实成本”。

月之暗面被指提取Claude Fable5数据训练Kimi-K3模型、提取GPT-4o数据训练Kimi-K2模型。

阿里巴巴被指于2025年底蒸馏Claude4和GPT-5以改进通义千问(Qwen)系列模型;MiniMax被指蒸馏Claude Code、Gemini3Pro等改进其M2模型,甚至“使用提示词注入试图让Claude Code相信自己是MiniMax产品”;阶跃星辰被指蒸馏Claude Opus4.5、GPT-5.2等改进Step4模型;智谱则被指截至2026年年中蒸馏了“数十亿token”的GPT-5.5和Claude Opus4.8数据。

美国三机构进一步声称,这些活动并非普通用户调用模型,而是通过多账户、API代理、云平台和第三方聚合服务进行的大规模操作。公告特别提到一种被称为“transfer stations”的API灰色代理市场。按照美方描述,这类服务可以帮助使用者绕开模型公司的地域限制和账户控制;部分操作还包括批量购买高级订阅、多个开发人员共享账户、自动切换访问路径,以及利用提示词注入或越狱方式获取模型的推理过程。

基于此,三机构向美国AI企业提出三项建议:实施全面的异常检测与缓解;对疑似恶意蒸馏请求“悄悄改变响应”,例如以降低推理深度、切换降级模型等方式回应,且“避免告知”被怀疑的蒸馏方;建立跨组织情报共享机制,打通模型厂商、云平台与API聚合商之间的数据。

中国商务部:必要时将坚决反制

9月9日,中国商务部新闻发言人就上述公告回应称,美方有关中国人工智能企业开展“工业规模”蒸馏的指控“于事无凭,于法无据”,实质上是将人工智能领域正常的技术和商业问题政治化、工具化。

商务部认为,蒸馏本身是不同模型之间相互学习的通行技术手段,包括美国企业在内的全球模型企业均有使用,有助于提高模型训练效率和知识利用效率。

中方同时将美方做法概括为“双重标准”:一方面,中国开源模型向全球开发者开放,美国企业也曾披露使用中国模型进行蒸馏;另一方面,美方却将中国企业类似做法定义为“攻击行为”。

商务部发言人称,美国由国家安全局等安全部门出面发布公告,相当于将个别企业的商业利益与国家安全相捆绑,并质疑部分美国AI企业利用市场优势,在用户协议中设置宽泛的地域限制,美方有关“违规蒸馏”的指控存在为这些商业规则背书之嫌。

商务部还认为,美方做法是典型的动用国家力量维护科技霸权和算力垄断,打压竞争。今年以来,美国行政、立法机关频频发出对中国企业蒸馏行为的制裁打压威胁,其目的是打压竞争,维护美在算力、数据方面的垄断,只能美国独赢,不能人类共赢,将本应公开公平获取的全球人工智能资源变成少数企业的独占资源,阻止他国参与人工智能创新成果的普惠共享。

中方表示,中美两国元首已同意开展人工智能政府间对话,中方愿意以平等互利、合作共赢原则,通过对话与美方开展建设性和专业的讨论。但如果美方以打击蒸馏为名,实施遏压中国人工智能企业的行动,中方必将坚决采取措施予以反制。希望美方与中方相向而行,通过对话和沟通管控风险,推动人工智能产业惠及全球。

大模型蒸馏争端酝酿已久

2025年1月,DeepSeek-R1发布并引发全球关注后,OpenAI曾向媒体表示,发现DeepSeek可能利用其专有模型输出训练自身模型,相关争议由此指向蒸馏技术。此后,蒸馏逐渐成为美国政府和AI企业审视中国模型公司的重要议题。此次美国三部门联合公告所列参考材料,包括白宫《对抗性蒸馏美国AI模型》备忘录(NSTM-4)、Anthropic关于识别和防范蒸馏攻击的报告、OpenAI提交美国政府的政策文件,以及谷歌威胁情报团队的相关报告。

2026年4月23日,白宫科技政策办公室发布《美国人工智能模型的对抗性蒸馏》备忘录,称美国政府掌握的信息显示,部分外国实体,尤其是中国相关主体,正通过代理账户、越狱等方式,对美国前沿模型实施“工业规模”蒸馏。文件要求美国政府加强与AI企业的信息共享,推动企业间协同防范,并研究追究相关外国主体责任的政策工具。2026年6月,美国政府又通过国家安全总统备忘录进一步将相关议题纳入国家安全框架,要求国家安全局等机构与美国私营AI企业建立合作机制,通过共享威胁情报、联合红队测试和模型安全研究等方式,防范所谓“恶意蒸馏攻击”。

此次美国三部门联合发布公告,则在此前政策上更进一步,将原本笼统指向“外国实体”或“中国企业”的风险判断,具体落实到六家中国AI企业,并披露美方认定的相关模型、调用方式和技术路径。

2026年7月,美国财政部长贝森特、贸易代表格里尔等官员公开表示,美方将调查中国AI企业是否通过蒸馏方式获取美国前沿模型能力,并讨论以“窃取美国知识产权”等理由采取制裁措施。

对此,中国商务部新闻发言人7月27日曾回应称,美方有关做法“缺乏事实依据,没有法理支撑,在实践上搞双重标准”,并指出美国AI企业在研发和训练过程中同样使用过中国模型。商务部同时援引美国业界意见称,近200家美国初创企业曾呼吁美国政府不要限制获取中国开源模型,一些大型跨国企业也认为,模型蒸馏属于行业普遍采用的技术路径,不应禁止美国企业使用中国开源模型。

216.73.217.37