当地时间9月8日,美国国家安全局(NSA)、美国联邦调查局(FBI)和美国网络安全和基础设施安全局(CISA)联合发布网络安全通告,指称多家中国人工智能企业自至少2024年底以来,对美国前沿人工智能模型开展大规模知识蒸馏活动。
美方将相关活动描述为“工业规模”的模型蒸馏,并声称部分中国企业借此获取美国前沿模型的部分能力。美方通告共点名六家中国头部AI企业。
美方通告同时承认,知识蒸馏本身是人工智能研究中的合法技术。开发者通常利用能力更强的“教师模型”生成数据,再用于训练规模较小的“学生模型”。美国三部门此次将矛头指向其所谓具有“侵略性、恶意和针对性”的大规模蒸馏活动。
按照美方说法,相关中国企业通过数百万次交互,从Claude、GPT、Gemini、Grok等美国前沿模型获取数十亿词元(token),并将相关输出用于提升推理、软件工程、智能体、数学、写作和图像生成等能力。
美方通告分别列举了六家企业的相关活动。
美方声称,企业一自2024年底以来持续获取多个美国模型的推理、专业领域和智能体能力;企业二自2025年中期以来通过大规模交互获取监督微调、强化学习、软件工程和数学等能力;企业三至企业六则分别被指利用美国模型提升软件工程、客服对话、图像生成、智能体、代码开发和思维链推理等能力。美国三部门据此认为,这类活动已经超出普通研究、测试和正常模型调用的范围。
美方通告还将相关活动纳入网络安全框架。
按照美方指控,相关企业通过官方API、云服务商、第三方API聚合平台以及所谓“中转站”等渠道访问美国模型,并使用多个账号、共享订阅、代理服务和自动化路由系统分散请求。部分活动还被指涉及虚假账户、隐藏来源信息和清理请求元数据,以规避地域限制和平台监测。部分请求则被指用于诱导模型输出思维链或逐步推理过程,再将相关内容整理为合成训练数据。
美国三部门还声称,相关活动已经呈现组织化和自动化特征。美方通告称,同一主题下的请求量可能达到数千甚至数百万次,部分系统可以在一个访问渠道受到限制后切换至其他渠道,并根据价格、调用额度和模型性能调整请求路径。
美方三部门因此建议美国人工智能企业加强账号身份验证和异常请求监测,并加强模型企业、云服务商、API聚合商与美国政府机构之间的信息共享。
美国头部人工智能企业此前已经连续提出类似指控。2月23日,Anthropic声称发现三家中国人工智能企业通过约2.4万个所谓虚假账户,与Claude进行超过1600万次交互,并将相关活动称为“工业规模”的模型蒸馏。Anthropic还公开主张美国政府加强政策干预,并将模型蒸馏与对华芯片限制联系起来,认为蒸馏可以降低提升模型能力所需要的算力。
OpenAI也曾向美国国会提交材料,声称其观察到的大部分所谓“对抗性蒸馏”活动来自中国,并指称部分中国企业通过第三方路由等方式规避访问限制。9月8日,谷歌威胁情报团队也发布相关报告,称针对其模型的蒸馏活动规模持续扩大,部分活动涉及超过1亿次提示请求。美国头部模型企业围绕所谓中国企业模型蒸馏的公开指控,已经成为美方相关政策讨论的重要背景。
从美国以往处理所谓中国网络活动的做法看,联合网络安全通告有时会成为后续政策行动的一部分。
此次美方通告显示,美国政府开始把中国头部人工智能企业获取和训练模型能力的方式本身纳入国家安全框架。短期内,这种官方归因可能首先影响美国模型企业、云服务商和API平台对中国企业的账号管理、模型访问和服务政策。更长期看,美方对前沿模型能力、训练数据、模型输出和云端访问的政策关注可能继续上升。
今年7月,美国多名高级官员已经公开指称中国人工智能企业通过所谓大规模模型蒸馏获取美国前沿模型能力,并表示美方正在调查相关活动。9月8日,NSA、FBI和CISA进一步将相关指控扩展至六家中国人工智能企业,并系统披露其所谓模型访问方式和技术手段。从时间和内容衔接看,此次通告很可能是美方此前相关调查和政策关注的进一步公开化。
我国商务部7月27日已就相关问题作出回应。商务部表示,美方给中国企业扣上所谓依靠“蒸馏”“窃取美国知识产权”等帽子,缺乏事实依据和法理支撑。商务部同时指出,模型蒸馏是人工智能行业广泛应用的技术,美国人工智能企业在研发和训练中同样使用中国模型,并敦促美方停止对中国企业的抹黑和制裁威胁。对于实质性损害中方利益的行为,中方将采取必要措施维护自身正当合法权益。
https://media.defense.gov/2026/Sep/08/2003992823/-1/-1/1/CSA_CHINA_BASED_AI_COMPANIES_MALICIOUS_DISTILLATION_AGAINST_US.PDF

