大数跨境

美国紧张了?三大安全机构点名多家中国AI公司“模型蒸馏”

美国紧张了?三大安全机构点名多家中国AI公司“模型蒸馏” 出海湃
2026-09-12
42
导读:“蒸馏”本身并非意味着天然违法。

"于事无凭,于法无据"

撰稿|艾斯

审核|九哥

出品 | 出海湃


9 月 8 日,美国国家安全局(NSA)网络安全与基础设施安全局(CISA)联邦调查局(FBI)联合发布网络安全告警,称多家中国人工智能公司针对美国前沿模型开展“工业规模”的蒸馏活动


第二天,中国商务部新闻发言人回应称,美方所谓中国 AI 企业从事“工业规模”蒸馏美国模型的指控“于事无凭,于法无据”,并批评美方将正常技术和商业问题政治化、工具化。



随着大模型公司模型、API 和企业服务纷纷出海,这场争议已把一个原本主要属于训练方法争议的话题,推到跨境技术服务以及地缘政治的公开争端中。


根据美方公告的公开报道,DeepSeek月之暗面阿里巴巴、MiniMax、阶跃星辰和智谱(Z.ai)被点名。


美方称,这些企业通过大量请求,从 Claude、GPT、Gemini 和 Grok 等美国前沿模型中提取受限功能和能力;美方指控还涉及规避访问限制、批量调用和通过多个路径获取模型输出


“蒸馏”本身并非意味着天然违法。


在机器学习中,较强的“教师模型”可以生成输出,用于训练较小或较便宜的“学生模型”



但这是一种常见训练方法。美方此次的指控,则把争议放在是否经过授权、调用规模是否异常,以及是否绕过服务条款与访问控制上。


商务部在回应中也强调,蒸馏是 AI 领域模型相互学习的通行做法,本质上是一种中性技术手段,包括美国企业在内的全球模型企业都在使用。


所以说,中美双方的分歧,其实并不是围绕“是否可以蒸馏”,更多的还是集中在具体访问方式、授权边界和对事实的认定。


在美方告警之后,Claude 的母公司Anthropic 发布了 9 月威胁情报报告,给出它对部分中国 AI 实验室的更细致描述和指控。



对于阿里巴巴,Anthropic 称,关联运营者通过大量被其认定为虚假的账户访问 Claude,并试图获取推理过程,用于 Qwen 模型的训练与研发。Anthropic 称,其观察到的相关活动高峰接近每日 300 万次交互,并涉及 3500 多个账户。


对于月之暗面,Anthropic 称,月之暗面曾将部分用户请求转发给 Claude,再把回答呈现给原本以为在使用 Kimi 的用户;报告还称,月之暗面保存了至少一部分相关交互,用于提取推理痕迹和训练。


对于 DeepSeek,Anthropic 称,该公司使用了与月之暗面相似的跨会话方式来提取 Claude 的推理痕迹,并把部分用户请求转发给 Claude。



可以预见,中美两国作为世界 AI 研发领域的两级,这种指控或冲突必将是常态。


正在服务海外开发者和企业客户的中国模型公司而言,这场争议可能提高外界对数据路径、第三方路由和服务条款的各种询问频率,解释成本可能大大增加。


至于未来被指控的各大公司是否回应、美方是否还会披露更多技术材料,以及是否出现独立审计,甚至走向法律程序,这一切尚待观察。

END



出海数字媒体机构|记录出海浪潮中值得记录的人和事

Catalysts, Hustlers & Pathfinders

【声明】内容源于网络
0
0
出海湃
各类跨境出海行业相关资讯
内容 88
粉丝 0
出海湃 各类跨境出海行业相关资讯
总阅读8.2k
粉丝0
内容88