"于事无凭,于法无据"
撰稿|艾斯
审核|九哥
出品 | 出海湃
9 月 8 日,美国国家安全局(NSA)、网络安全与基础设施安全局(CISA)和联邦调查局(FBI)联合发布网络安全告警,称多家中国人工智能公司针对美国前沿模型开展“工业规模”的蒸馏活动。
第二天,中国商务部新闻发言人回应称,美方所谓中国 AI 企业从事“工业规模”蒸馏美国模型的指控“于事无凭,于法无据”,并批评美方将正常技术和商业问题政治化、工具化。
随着大模型公司模型、API 和企业服务纷纷出海,这场争议已把一个原本主要属于训练方法争议的话题,推到跨境技术服务以及地缘政治的公开争端中。
根据美方公告的公开报道,DeepSeek、月之暗面、阿里巴巴、MiniMax、阶跃星辰和智谱(Z.ai)被点名。
美方称,这些企业通过大量请求,从 Claude、GPT、Gemini 和 Grok 等美国前沿模型中提取受限功能和能力;美方指控还涉及规避访问限制、批量调用和通过多个路径获取模型输出。
“蒸馏”本身并非意味着天然违法。
在机器学习中,较强的“教师模型”可以生成输出,用于训练较小或较便宜的“学生模型”。
但这是一种常见训练方法。美方此次的指控,则把争议放在是否经过授权、调用规模是否异常,以及是否绕过服务条款与访问控制上。
商务部在回应中也强调,蒸馏是 AI 领域模型相互学习的通行做法,本质上是一种中性技术手段,包括美国企业在内的全球模型企业都在使用。
所以说,中美双方的分歧,其实并不是围绕“是否可以蒸馏”,更多的还是集中在具体访问方式、授权边界和对事实的认定。
在美方告警之后,Claude 的母公司Anthropic 发布了 9 月威胁情报报告,给出它对部分中国 AI 实验室的更细致描述和指控。
对于阿里巴巴,Anthropic 称,关联运营者通过大量被其认定为虚假的账户访问 Claude,并试图获取推理过程,用于 Qwen 模型的训练与研发。Anthropic 称,其观察到的相关活动高峰接近每日 300 万次交互,并涉及 3500 多个账户。
对于月之暗面,Anthropic 称,月之暗面曾将部分用户请求转发给 Claude,再把回答呈现给原本以为在使用 Kimi 的用户;报告还称,月之暗面保存了至少一部分相关交互,用于提取推理痕迹和训练。
对于 DeepSeek,Anthropic 称,该公司使用了与月之暗面相似的跨会话方式来提取 Claude 的推理痕迹,并把部分用户请求转发给 Claude。
可以预见,中美两国作为世界 AI 研发领域的两级,这种指控或冲突必将是常态。
对正在服务海外开发者和企业客户的中国模型公司而言,这场争议可能提高外界对数据路径、第三方路由和服务条款的各种询问频率,解释成本可能大大增加。
至于未来被指控的各大公司是否回应、美方是否还会披露更多技术材料,以及是否出现独立审计,甚至走向法律程序,这一切尚待观察。
END
出海数字媒体机构|记录出海浪潮中值得记录的人和事
Catalysts, Hustlers & Pathfinders

