
新智元报道

自 8 月 2 日起,Anthropic 旗下 AI 模型 Claude 生成的所有文本将强制携带隐形水印。该水印嵌入于文本统计分布中,具备抗复制粘贴及部分编辑的特性。

此举旨在响应欧盟《AI 法案》第 50 条关于生成式 AI 内容透明度的合规要求。尽管法规仅约束欧盟市场,Anthropic 宣布将标记范围扩大至全球所有用户及产品线。

双层标记机制:文本隐写与文件签章
Anthropic 为 AI 生成内容构建了“文本 + 文件”的双重溯源体系。
第一层:不可见的文本统计水印
Claude 在 Token 生成阶段引入不可见的统计偏置,使输出文本的分布偏离自然概率。官方强调,该技术不影响文本的含义、质量或可读性。

此类水印内嵌于文本本体,不依赖外部元数据,随复制粘贴传播,且在经过部分编辑后仍可能被检测到。虽然具体算法未公开,但其原理区别于简单的词汇替换,更侧重于底层统计特征的修饰。
第二层:基于 C2PA 标准的文件溯源
针对 SVG、PNG、JPG 等文件格式,Claude 将附加符合内容来源与真实性联盟(C2PA)标准的数字签名。该签名不仅标识文件由 Claude 生成,还能检测文件是否遭到篡改。

两者覆盖范围有所差异:文本水印适用于所有模型输出;而 C2PA 元数据仅作用于支持的文件类型,且可能受云平台功能限制。Anthropic 计划向第三方提供检测工具,但相关技术文档尚未发布。
全球合规部署:五条产品线全覆盖
尽管欧盟《AI 法案》设有过渡期,Anthropic 选择采取更激进的全球合规策略。
标记功能覆盖 Claude Platform (API)、Claude 网页版、Claude Code、Claude Cowork 及 Claude Tag 五条核心产品线。通过 AWS、Google Cloud 及 Microsoft Foundry 接入的云客户,其文本输出同样适用水印规则。

时间节点方面,8 月 2 日后在欧盟上线的新模型必须即时支持标记;此前发布的旧模型合规截止日延至 12 月 2 日。违规者将面临最高 1500 万欧元或全球年营收 3% 的罚款。
技术局限与潜在争议
Anthropic 在文档中明确列出了水印技术的四重局限,以管理用户预期:
- 非原创证明:水印仅表明内容“可能经 Claude 处理”,若用户仅利用模型进行校对或格式转换,水印存在并不代表内容由 AI 原创。
- 检测失效场景:大幅改写、翻译、过短文本以及文件格式转换(如截图)可能导致水印衰减或元数据丢失。
- 质量权衡:学术研究指出,强鲁棒性的水印可能牺牲生成质量,尤其在模型置信度较低时更为明显。Anthropic 虽声称无影响,但缺乏公开验证。
- 元数据易移除:相比内嵌统计水印,外部的 C2PA 元数据更容易通过开源工具被剥离。

此外,付费用户无法关闭水印的功能引发争议,这可能促使部分对隐私和溯源敏感的用户转向无水印限制的开源模型。对于 API 开发者而言,需自行评估下游产品的法律合规责任。
行业标杆:首个大规模部署文本水印的主流厂商
Anthropic 成为首家在文本输出端大规模部署水印的主流 AI 公司,领先于谷歌 DeepMind 的 SynthID 及 OpenAI 的相关计划。
其承诺向第三方开放检测权限,意在构建透明的 AI 生态基础设施。然而,检测工具的精度、抗攻击能力及落地时间,将是验证该方案是实质性的透明度突破,还是仅仅是一份合规文书的关键。

