文|南都记者 樊文扬
8 月 11 日,Anthropic 发布官方声明称,自 8 月 2 日起推出的新一代 Claude 模型将默认启用 AI 生成内容标识功能。所有生成的文本将被嵌入隐形水印,图片等文件则附加经数字签名的溯源元数据。此举旨在落实欧盟《人工智能法案》第 50 条关于 AI 生成内容透明度的行为准则,该功能将面向全球用户开放,不限于欧盟地区。
Anthropic 声明示意图
欧盟新规落地,AI 内容需持“数字身份证”
随着 AI 生成内容与真实信息的界限日益模糊,为内容嵌入可追溯的“数字身份证”已成为维护信息真实性与公众信任的必要防线。8 月 2 日,欧盟《人工智能法案》第 50 条正式生效,强制要求生成式 AI 提供者为 AI 生成内容添加机器可读标识。同日,《AI 生成内容透明度行为准则》作为配套文件同步实施。
据欧盟委员会披露,截至今年 7 月底,包括 Anthropic、Google、Meta、Microsoft、OpenAI 在内的约 190 家机构已签署该准则,涵盖生成式 AI 系统提供者及联想、汉莎航空、宝格丽等部署者。
Claude 双重标识方案:隐形水印与签名溯源
根据 Anthropic 公布的方案,Claude 主要采用两种标识方式:
文本隐形水印
Claude 在生成文字时,会直接嵌入肉眼无法察觉的水印。该水印不影响文本含义、质量或可读性,且能随复制粘贴操作转移,即便经过部分编辑仍可能保留。Anthropic 强调,从模型层面施加水印意味着无论通过何种产品或界面生成,水印都将存在。
文件签名溯源元数据
当生成.svg、.png、.jpg 等支持的文件类型时,Claude 会加入遵循 C2PA 标准(数字内容验证开放标准)的数字签名元数据。借此可判断文件是否经 Claude 处理以及内容是否被篡改。
该标识功能将覆盖 Claude 全产品线(含 API、Code、Cowork 等),云服务商调用生成的内容同样适用。对于 8 月 2 日前发布的旧版模型,Anthropic 表示将继续研究增设方案。地域上,该机制适用于全球所有使用 Claude 服务的地区。
技术局限性与监管挑战
Anthropic 明确指出标识技术的局限性:检测到标识仅说明内容可能经过 AI 处理,无法确证来源。这是因为用户常利用 Claude 进行校对、翻译或格式转换,非原生内容也可能携带标识。反之,未检测到标识也不代表内容非 AI 生成,反复改写、混合创作或屏幕截图等操作可能导致元数据丢失。
中国构建“显式 + 隐式”双重标识体系
在海外监管落地的同时,我国已建立起完整的 AI 内容标识制度体系。去年 9 月,四部门联合发布《人工智能生成合成内容标识办法》及强制性国家标准《网络安全技术 人工智能生成合成内容标识方法》,为平台和用户履行标识义务提供明确指引。
中国采取“显式 + 隐式”双重架构:显式标识为用户可感知的标记,隐式标识则为嵌入文件数据的技術措施(类似 Anthropic 方案)。目前,主流 AI 及社交平台已普遍落地显式标识,并在协议中承诺添加隐式标识。
标识管理已成为国内 AI 内容安全执法的重点。今年 4 月,工信部因“剪映”“猫箱”App 及“即梦 AI"网站未有效落实标识规定,依法采取约谈、责令改正等措施。同期,中央网信办部署为期四个月的“清朗·整治 AI 应用乱象”专项行动,将“生成合成内容标识落实不到位”列为重点整治问题,强化源头治理。

