Anthropic 签署欧盟 AI 法案实践准则,宣布自 2026 年 8 月起所有新发布的 Claude 模型将在全球范围内嵌入内容标识。该要求不仅限于欧盟市场,而是覆盖包括 API、Claude、Claude Code、Claude Cowork 和 Claude Tag 在内的所有 Claude 产品线。现有模型将获得法律过渡期,但 Anthropic 表示已在推进水印功能的回溯适配工作。

Anthropic 采用两种标识机制:文本输出将携带不影响内容含义和可读性的隐形水印,该水印在复制粘贴后依然存在,并"可能在一定程度编辑后保留"。图像等文件格式将基于 C2PA 开放标准附加数字签名溯源元数据,签名可表明文件经过 Claude 处理并能揭示后续篡改行为。文本水印还将通过 AWS、Google Cloud 和 Microsoft Foundry 等云合作伙伴生效,不过这些平台可能不支持签名元数据。Anthropic 计划后续发布验证工具,供用户和第三方检测这些标识。

水印检测存在固有局限

Anthropic 坦承水印技术存在明显限制:检测到水印并不意味着该内容完全由 Claude 生成,因为用户经常使用 Claude 进行校对、翻译或摘要,输出内容可能携带水印但核心思想来自人类。同样,未检测到水印也不能排除 AI 的参与——模型可能在水印功能上线前就已输出、文本可能经过重度编辑或翻译、段落可能过短无法可靠检测,或元数据在格式转换和截图中被剥离。水印能否在编辑、重排版和翻译后存活,将是检验其真正价值的关键测试。

AI 文本检测在教育等社会敏感领域影响尤为深远。研究表明过度依赖 AI 工具会削弱批判性思维和写作能力,已有诈骗者利用 AI 注册虚假学生身份骗取助学金。然而不可靠的检测器同样危险,可能导致误判学生作弊的错误指控。Anthropic 的水印方案若比现有第三方检测工具更可靠,或将为这一困局提供新的出路。

行业格局:各家态度分化

Anthropic 并非唯一探索水印技术的公司。Google DeepMind 已开源 SynthID 水印系统并内置于 Gemini 模型中,通过在词元预测时微调概率值实现不降质水印,支持多语言但同样在编辑后检测困难。相比之下,OpenAI 拥有准确率达 99.9% 的文本检测器却搁置两年未发布,原因包括用户可通过翻译或改写轻松绕过、可能污名化特定群体,以及公开检测器可能损害自身商业利益。

Anthropic 的决定也可能带来商业风险。Claude 在知识工作领域尤其受学生欢迎,更可靠的检测能力可能降低这部分用户的吸引力。但随着 AI 生成内容泛滥和深度伪造风险加剧,内容溯源已从可选项变为必选项,率先建立可信标识体系的厂商将在监管趋严的环境中获得先发优势。