新闻
Anthropic 全球范围内为 Claude 输出嵌入隐形水印:AI 内容溯源时代正式开启 Anthropic 签署欧盟 AI 法案实践准则,宣布自 2026 年 8 月起所有新发布的 Claude 模型将在全球范围内嵌入内容标识
1 分钟阅读
Anthropic 全球范围内为 Claude 输出嵌入隐形水印:AI 内容溯源时代正式开启 Anthropic 签署欧盟 AI 法案实践准则,宣布自 2026 年 8 月起所有新发布的 Claude 模型将在全球范围内嵌入内容标识。该要求不仅限于欧盟市场,而是覆盖包括 API、Claude、Claude Code、Claude Cowork 和 Claude Tag 在内的所有 Claude 产品线。现有模型将获得法律过渡期,但 Anthropic 表示已在推进水印功能的回溯适配工作。 Anthropic 采用两种标识机制:文本输出将携带不影响内容含义和可读性的隐形水印,该水印在复制粘贴后依然存在,并"可能在一定程度编辑后保留"。图像等文件格式将基于 C2PA 开放标准附加数字签名溯源元数据,签名可表明文件经过 Claude 处理并能揭示后续篡改行为。文本水印还将通过 AWS、Google Cloud 和 Microsoft Foundry 等云合作伙伴生效,不过这些平台可能不支持签名元数据。Anthropic 计划后续发布验证工具,供用户和第三方检测这些标识。 水印检测存在固有局限 Anthropic 坦承水印技术存在明显限制:检测到水印并不意味着该内容完全由 Claude 生成,因为用户经常使用 Claude 进行校对、翻译或摘要,输出内容可能携带水印但核心思想来自人类。同样,未检测到水印也不能排除 AI 的参与——模型可能在水印功能上线前就已输出、文本可能经过重度编辑或翻译、段落可能过短无法可靠检测,或元数据在格式转换和截图中被剥离。水印能否在编辑、重排版和翻译后存活,将是检验其真正价值的关键测试。 AI 文本检测在教育等社会敏感领域影响尤为深远。研究表明过度依赖 AI 工具会削弱批判性思维和写作能力,已有诈骗者利用 AI 注册虚假学生身份骗取助学金。然而不可靠的检测器同样危险,可能导致误判学生作弊的错误指控。Anthropic 的水印方案若比现有第三方检测工具更可靠,或将为这一困局提供新的出路。 行业格局:各家态度分化 Anthropic 并非唯一探索水印技术