星知

logo
logo
登录

Anthropic 全球范围内为 Claude 输出嵌入隐形水印:AI 内容溯源时代正式开启

Anthropic 响应欧盟 AI 法案,自 2026 年 8 月起为 Claude 所有输出嵌入隐形水印与 C2PA 元数据,实现全球 AI 内容溯源。水印可抗复制粘贴和轻度编辑,但检测存在局限,无法绝对判定内容全由 AI 生成。相比 Google SynthID 和 OpenAI 搁置的检测器,Anthropic 率先落地,有望在监管趋严中抢占先机,也可能影响学生用户群体。
发布时间:2026/08/12 03:24|分类:人工智能
Anthropic 签署欧盟 AI 法案实践准则,宣布自 2026 年 8 月起所有新发布的 Claude 模型将在全球范围内嵌入内容标识,覆盖 API、Claude、Claude Code、Claude Cowork 和 Claude Tag 等全部产品线。现有模型将获得法律过渡期,但 Anthropic 已推进水印回溯适配。Anthropic 采用两种标识机制:文本输出携带不影响含义和可读性的隐形水印,复制粘贴后仍存在,并“可能在一定程度编辑后保留”;图像等文件则基于 C2PA 开放标准附加数字签名溯源元数据,可揭示后续篡改。文本水印还将通过 AWS、Google Cloud 和 Microsoft Foundry 等云合作伙伴生效,但云平台可能不支持签名元数据。Anthropic 计划后续发布验证工具。水印检测存在固有局限:检测到水印不意味内容完全由 Claude 生成,用户常使用 Claude 进行校对、翻译或摘要;未检测到水印也不能排除 AI 参与,如模型在水印上线前已输出、重度编辑或格式转换中元数据被剥离。因此水印在编辑、重排版和翻译后的存活能力是关键考验。AI 文本检测在教育等敏感领域影响深远。过度依赖 AI 会削弱批判性思维,确有诈骗者利用 AI 注册虚假学生身份骗助学金,但不可靠的检测器又可能导致误判作弊。若 Anthropic 水印方案更可靠,或可为这一困局提供新出路。行业格局呈分化:Google DeepMind 已开源 SynthID 水印并内置 Gemini,虽不降质但编辑后检测困难;OpenAI 拥有准确率 99.9% 的文本检测器却搁置两年未发布,顾虑用户可绕过、可能污名化特定群体及损害商业利益。Anthropic 的决定可能带来商业风险,因 Claude 在学生中受欢迎,更强的检测能力或降低部分用户吸引力。但随 AI 生成内容泛滥和深度伪造风险加剧,内容溯源已成必选项,率先建立可信标识体系的厂商将在监管趋严中获得先发优势。
人工智能星知