专题 · FULL STORY

Claude引入隐形水印:从合规到争议

为响应欧盟《AI法案》,Anthropic 宣布在 Claude 模型层面引入隐形水印。然而该技术随即引发广泛争议,不仅文本水印的技术难点受热议,新规更导致原创内容遭误报。

2026-08-11 ~ 2026-08-12 · 5 集 · 86 条

第 1 集 · Anthropic 为 Claude 引入隐形水印以响应欧盟法规(2026-08-11,77 条)

为响应欧盟《AI法案》第50条透明度要求,Anthropic 宣布已在 Claude 模型层面引入隐形水印机制。该功能在全球范围内适用,覆盖 API、网页端及代码等全场景,旨在确保 AI 生成内容可被有效检测和追溯。此举被视为 AI 内容溯源与安全领域的实质性更新,但也引发了关于人类创作归属和技术实现的广泛讨论。

已确认

  • Anthropic 官方支持文档确认,Claude 现在默认在所有生成的文本输出中嵌入隐形水印,并在生成的文件中添加签名元数据(m5、m8、m10)。
  • 水印分为文本水印和文件元数据两种形式,均为机器可读,不影响人类可读性。文本水印能抵御复制粘贴和轻度修改;针对 .svg、.png、.jpg 等图像文件则加入 C2PA 来源签名以验证篡改(m4、m10、m12)。
  • 该功能主要为应对 2026 年 8 月 2 日及之后在欧盟发布模型的合规要求,但 Anthropic 正在为之前发布的旧模型添加支持(m11、m16)。
  • 欧盟新规要求各公司必须确保用户明确知晓自己何时正在与高度逼真的 AI 生成图像、音频或文本进行交互,这意味着 AI 生成内容将面临强制性标签要求(m14)。

尚未确认

  • 水印是否已应用于当前所有旧模型(如 Opus 5)尚不明确。Anthropic 声明措辞模糊,Reddit 用户质疑当前模型是否已加水印,要求官方进一步澄清(m19)。
  • 水印对代码质量的具体影响尚未有定论。开发者担忧模型的首要约束可能变为嵌入水印而非写出最优代码,强烈反对将用户指令与决策的成果标记为纯 AI 生成(m4、m20)。

为什么重要

  • 行业合规趋势:AI 政策专家 Miles Brundage 指出,根据欧盟《AI生成内容透明度业务守则》,OpenAI、Google、Meta 等六家巨头均须添加文本水印,这可能成为行业标配(m20)。
  • 创作归属争议:水印随复制保留的特性,引发了 AI 辅助创作内容归属的争议。用户上传人类文本让 Claude 润色,最终文本也会被标记,这被开发者指责为工具窃取人类成果(m4、m17)。
  • 技术落地挑战:GPTZero CTO 撰文解析了前沿实验室常用的 KGW(绿/红词表)算法,通过干预 token 采样实现水印。但该技术在实际应用中仍面临抗干扰性和检测准确性的双重考验(m13、m18)。

还有 57 条相关讨论 →

第 2 集 · AI生成内容水印争议:信任工具还是变相歧视(2026-08-11,2 条)

关于AI生成内容是否应强制添加水印的提议引发了广泛争议。支持者认为社交平台应标记AI内容以允许用户过滤,但反对在个人请求的LLM生成结果中强制加水印,担忧此举不仅损害下游商业价值,还侵犯了用户获取免监控内容的权利。同时有观点指出,水印无法真实反映内容质量,反而暗示缺乏人类参与,过度强调“纯人类创作”极易引发变相歧视。

第 3 集 · 文本水印技术难点引热议:离散数据挑战与AI法案推动研究(2026-08-11,2 条)

AI研究员@antoinechaffin指出,由于文本是离散数据,无法像图像、视频那样通过添加微小噪声嵌入水印,这成为LLM输出水印的主要难点。随着《欧盟AI法案》推动,文本水印技术再次成为热点,Meta研究员过往工作也受到关注。

第 4 集 · Anthropic水印新规引争议:润色原创内容也遭误报(2026-08-12,2 条)

Anthropic 宣布将在 Claude 生成的文本中加入隐写水印以标记 AI 内容。然而新规引发争议,有用户反馈系统已出现误报:即使用户上传完全原创的文章,仅让 Claude 进行校对或润色,最终输出也会被打上 AI 生成标签。此事引发了社区对 AI 内容可追溯性及隐私边界的广泛讨论。

第 5 集 · Anthropic将为AI生成内容嵌入隐形水印(2026-08-12,3 条)

为遵守《欧盟AI法案》相关准则,Anthropic宣布将为AI生成的文本与文件添加水印。自8月2日后发布的模型将自动配备该技术,且水印作为文本本身的一部分,具有隐形特性。此外,针对生成的文件,Anthropic将采用C2PA开放标准进行标识,并计划将水印支持扩展至旧模型。