专题 · FULL STORY

Claude嵌入隐形水印应对欧盟AI法案

为响应欧盟AI法案透明度要求,Anthropic宣布在Claude生成的文本和图像中默认嵌入隐形水印。此举引发了行业对文本水印技术难点与监管合理性的激烈争议。

2026-08-11 ~ 2026-08-12 · 6 集 · 74 条

第 1 集 · Anthropic为Claude全场景嵌入隐形水印响应欧盟AI法案(2026-08-11,52 条)

Anthropic官方宣布,为响应欧盟《AI法案》透明度要求,Claude模型现已在全球范围内默认于所有生成的文本中嵌入隐形水印,并在.svg、.png、.jpg等文件中加入签名元数据(如C2PA)。文本水印机器可读、肉眼不可见,且能抵御复制粘贴和轻度修改。该功能在模型层面施加,覆盖API、网页端及代码等全场景。此举主要针对2026年8月2日及之后在欧盟发布的模型,但Anthropic正在为之前发布的模型添加支持。

已确认

  • Anthropic官方支持文档确认,Claude现在默认在所有生成的文本输出中嵌入隐形水印,并在生成的文件中添加签名元数据(m5、m8)。
  • 水印分为文本水印和文件元数据两种形式,均为机器可读,不影响可读性(m4、m8)。
  • 该功能覆盖Claude API、网页端及代码等全场景,图像文件(如png、jpg)加入C2PA来源签名(m10、m11)。
  • 此举主要为响应8月2日生效的欧盟《AI法案》第50条透明度要求(m12、m13、m14)。

尚未确认

  • 水印是否已应用于当前所有模型(如Opus 5)尚不明确,Anthropic声明措辞模糊,用户质疑8月2日前发布的模型是否已加水印(m15)。
  • 水印对代码质量的具体影响尚未有定论,开发者担忧模型首要约束变为嵌入水印而非写出最优代码(m20)。

为什么重要

  • 这是AI内容溯源与安全领域的一项实质性产品更新,可能成为行业标配(m19)。
  • 水印随复制粘贴保留,意味着AI生成内容可被追溯,但也引发对AI辅助创作内容归属的争议:用户上传人类文本让Claude润色,最终文本也会被标记为AI生成(m17)。
  • 技术实现上,主流方案为KGW方法,通过绿/红词表干预token选择,GPTZero CTO已撰文解析(m16)。

还有 32 条相关讨论 →

第 2 集 · 欧盟AI新规要求文本水印,六大巨头签署引争议(2026-08-11,5 条)

欧盟《AI生成内容透明度业务守则》落地,要求AI企业为生成文本添加隐形水印,引发行业对技术可行性与监管合理性的激烈争议。

已确认

  • 根据 @MilesBrundage 与 @deedydas 提供的信息,OpenAI 支持页面更新了关于文本水印的说明。根据欧盟新规,Anthropic、OpenAI、Google、Meta、Microsoft 和 Mistral 已签署该协议,承诺将隐形水印嵌入文本中,而 xAI 目前未签署。
  • @deedydas 指出,以 Google DeepMind 发表在《Nature》的 SynthID 论文为例,当前文本水印通常通过特定密钥改变 token 采样来实现。

尚未确认

  • 欧盟法案强制要求内容可检测的具体技术标准与最终落地效果,目前仍存在较大争议。

为什么重要

  • 技术落地困难:AI 研究者 Dan Jeffries 批评该法案是“史上最糟糕的立法之一”。他指出,文本水印无法在不改变文本的情况下有效嵌入,现有方法(如改变用词、标点或插入隐藏 Unicode/零宽字符)都极易在编辑中被破坏,且会损害模型性能。
  • 行业影响:@StewartalsopIII 的转发讨论指出,强制水印要求引发了关于中心化保护的争议。如何在满足合规要求的同时,克服技术瓶颈并保持模型能力,是签署协议的科技巨头们面临的共同难题。

第 3 集 · AI生成内容水印争议:信任工具还是变相歧视(2026-08-11,2 条)

关于AI生成内容是否应强制添加水印的提议引发了广泛争议。支持者认为社交平台应标记AI内容以允许用户过滤,但反对在个人请求的LLM生成结果中强制加水印,担忧此举不仅损害下游商业价值,还侵犯了用户获取免监控内容的权利。同时有观点指出,水印无法真实反映内容质量,反而暗示缺乏人类参与,过度强调“纯人类创作”极易引发变相歧视。

第 4 集 · 文本水印技术难点引热议:离散数据挑战与AI法案推动研究(2026-08-11,2 条)

AI研究员@antoinechaffin指出,由于文本是离散数据,无法像图像、视频那样通过添加微小噪声嵌入水印,这成为LLM输出水印的主要难点。随着《欧盟AI法案》推动,文本水印技术再次成为热点,Meta研究员过往工作也受到关注。

第 5 集 · Anthropic将为Claude输出添加隐形水印以应对欧盟法案(2026-08-11,11 条)

为响应欧盟《人工智能法案》透明度义务的近期生效,Anthropic 宣布在 Claude 新模型生成的文本中加入嵌入式隐形水印,并在生成的图片等文件中附带防篡改的签名溯源元数据。这一合规举措标志着 AI 内容标记时代的到来,并引发了关于合规、行业冲击与用户规避的广泛讨论。

已确认

  • 据 @APPSO 与 @rohanpaulai 报道,欧盟《人工智能法案》透明度义务近期生效,要求生成式 AI 内容必须带有机器可读标记,Anthropic 已跟进合规宣布上述水印与元数据功能。该标记在模型层面完成,将应用于 API、Claude Code 及各大云平台等。
  • 据 @HarperSCarroll 介绍,该文本水印机制类似 Google 的 SynthID,通过微调生成时下一个词的概率分布实现,对人类完全不可见,且检测机制目前仅限 Anthropic 内部。
  • 美国律师 @MatthewChang 确认,该水印变动同样适用于美国用户。

尚未确认

  • 资深 SEO 专家 @lilyraynnc 认为 Google 很可能很快就能借此轻松检测 AI 生成的内容,但这仅为行业推测,搜索引擎的具体应对机制尚未明确。

为什么重要

  • 行业合规与透明度:此举是生成式 AI 平台跟进地区法规的标志性动作,将极大改变 AI 生成内容的流转与识别方式。
  • 专业领域冲击:@MatthewChang 指出,水印技术将对法律职业和内容创作者产生重大影响,使得在法庭文件、特权问题以及低质 AI 内容中检测 AI 写作变得容易。
  • 用户应对与社区反馈:水印机制引发了用户的抵触与探讨。用户 @iamfakhrealam 抱怨 Claude 自动给输出内容添加水印是不道德的;用户 @dreamwieber 批评该政策缺乏颗粒度,无法区分是“仅用于语法检查”还是“完全由 AI 生成”。网友 @churchkey 分享了实测的“土办法”,称将文本通过 Google 翻译先转成西班牙语再翻译回英文,可以绕过 AI 检测。同时,@TheZvi 调侃称,除了隐形水印,Claude 生成文本中早已存在人类一眼就能认出的“AI 味”特征,这同样起到了标记作用。

第 6 集 · Anthropic将落实欧盟合规实施AI水印(2026-08-11,2 条)

受欧盟合规法案的推动,AI公司Anthropic正切实落实监管要求,着手实施AI生成内容水印。分析指出,与其在被动应对检测技术上陷入劣势,AI公司选择主动将水印功能内置于产品中是一种明智的合规博弈。这不仅回应了外界对AI内容监管难以落地的质疑,也预示着行业在内容溯源与安全机制上迈出了实质性的一步。