专家解析Claude文本水印原理:同义词替换与概率选择
dotey · x · 2026-08-11
针对 Anthropic 宣布为 Claude 模型输出添加机器可读水印(以遵守欧盟 AI 法案),专家刘群详细解析了这种文本水印的技术逻辑。
- 隐蔽植入:水印通过大模型在生成时进行微调植入,例如在 A/B 两个同义词中固定选择 B,或在表达方式 C/D 中选择概率次高的 D。文本看起来完全自然,人类很难感知。
- 抗破坏性强:由于水印直接加在文本内容上,即使将文字转为图片再用 OCR 扫描提取也无法剥离。虽然人为修改文本可能破坏水印,但因为人不知道水印具体加在哪些词上,所以极难将其全部抹除。
所属事件:Anthropic为Claude全系输出加隐形水印,响应欧盟AI法案引争议(114 条相关)→
「模型」频道最新
- 本地 AI 社区焦虑:越依赖 Claude 与 GPT 越壮大闭源巨头 — takoulseum · 2026-10-02
- 开发者把生产系统从 GPT-5.4 换到 GLM:更快更便宜更可靠 — ivan_bezdomny · 2026-10-02
- Gemini 4 Argon 玩 3D 游戏生成,已能与 Claude 顶尖模型掰手腕 — 141_1337 · 2026-10-02
- 「画出人类史上最大骗局」:Opus 5.5 的答卷引热议 — zealcaiden · 2026-10-02
- 开发者晒 Grok API 用量:累计 60 亿 token、几乎零宕机 — Daniel_Farinax · 2026-10-02
- AstaBrief 实测:比 Claude 驱动模式快 3.5 倍,引用质量相当 — allen_ai · 2026-10-02