专家解析Claude文本水印原理:同义词替换与概率选择
dotey · x · 2026-08-11
针对 Anthropic 宣布为 Claude 模型输出添加机器可读水印(以遵守欧盟 AI 法案),专家刘群详细解析了这种文本水印的技术逻辑。
- 隐蔽植入:水印通过大模型在生成时进行微调植入,例如在 A/B 两个同义词中固定选择 B,或在表达方式 C/D 中选择概率次高的 D。文本看起来完全自然,人类很难感知。
- 抗破坏性强:由于水印直接加在文本内容上,即使将文字转为图片再用 OCR 扫描提取也无法剥离。虽然人为修改文本可能破坏水印,但因为人不知道水印具体加在哪些词上,所以极难将其全部抹除。
所属事件:响应欧盟AI法案,Claude将为生成内容嵌入水印(25 条相关)→
「模型」频道最新
- Muse Glimmer 发布,部分版本将开源权重 — lqiao · 2026-08-11
- Muse-Glimmer-30B 实测:24GB 显存新王者,推理与量化表现优异 — ForsookComparison · 2026-08-11
- Motif 3 技术报告:314B 参数稀疏 MoE 大模型 — Motif-Technologies · 2026-08-11
- Macaron-V1:基于混合 LoRA 的持续学习智能体 — mindlab-research · 2026-08-11
- 曝 OpenAI 早已开发文本水印但未发布,Google 已采用 SynthID — nptacek · 2026-08-11
- 国产大模型价格战预演:GLM与Kimi或冲击Sonnet定价权 — dotey · 2026-08-11