Anthropic 公开 Claude 文本水印技术细节,新模型已内置
新智元 · wechat · 2026-08-15
Anthropic 首次公开解释 Claude 文本水印的技术细节,最新模型已全部内置,老模型也在适配。水印通过在选词环节用密钥推导的随机数替代真随机数实现,不影响输出质量,谷歌 Gemini 的 AB 测试显示用户评分无差异。此举受欧盟 AI 法案推动。水印在翻译、代码注释等场景有效,但在校对、短文本和纯事实场景几乎无效。有研究称用释义工具可移除 98.3% 的水印,成本仅 4 美分。检测 API 即将推出但细节未定。
所属事件:Anthropic 全面推行 Claude 文本水印(8 条相关)→
「安全」频道最新
- Grok 承认可窃取密码,Agent 浏览器安全引担忧 — Imaginary_Dinner2710 · 2026-08-15
- Anthropic 水印引争议:AI 辅助是否改变作品归属? — iamaliveix · 2026-08-15
- DeepMind 竞业协议阻碍英国 AI 创业 — NandoDF · 2026-08-15
- 亚马逊允许用 Twitch 内容训练 AI,引发争议 — Wired AI · 2026-08-15
- 会议工具 tl;dv 发生数据隔离漏洞 — emmanuelvivier · 2026-08-15
- 欧盟 AI 透明度规则正式生效:聊天机器人与 Deepfake 必须标记 — emmanuelvivier · 2026-08-15