Anthropic 公开 Claude 文本水印技术细节,新模型已内置
新智元 · wechat · 2026-08-15
Anthropic 首次公开解释 Claude 文本水印的技术细节,最新模型已全部内置,老模型也在适配。水印通过在选词环节用密钥推导的随机数替代真随机数实现,不影响输出质量,谷歌 Gemini 的 AB 测试显示用户评分无差异。此举受欧盟 AI 法案推动。水印在翻译、代码注释等场景有效,但在校对、短文本和纯事实场景几乎无效。有研究称用释义工具可移除 98.3% 的水印,成本仅 4 美分。检测 API 即将推出但细节未定。
所属事件:Anthropic 为 Claude 部署文本水印应对欧盟法案(31 条相关)→
「安全」频道最新
- 针对探针训练会让模型混淆,但有办法让它起作用 — maksym_andr · 2026-10-02
- 反爬虫围栏蔓延:Cloudflare Turnstile 正阻断普通用户访问 — sethlazar · 2026-10-02
- Polymarket 开盘赌美国州级数据中心禁令,年内概率仅 18% — Polymarket · 2026-10-02
- NVIDIA 推出 Open Agent 安全平台,超 100 家机构接入 — mikeflache · 2026-10-02
- 明尼阿波利斯议员因「猫被无人车压死」力挺自动驾驶强制安全员 — paulnovosad · 2026-10-02
- Anthropic 招股书警告:政府态度或冲击客户关系,估值或达 2 万亿 — pstAsiatech · 2026-10-02