OpenAI 与 Anthropic 相继上线隐形文本水印,同义词替换可破检测

lmoroney · x · 2026-10-11

AI 文本水印正成为标配:OpenAI 宣布未来几周内为欧盟符合条件的 ChatGPT 和 Codex 文本添加隐形水印,以满足欧盟 AI 法案的标识要求,全球 API 客户可主动开启,欧盟区默认关闭;Anthropic 帮助页则显示支持的 Claude 模型已在 API、应用和 Claude Code 全球范围默认加水印。

两者原理相同:通过影响模型选词形成统计模式供检测器识别,但检测器目前均不公开。OpenAI 自己的测试暴露了弱点——在 400 token 的段落中把 25% 的词替换为同义词,检测率就从约 92% 骤降至 17%,越短的文本越难检测。

实用建议:用 AI 辅助写作的人应保留草稿和笔记以证明创作过程;教师应把检测器结果当作与学生沟通的一个信号,因为 OpenAI 明确表示水印无法衡量人类参与了多少工作。

所属事件:OpenAI 为欧盟 ChatGPT 文本上线隐形水印(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →