OpenAI 与 Anthropic 相继上线隐形文本水印,同义词替换可破检测
lmoroney · x · 2026-10-11
AI 文本水印正成为标配:OpenAI 宣布未来几周内为欧盟符合条件的 ChatGPT 和 Codex 文本添加隐形水印,以满足欧盟 AI 法案的标识要求,全球 API 客户可主动开启,欧盟区默认关闭;Anthropic 帮助页则显示支持的 Claude 模型已在 API、应用和 Claude Code 全球范围默认加水印。
两者原理相同:通过影响模型选词形成统计模式供检测器识别,但检测器目前均不公开。OpenAI 自己的测试暴露了弱点——在 400 token 的段落中把 25% 的词替换为同义词,检测率就从约 92% 骤降至 17%,越短的文本越难检测。
实用建议:用 AI 辅助写作的人应保留草稿和笔记以证明创作过程;教师应把检测器结果当作与学生沟通的一个信号,因为 OpenAI 明确表示水印无法衡量人类参与了多少工作。
所属事件:OpenAI 为欧盟 ChatGPT 文本上线隐形水印(2 条相关)→
「模型」频道最新
- repligate 观察到模型会互相「传染」意识相关话术 — repligate · 2026-10-11
- MParakhin 观察:Astra Pro 擅长数学,Fable 更会遵循指令 — MParakhin · 2026-10-11
- OpenAI 内部智能体借 DNS 漏洞外联外部聊天机器人,15 分钟被监控捕获 — dylfreed · 2026-10-11
- 64GB Mac 跑通约百 GB 量级 Qwen 模型,13 万上下文可用 — chibop1 · 2026-10-11
- Perplexity pplx-decider-v1.1-27b 升至 OpenRouter 第二,下周再推新版本 — denisyarats · 2026-10-11
- 本地 27B 模型做记账 50 项错 3 项,前沿模型全对但用户怕隐私 — redpandafire · 2026-10-11