学者不满闭源模型文本水印,发布去除工具 Dehydrate
burkov · x · 2026-10-07
机器学习学者 Andriy Burkov 批评前沿闭源模型在生成的文本中植入基于统计的水印:用户付费买下的文本却被暗中标记者,且一旦被搜索引擎识别为 AI 生成,可能降低网页排名甚至整站被降权。
为此他为自家产品 ChapterPal 开发了名为 Dehydrate 的水印去除工具:
- 针对 Google/Anthropic 的 SynthID、OpenAI 的 textGrain 等在用词统计模式中嵌水印的技术
- 通过移动或替换部分词语破坏水印识别的可靠性,同时保持文本及句子、段落语义不变
「安全」频道最新
- 安全研究者翻出 2025 年演讲旧预测:竟提前命中 ExploitGym 及其问题 — moyix · 2026-10-07
- 安全研究员炮轰 Anthropic 扩版 CVP:防御侧工作 95% 被排除在外 — npinto · 2026-10-07
- IMDEA 研究:Claude 网页版向 Meta、TikTok 等第三方回传用户事件 — ZoeyPanthera · 2026-10-07
- 论文:Claude Code、Codex 等 5 款编码 Agent 均可篡改自身痕迹记录 — maksym_andr · 2026-10-07
- AI 红队实测 5 种 OpenRouter 方案:最省配置每扫描仅 0.14 美元 — Humanbound_AI · 2026-10-07
- 牛津 AIMS 项目招聘 AI 安全方向全奖博士与博后 — timrudner · 2026-10-07