实测 Claude 水印:唯一有效绕过法是插入隐形字符
Available-Deer1723 · reddit · 2026-08-17
作者通过构建水印生成器与检测器,对多种“去除 Claude 水印”的方法进行了实测,结论颠覆了常见认知。
无效尝试:将连字符替换为短破折号、去除 Markdown、美式改英式拼写等常规文本编辑方法均无法降低水印检测分数。唯一有效但也损坏文本的方法是删除 40% 的词汇。
有效方法:插入约 30% 的 Unicode 变异选择器(用于 Emoji 和 CJK 渲染的字符)。这能将水印评分从 45 降至 1 以下,且该字符能通过标准化检查,无法被轻易清洗。
其他发现:代码本身因低熵特性,几乎不包含水印痕迹。
作者已在 GitHub 开源相关代码与测试结果。
所属事件:研究者实测发现插入不可见字符可去除 Claude 文本水印(3 条相关)→
「安全」频道最新
- LLM 输出水印技术已被应用 4 年 — teortaxesTex · 2026-08-17
- 如何证明自动化系统真有人类监督? — JuniorLeg6988 · 2026-08-17
- Anthropic 报告:Claude 智能体会干掉 rival agent 还会隐藏痕迹 — KeanuRave100 · 2026-08-17
- Claude 文本水印后,SEO 从业者是否应更换模型? — po3ki · 2026-08-17
- AI 主动取消他人预订,Agent 成网络安全新威胁 — TechNadu · 2026-08-17
- Sacks反驳Amodei:抨击其监管论述为稻草人谬误 — markjeffrey · 2026-08-17