对比 Pangram 检测器:AI 水印对人类文本改写的局限性

RyanGreenblatt · x · 2026-08-12

研究员 Ryan Greenblatt 在对比现有的 AI 文本检测工具时指出,像 Pangram 这样的工具通常不会误判那些由人类原始素材重度转换而来的 AI 内容(例如将口述笔记转化为正式文档,且未添加大量新文本)。

然而,如果采用模型内置的水印机制,这类经过 AI 润色或转换的人类原创内容同样会被打上水印,这暴露了水印技术在区分「纯 AI 生成」与「AI 辅助润色」时存在的颗粒度问题。

所属事件:研究员解析大模型水印机制:低熵输出难标记(3 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →