AI 写作查重新思路:infini-gram 揭示大模型生成文本来源
allen_ai · x · 2026-08-01
传统 AI 写作检测器仅能给出一个概率分数,无法指出具体表达是否已存在于现有数据源中。Allen AI 介绍了石溪大学 Tuhin Chakrabarti 团队利用 infini-gram 引擎进行的研究:该引擎能索引海量公开文本数据集,并统计任意长度的短语在其中出现的频率。
研究团队将该方法应用于书籍分析,通过筛选罕见短语(在 Google Books 中出现不超过 5 次且未被网络索引的短语)来区分独特表达与套话。他们还分析了近期的 GrantaGate 争议事件,发现被读者质疑为 AI 生成的文本片段,确实大量匹配了同人小说网站上的已有内容。
所属事件:Ai2 infini-gram 引擎追踪 AI 写作痕迹(8 条相关)→
「研究」频道最新
- 模型没问题是约束失效:解析近期 AI 越权事件本质 — drhyrum · 2026-08-01
- MIT 四日 AI 课程总结:科学家正转型为 AI 智能体管理者 — ProfBuehlerMIT · 2026-08-01
- AI Agent 新突破:攻克核磁共振结构解析难题 — AllThingsApx · 2026-08-01
- 神经元突触聚类如何影响学习?计算模型揭示因果机制 — KordingLab · 2026-08-01
- AI写作检测新工具:infini-gram引擎可追溯AI生成文本的词汇来源 — allen_ai · 2026-08-01
- 从零实现对比 BatchNorm/LayerNorm/GroupNorm — jcflynnnn · 2026-08-01