文本相似度学者:LLM 写作不是抄袭,人类本就在复读梗
9 月 23 日,做过大规模文本相似度分析的学者 Rex Douglass 连发多条推文,反驳「用 LLM 写作是抄袭」的观点,核心论点是:原创性本身就是幻觉,LLM 只是把人类一直在做的事做得更透明、且留下了记录。
已确认
- 作者从大规模文本相似度计算的实践经验出发,指出文化本身就是梗与内容被成千上万次复制、排列、混搭并发生轻微变异的演化过程;人脑同样在不断复读梗,只是不留痕迹,而 LLM 留下了记录。
- 他认为人类文本之所以「可预测」,恰恰是 LLM 能工作的原因:人们一生中无数次稍微改写别人的句子以规避「抄袭」,全人类同时这么做产生了海量 n-gram,但真正的新「想法」很少。
- 他反驳「怀旧式的真实创作」叙事,称抵抗 AI 内容的人是在捍卫一个从未存在的过去,本质上是对下一代竞争者的保护主义;市场根本不在乎内容是否为 LLM 生成,正如人们从不在乎人类彼此复制 meme。
- 他批评学术界普遍高估研究产出的真实性:几乎没人做元科学研究,因此没意识到绝大多数研究其实平庸——衍生性强、照猫画虎、表述含糊、赶工粗糙——而这恰好构成了 LLM 的「很好的基线」。
为什么重要
- 这一观点把 AI 抄袭争议从「机器是否剽窃」转移到「人类原创性是否存在」的更根本层面,为 LLM 内容的正当性提供了一个基于实证文本分析的反直觉论证,也间接解释了为什么 LLM 在学术与研究类文本上表现良好。
2026-09-23 ~ 2026-09-23 · 5 条相关
一手来源
- 做过大规模文本相似度的人,早就不信「原创」了 — RexDouglass ·
- Rex Douglass:市场早已不在乎内容是不是 LLM 生成的 — RexDouglass ·
- 【源头】做过大规模文本相似度的人,早就不信「原创」了 — RexDouglass · 2026-09-23
- 文本相似度研究者:「说 LLM 写作是抄袭」本身就是个被复读的梗 — RexDouglass · 2026-09-23
- 博主反驳「用 LLM 写作是抄袭」论:人类天天互相复述梗 — RexDouglass · 2026-09-23
- 学者指多数研究产出平庸,人类文本可预测恰是 LLM 得以成立的根基 — RexDouglass · 2026-09-23
- 【源头】Rex Douglass:市场早已不在乎内容是不是 LLM 生成的 — RexDouglass · 2026-09-23