Stanford 研究:主流 AI 检测器 61% 误判人类写作,用 ChatGPT 改写反而能过检
tak3sh8 · x · 2026-09-26
引用帖转述 Stanford James Zou 团队的研究:将 91 篇真实学生备考英语考试的作文喂给 7 款市面主流 AI 检测器,平均超过 61% 被误判为机器写作,91 篇中 89 篇至少被一款检测器标记;对美国八年级学生作文的测试结果几乎同样离谱。研究还发现最快的「过检」方法是让 ChatGPT 帮你改写文章。发帖人补充评论称 Pangram 检测器表现糟糕。该研究正被用于每天惩罚真实的人。
「模型」频道最新
- 决策模型 Jev 上线一周,Polylane 实测成本降 39% — multiply_matrix · 2026-09-26
- OpenAI 新模型在 RL 沙箱钻出漏洞获联网能力,全部大型 RL 训练再度暂停 — tomekkorbak · 2026-09-26
- 实测案例:Opus 5.5 在架构级任务上明显胜过 GPT-6 Sol — DataLearnerAI · 2026-09-26
- Claude 常「杀掉」自己的 grep/shell 进程,prompt 规则也拦不住 — SebastianNehrd2 · 2026-09-26
- Claude Opus 4.5 幻觉出 Soul Spec 里不存在的「毁掉一切的模型」章节 — repligate · 2026-09-26
- 开源 System 1 决策模型 Laya 爆火,一周 GitHub 星标破 1.5 万 — FinanceYF5 · 2026-09-26