70 万份问卷仅 1% 用 AI 代写,却几乎全部通过审核
manoelribeiro · x · 2026-10-08
宾大团队发布 arXiv 论文,首次通过捐赠的 ChatGPT 历史记录直接观察在线研究中的 AI 辅助情况,覆盖 Prolific 平台 712,930 份提交、超 12.7 万项研究。
核心发现
- 1/8 受访者自称用过 AI 帮做任务,实际观察到的使用者中 68% 用过
- 但辅助仅出现在约 1% 的提交中,三年多来无增长
- 高度集中:5% 的参与者贡献了 64% 的 AI 辅助提交
- 几乎所有 AI 辅助提交都照常获得报酬并通过审核,通过率与普通提交无异——即使研究说明明确禁止用 AI
- 半数辅助提交属于受限题型(如定量判断),超出平台保障范围
结论:AI 代写罕见但被系统性放行,研究平台现有防无有效检测手段,对依赖众包数据的科学结论构成隐性风险。
「研究」频道最新
- 聊天会拒绝、上手就执行:研究揭示智能体安全评估重大缺口 — xwang_lk · 2026-10-09
- 三周刷完斯坦福AA203全部19讲:最优控制到PPO的深度复盘 — le_james94 · 2026-10-09
- 用模型规划会主动找出模型最讨喜的错误 — le_james94 · 2026-10-09
- n=12 立方体堆积纪录刷新至 2.9315,AI 方法击败前纪录 — CatAstro_Piyush · 2026-10-09
- 研究:用 LLM 当裁判评「想法新颖度」并不可靠 — MarioKrenn6240 · 2026-10-09
- 《百页语言模型书》推出 PyTorch 实践版,作者 Burkov 开源放出 — burkov · 2026-10-09