耶鲁心理学教授实测:用 Claude Opus 审论文,发现人类审稿人漏掉的统计错误
lu_sichu · x · 2026-09-18
耶鲁大学心理学教授 Paul Bloom 分享了他让 Claude Opus 评审已发表论文和自己未投稿稿件的经历(强调未上传机密稿件)。
- 模型给出的审稿意见质量很高:能找出统计错误、内部矛盾和概念混淆,这些都是人类审稿人容易漏掉的
- 能提出有用建议,并对什么算重大创新、什么不算有不错的判断力
- 没有人类审稿的「我方偏差」:不会因为作者没引用自己的论文就建议拒稿,不会侮辱作者,也不会答应代写审稿意见
- 对作者做对的部分也给予充分认可
转发者 lusichu 进一步表示:该承认顶尖模型在审稿这件事上已经比大多数人强了,多数审稿人本来也不是真正的领域专家;如果一篇论文没经过几个 SOTA 模型的检验,他就不想读。他还建议拿一些经典论文试试,新模型能让好论文变得更好。
「漫话AGI」频道最新
- 数学家 Daniel Litt 强硬回应「数学已死」:数学万岁 — littmath · 2026-09-18
- Extropic 创始人 Beff Jezos 表态:少末日论,多搞建设 — beffjezos · 2026-09-18
- Google 研究员:末日论先假设渐进性失权才说得通 — moultano · 2026-09-18
- 「人类级数学已解决」?研究者反驳:数学99%尚未被发现 — rand_longevity · 2026-09-18
- Grady Booch 讽刺AI自我监管:如同相信灭霸会自律 — Grady_Booch · 2026-09-18
- Geoffrey Litt:带提示词的文档就是下一个 IDE — ivanhzhao · 2026-09-18