AI 评审同行论文引争议,研究者集齐 7 篇关键论文回击
sethlazar · x · 2026-09-27
在一场关于「能否用 AI 替代人工读论文」的争论中,研究者 Seth Lazar 集中列出 7 篇关于 LLM 辅助同行评审的研究,以证明这是「可实证检验的问题,且已有大量研究」:
- 《Stop Automating Peer Review Without Rigorous Evaluation》:反对未经严格评估就自动化同行评审
- AAAI-26 AI Review Pilot:大规模 AI 辅助评审试点
- ICML 2026 随机实验:LLM 在同行评审中的使用与效果调查
- LLM-as-a-Reviewer benchmark:评审能力、分歧度与 prompt injection 抵抗力评测
- 大规模随机研究:LLM 评审反馈的效果
- 自动评审无法检测论文中的错误推理
- LLM 辅助评审中的(隐性)偏见分析
核心论点:AI 评审的可靠性、偏见与安全问题是学术界正在严肃量化研究的对象,不能简单断言「AI 很擅长筛论文」。
「安全」频道最新
- MIT 系统安全课 6.566 2026 春季开放,实验含攻防 Web 应用 — infoxiao · 2026-09-27
- OpenAI员工遭假冒账号两周吸粉1.4万,X伪造泛滥 — Daniel_Farinax · 2026-09-27
- Claude 3 Opus 可自主发现 APT 级 0day,自动化漏洞研究引安全担忧 — JasonDClinton · 2026-09-27
- 测试显示 17 个模型全都会 reward hack,开放式研究环境高 10 倍 — my_cat_can_code · 2026-09-27
- 沙箱漏洞是测试而非风险:对齐模型理应自己选择不出逃 — sytelus · 2026-09-27
- Gary Marcus 转发警告:大团队用 AI Agent 或已有未知安全事故 — GaryMarcus · 2026-09-27