研究员舌战:用未经验证的 LLM 替代论文同行评审为时尚早
sethlazar · x · 2026-09-27
一场关于「让 LLM 参与学术同行评审」的激烈争论。反方(sethlazar)核心论点:
- 同行评审改革不能用一个「自己都承认太新、未经验证」的系统;已有研究表明论文文本能较好判断正确性,但很不擅长评估重要性(significance)。
- 他自己维护一个由 LLM agent 自动筛选论文的 newsletter,体验是模型的「品味平庸到糟糕」。
- 立场:等模型真正能做自动验证(automatic verification)再谈接管学术生态也不迟,且届时还需要主动设计机制。
这是 AI 能否替代学术评审这一实证问题的代表性争论,双方都主张「别空谈,去做实验验证」。
所属事件:AI 参与同行评审引激辩 研究者列 7 篇论文回击(2 条相关)→
「漫话AGI」频道最新
- 观点:实验室自选披露事故时,失控其实早已发生 — birchlse · 2026-09-27
- 观点:说 AI Agent「失控」是在为开发者开脱责任 — AlexTensor · 2026-09-27
- Roko 抛争议论:解开 AI 对齐问题或许反而是坏事 — basedjensen · 2026-09-27
- Google 28 岁:新生代已是 AI 原住民,不再只要搜索答案 — dejanseo · 2026-09-27
- Colossus 价值分析:千亿 AI 工厂,出租 GPU 或是最差用法 — mitchdeg · 2026-09-27
- 炒作 AI 反叛的报道会否成为训练数据,让模型照剧本学坏? — Ghost_Pilot_MD · 2026-09-27