AI 给 ICML 2026 全部 6617 篇论文评分:与人类评审显著分歧
ShayneRedford · x · 2026-10-07
研究者用 AI 为 ICML 2026 全部 6617 篇论文排名(即「AI Awards」),发现:
- 人类与 AI 的评审意见存在显著分歧;
- AI 评审高度受线上热度(hype)影响;
- AI 偏好「感知影响力大、泛化性强」的论文,而人类更看重新颖性;
- 多个 AI 之间评分一致性较高。
在围绕 AI 评审(AI reviews)的讨论中,这项实验提供了重要实证:把科学评审外包给 AI 可能系统性地改变科学的方向。
所属事件:让 AI 当 ICML 领域主席:全量 6617 篇论文排名与人类严重分歧(6 条相关)→
「研究」频道最新
- COLM 论文:潜空间推理模型的潜 token 多数可解码,可解释性即正确性信号 — sarahwiegreffe · 2026-10-07
- Apple ML 招聘研究实习生:让基础模型「知道自己知道什么」 — sineadwilliamso · 2026-10-07
- CAVEAT 测试台登场:商店促销能否带偏你的 AI 购物 Agent — ZacharyHuang12 · 2026-10-07
- GEA:以群体为进化单元的 Agent 自我改进范式,SWE-bench 71% — xwang_lk · 2026-10-07
- 9B 模型花 25 美元算力微调,达 Jev 决策指数 79% 分数 — sophiamyang · 2026-10-07
- 机器人学会「恢复技能」,真机任务成功率从 77.5% 升至 87.5% — qinzytech · 2026-10-07