AI 审稿与人类分歧惊人:人类 oral 仅四分之一进入 AI 前 10%
ShayneRedford · x · 2026-10-07
「AI as Area Chair」研究的后续数据:人类评选的 oral 中只有约四分之一进入 AI 排名的前 10%;在主赛道全体论文上,AI 排名与口头/spotlight 层级及评审分数的 Kendall's τ 仅约 0.08,一致性极弱。模型看到的是匿名论文,没有人类评审、分数或网络搜索。
所属事件:让 AI 当 ICML 领域主席:全量 6617 篇论文排名与人类严重分歧(6 条相关)→
「研究」频道最新
- COLM 论文:潜空间推理模型的潜 token 多数可解码,可解释性即正确性信号 — sarahwiegreffe · 2026-10-07
- Apple ML 招聘研究实习生:让基础模型「知道自己知道什么」 — sineadwilliamso · 2026-10-07
- CAVEAT 测试台登场:商店促销能否带偏你的 AI 购物 Agent — ZacharyHuang12 · 2026-10-07
- GEA:以群体为进化单元的 Agent 自我改进范式,SWE-bench 71% — xwang_lk · 2026-10-07
- 9B 模型花 25 美元算力微调,达 Jev 决策指数 79% 分数 — sophiamyang · 2026-10-07
- 机器人学会「恢复技能」,真机任务成功率从 77.5% 升至 87.5% — qinzytech · 2026-10-07