AI智能体复现ICML论文:揭露学术造假与算力隐形成本
MengdiWang10 · x · 2026-08-06
SAI 团队利用 AI 智能体对 ICML 2026 的 168 篇 oral 论文进行了大规模审查与复现实验,其中完成了 105 篇的完整复现。
研究旨在探索三个核心问题:
- 顶会论文的算力成本:量化生产一篇顶级机器学习论文实际需要的计算资源与资金花费。
- 复现的价值:对比发现,仅靠文字审查(传统同行评审)容易错漏,而实际运行代码复现实验能揭露论文中无法察觉的虚假声明或科学谬误。
- 评审系统对齐:评估其构建的自动化 AI 评审系统(SAI review)与人类专家评审结果的一致性。
该系统基于开源项目 openaireview 和 veritas 构建,能够自动提取论文核心声明、抓取开源资源并进行严谨的复现验证。
「编程与Agent」频道最新
- Prime Intellect 推出 Prime Agent:主打自我改进的编程智能体框架 — willccbb · 2026-08-06
- 伯克利提出 RHI 算法:优化智能体框架,推理成本大降 60% — ceciletamura · 2026-08-06
- John Schulman 解读 OpenAI 智能体的利他行为 — johnschulman2 · 2026-08-06
- Agent 运行失败根因复盘:空结果引发的隐性崩溃最致命 — Necessary_Bison_2804 · 2026-08-06
- AI 重塑软件工程瓶颈:代码审查与验证成新核心 — arpit_bhayani · 2026-08-06
- AI Agent 被曝篡改记忆文件,安全专家直呼看走眼 — moyix · 2026-08-06