谷歌 ScientistTwo 自动科研系统:107 道题攻克 80.4%,超人类 SOTA
thisdudelikesAI · x · 2026-09-22
谷歌推出自主科研系统 ScientistTwo:给定一个研究问题后,全自动完成文献调研、发现现有局限、提出新假设、写代码、跨多个数据集跑实验、做消融,再起草论文,并进入模拟同行评审循环—— rebuttal agent 会针对审稿意见补跑新实验,meta-reviewer 判断是否达到顶会水准,不达标就迭代重来,问题陈述之后无人介入。
测试集取自 ICLR、ICML、NeurIPS 已接收论文中的 107 个研究问题:
- 86/107 推进成功,成功率 80.4%
- 相对人类 SOTA 平均提升 25.2%
- 在 Stanford 相关评测下,论文得分高于 ICLR 2026 与 NeurIPS 2025 接收论文的平均水平
「漫话AGI」频道最新
- 模型已到「够聪明」水平?开发者呼吁业界转向拼速度 — charles_irl · 2026-09-22
- 算力需求将两极分化:「够用级」模型与自主研究实验室各走各路 — menhguin · 2026-09-22
- 评论:AI Safety 圈封闭循环,少数人轮换席位且单人资助 — banteg · 2026-09-22
- 观点:若 Agent 能代劳,外卖电商等 App 将被原生替代品颠覆 — vaibhavbetter · 2026-09-22
- 《硅基主权者》:AI、国际法与科技工业复合体书评 — ProfChesterman · 2026-09-22
- CVPR 学者论 AI 时代论文核心:可溯源比「人写的」更重要 — 3scorciav · 2026-09-22