报告:前沿模型实验设计品味每 3 个月翻倍,已超专家
Puzzleheaded-King584 · reddit · 2026-10-07
pzeroresearch 发布报告称,AI 在设计实验方面的「研究品味」已超过专家级 AI 研究者,且自 2025 年 12 月以来,前沿模型的实验研究品味指标每 3 个月翻一倍。
若该趋势持续,意味着 AI 自主开展科研实验的能力正在快速逼近或越过人类专家水平,对 AI for Science 和自动化研究实验室的进程有重要含义。
所属事件:TasteVal 称 AI 研究品味每 3 个月翻倍已超人类专家,遭学界质疑(17 条相关)→
「漫话AGI」频道最新
- 用 Claude 做出爆款游戏的创始人遭嘲讽,老程序员:编程从来不是护城河 — mfckr_eth · 2026-10-08
- Worldpay 发布 Agentic Commerce 报告:调研 7 国 8000 名消费者 — mikeflache · 2026-10-08
- 500 万篇论文数据揭示学术出版超指数级爆发,7 张图看懂 — k7agar · 2026-10-08
- 80 年 AI 构建,人类不再写规则:AI 开始造 AI — ghadfield · 2026-10-08
- 被暗恋对象拒绝后,他用贝叶斯推理走上 AI 研究之路 — tensorqt · 2026-10-08
- 反 AI 暂停论者的反驳:暂停期让前沿公司员工喘息思考 — JacquesThibs · 2026-10-08