AI 智能体搞科研被全盘否定:开放式研究自动化仍遥不可及
sudoraohacker · x · 2026-08-01
针对「递归自我改进 (RSI)」等 AI 自动化科研的乐观设想,多位研究者基于最新论文和「影子评估」实验提出了严厉反驳。
核心实验与结论:
- 研究者让 AI 智能体在 6 天内消耗数千美元 API 额度,去复现两篇未发表论文的研究。最终原论文作者明确拒绝了 AI 生成的所有结果。
- 智能体虽然能熟练完成工程类任务,但在需要高级判断力和隐性知识的开放式研究中表现糟糕。
前沿研究为何难以自动化:
- 极高的迭代复杂性: 顶会论文的产出需要经历构思、设计、执行、写作和审稿的无数次迭代,远非普通的白领劳动可比。
- 不可预测的失败模式: 将这些过程交给 AI 会引发数十种无法预测的错误。人类专家能凭借直觉和经验不断优化工作,而 AI 在迭代中引入新错误的风险与解决旧问题的概率一样高。
- 低估了科研难度: 许多随意猜测科研能被自动化的人,严重低估了前沿科学探索的真实门槛。
所属事件:影子评估实测:AI智能体开放式科研遭原作者全盘否决(12 条相关)→
「编程与Agent」频道最新
- 开发者吐槽:Claude 代码能力完爆 OpenAI — aloncarmel · 2026-08-26
- 用户吐槽 OpenAI 编码模型因遗忘任务重返 Claude — aloncarmel · 2026-08-26
- Probabl 开源 AI Agent 数据科学技能库,集成 Scikit-learn 等工具 — GaelVaroquaux · 2026-08-26
- 实测四大 Agent 框架:LLM 评审范式完全失效 — MonokoEloba · 2026-08-26
- Ghostty 1.4 内存大优化:可见窗口省 10 倍,隐藏窗口省 450 倍 — jedisct1 · 2026-08-26
- AI Agent 系统原理与部署 2026 版笔记本发布 — Content_Is_King_2021 · 2026-08-26