实测 AI 智能体做开放式研究:烧钱耗时却被原作者全盘否定

sayashk · x · 2026-07-31

研究人员进行了一项“影子评估”,测试 AI 智能体能否胜任开放式的 AI 研究。他们为智能体提供了两篇未发表论文的研究问题,并给予六天时间以及数千美元的 API 额度和算力。

然而,原论文作者在审查 AI 生成的论文后,明确拒绝了这些产出。研究指出,尽管智能体在大多数工程类任务上表现得相当熟练,但在需要持续探索、识别文献空白以及对原始研究问题保持敏锐度等真正的研究核心技能上依然严重缺失。此外,这也引发了担忧:当 AI 研究能力达到能发现新知识的临界点时,人类可能已经无法有效捕捉它们所犯的错误了。

所属事件:实测AI做开放式科研:烧钱耗时遭原作者全盘否决(8 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →