实测前沿AI智能体:开放式研究全被拒,能力仍存瓶颈

sayashk · x · 2026-07-31

一项最新研究测试了前沿 AI 智能体(agents)能否胜任开放式的 AI 研究。

研究人员将两篇未发表的 NeurIPS 提交论文的研究问题交由这些前沿智能体解决,并邀请原论文作者对智能体的研究结果进行评分。

结果显示,这两篇由 AI 智能体“做出来”的研究论文都被明确拒绝。这表明当前 AI 智能体在处理复杂、开放式的科研任务时,仍存在明显的局限性。

所属事件:实测AI做开放式科研:烧钱耗时遭原作者全盘否决(8 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →