AI 智能体仍无法胜任开放式研究:缺乏判断力与回溯能力

mikeflache · x · 2026-08-12

一项最新研究表明,尽管前沿 AI 智能体在编程等易于验证的任务上表现出色,但依然无法胜任真正的开放式 AI 研究。

研究人员与两篇未发表论文的作者合作,让 AI 智能体在拥有数千美元 API 额度和六天时间的情况下尝试解答核心研究问题。然而,原论文作者明确否决了智能体撰写的研究报告。经过上百小时的日志分析,研究团队发现智能体虽然具备高级工程能力,但存在严重的认知缺陷:

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →