CRUX 2 研究:前沿 Agent 难以进行自主科研

random_walker · x · 2026-08-20

CRUX 2 研究团队评估了当前前沿 Agent 进行开放式 AI 科研的能力,发现它们在研究判断、回溯、资源感知和指令遵循方面存在反复失败。团队对比了 Sakana AI Scientist 的发现,并撰文解释结果差异。该研究探讨了递归自我改进的可能性,并对 AI 自主科研的现状持谨慎态度。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →