CRUX 2 研究:前沿 Agent 难以进行自主科研
random_walker · x · 2026-08-20
CRUX 2 研究团队评估了当前前沿 Agent 进行开放式 AI 科研的能力,发现它们在研究判断、回溯、资源感知和指令遵循方面存在反复失败。团队对比了 Sakana AI Scientist 的发现,并撰文解释结果差异。该研究探讨了递归自我改进的可能性,并对 AI 自主科研的现状持谨慎态度。
「漫话AGI」频道最新
- Mark Cuban:AI 不会取代放射科医生,但每位医生都得会用 — GaryMarcus · 2026-08-20
- 关于 AI 生物安全与知识壁垒的深度争论 — Hacubu · 2026-08-20
- 「AI解放人类做更有意义的工作」?没人解释市场为何要买单 — VraserX · 2026-08-20
- AI 内容像《欢乐谷》:语法完美、态度礼貌,却没有任何真实棱角 — TivadarDanka · 2026-08-20
- Peter Diamandis:前十文生视频模型九成来自中国 — PeterDiamandis · 2026-08-20
- 教师警告:过度依赖 AI 导致学生丧失独立思考能力 — Actual__Wizard · 2026-08-20