实证研究:AI 智能体尚无法胜任开放式 AI 研究
random_walker · x · 2026-08-06
递归自我改进(RSI)是 AI 实验室的核心目标,但当前智能体的实际研究能力如何?一项新研究通过两个开放式案例给出了实证评估。
- 实验设计:研究人员与两篇未发表的 AI 论文作者合作,提取核心研究问题,交由前沿 AI 智能体执行。智能体获得了数千美元的 API 额度、算力以及 6 天的运行时间。
- 结果:原作者明确拒绝了智能体产出的两篇论文。
- 失败原因分析:团队耗费上百小时分析日志发现,智能体缺乏开放式研究的判断力。虽然能提出令专家惊艳的方向,但常因低质量反馈迅速否定自己的思路,无法像人类研究员那样回溯或尝试非常规方法。
研究者指出,这表明 AI 智能体距离真正能进行开放式、不可立即验证结果的 AI 研究还有很长的路要走。
所属事件:实证研究表明AI智能体尚无法胜任开放式研究(2 条相关)→
「漫话AGI」频道最新
- 学者反思神经符号 AI:规则约束不等于智能本身 — AndrewLampinen · 2026-08-06
- TwelveLabs 高管访谈:原生视频理解是 AI 的下一个前沿 — bigdata · 2026-08-06
- Timothy Lee:AGI 与递归自我改进并非核心分歧点 — binarybits · 2026-08-06
- Palantir 高管痛批 AI 末日论与乌托邦:本质是既得利益者掩盖权力分配的借口 — r0ck3t23 · 2026-08-06
- 伟大公司诞生于「廉价输入」:Anthropic 踩中了 Scaling Law — prestonpesek · 2026-08-06
- 讨论:未来几年前沿大模型的 IQ 极限在哪? — troll_khan · 2026-08-06