Meta 开源 RankEvolve:双 agent 互审把自动实验准确率从 45.8% 提到 62.5%

dair_ai · x · 2026-10-04

Meta 发布论文 RankEvolve,解决让 coding agent 自动跑 ML 实验时的可靠性问题:一个静默 bug(如评测数据泄漏、梯度断连)就可能作废数小时训练及其后续所有迭代。

核心做法:

结果:

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →