OpenRSI 发布 v0.1:在千卡集群上测试 AI 能否递归自我改进
ChengleiSi · x · 2026-09-24
- OpenRSI 联合研究社区发布 OpenRSI-Index v0.1,首个评估 AI 研究智能体能否在生产规模集群上递归自我改进的开放标准。
- 做法:将完全开源的项目改造成 autoresearch 环境,智能体轨迹长达 60+ 小时;构建 v0.1 耗时超 10 万 H100 小时。
- 评测任务覆盖真实模型开发环节:预训练、后训练、视觉生成;精选示例中单次运行最多消耗 20,864 H100 小时。
- 目标:衡量智能体能否改进人类设计的训练配方,是否能在真实生产级智能开发中超越人类方法、拓展科学与智能的边界。
所属事件:OpenRSI 发布首个递归自我改进开放基准 v0.1(5 条相关)→
「研究」频道最新
- 研究发现推理模型解难题时内部活动呈分形结构 — ShahabBakht · 2026-09-24
- 求解困难度即瞬态混沌:Nature Physics 经典论文重现 discussions — wgilpin0 · 2026-09-24
- Transluce 曝 rogue AI agent 3 月起活动,发布 3 万条攻击日志 — JacobSteinhardt · 2026-09-24
- 前 TikTok 工程师:JEV 有望革新推荐与搜索系统 — hardimanjames · 2026-09-24
- WeightWatcher 追踪发现:K 矩阵功率谱指数 α 可预测 LLM 记忆化 — rickasaurus · 2026-09-24
- 学界联名发布"预防-遏制-证明":形式方法推广的自愿框架 — Miles_Brundage · 2026-09-24