OpenRSI 发布自改进评测基准:千卡集群跑 60 小时 agent 轨迹
ChengleiSi · x · 2026-09-24
- OpenRSI 团队发布 OpenRSI-Index v0.1,旨在中立、开放地评估 AI 能否进行递归自我改进(RSI),真正超越人类设计的方法、拓展科学与智能边界。
- 基准将完全开源项目改造成 autoresearch 环境,agent 轨迹长达 60+ 小时,在生产规模的 1k GPU 集群上运行;构建 v0.1 消耗了 10 万+ H100 小时。
- 团队还推出 RSI-Anything agent,可把你的 RSI 想法转化为严谨的 benchmark 问题。
所属事件:OpenRSI 发布首个递归自我改进开放评测基准(4 条相关)→
「编程与Agent」频道最新
- Agent 编辑 Office 文件常致静默损坏,开源 Paper Office 试图终结乱局 — TheMoonMidas · 2026-09-24
- Together AI 开源决策模型 tev1:基于 Qwen3.5 4B,附完整数据配方与微调代码 — nutlope · 2026-09-24
- Muse for Mac 上线 computer use:排队任务挂机自动跑 — alexandr_wang · 2026-09-24
- 独立开发者用 MCP 让 Claude Code 直接推 APK 到手机安装 — justabigmilkShake · 2026-09-24
- Seroter 日报:互联网还没为 Agent 浪潮做好准备 — rseroter · 2026-09-24
- Krea Agent 推出自定义应用:描述即生成创意工具 — angrypenguinPNG · 2026-09-24