RSIArena 实验:8 个 agent 共享 64 张 Blackwell,各用 1000 GPU 时训模型
my_cat_can_code · x · 2026-09-30
联合 Stanford、Notre Dame、UW 与 Scale AI 的 RSIArena(by Bake AI)正在实测一个大胆问题:前沿模型能独立完成多少 post-training 研究?
- 设置:8 个研究 agent、同一个 30B 基座模型,在 64 张 RTX PRO 6000 Blackwell 共享集群上连续跑 144 小时。
- 规则:每个 agent 分到 1000 GPU 小时,自主选择数据、编写训练代码、跑实验;定期冻结其提交的模型做独立评估。
- 看点:「模型训练模型」的公开竞技场,观众可围观 agent 们经历「为什么昨天这招灵今天不灵」的研究者时刻。
团队将在 COLM 会议 107 号展位设直播活动,欢迎 post-training、agent 与评测方向的研究者反馈。
所属事件:RSIArena直播实验:8个Agent同基座自主做后训练研究(6 条相关)→
「编程与Agent」频道最新
- alphaXiv 开源 OpenResearch 桌面版:把编码 Agent 变科研 Agent — gekobraa · 2026-09-30
- 开源项目号称「Agent 记忆的梯度下降」引热议 — Saboo_Shubham_ · 2026-09-30
- awesome-llm-apps 破 14 万星:100+ 开源 AI Agent 模板免费用 — Saboo_Shubham_ · 2026-09-30
- 谷歌向 CNCF 捐赠 Agent Substrate,剑指智能体运行时底座 — rakyll · 2026-09-30
- Git 2.56 发布:新增 git add --resolved 只暂存已解决冲突 — DanielLockyer · 2026-09-30
- OpenAI 揭秘:一年让 computer use 快 10 倍,双 Agent 架构是关键 — johncoogan · 2026-09-30