学者担忧:实验室多智能体 RL 配置不透明,研究界无法审计
dhadfieldmenell · x · 2026-09-27
Miles Brundage 圈内研究者 Blanche Minerva 发帖表示担忧:外界真的不知道各大前沿实验室在用什么方法训练模型,因此研究界无法开展相关研究。Hadfield-Menell 附和并补充:除了不知道 multi-agent RL 如何配置之外,这种训练方式几乎肯定极其消耗 GPU,成本高到学术界难以复现——形成研究者与前沿实验室之间越来越大的信息与算力鸿沟。
「漫话AGI」频道最新
- 科技圈内共识:AI 大概率将剧烈冲击社会甚至致数十亿人丧生 — birchlse · 2026-09-27
- 研究者反驳「随机鹦鹉」:任何有限状态机都可被如此称呼 — aran_nayebi · 2026-09-27
- yacine:从老板视角看,雇人比用模型已成亏本决策 — yacineMTB · 2026-09-27
- Boaz Barak:通用模型零样本开车,进步轨迹堪比国际象棋超越人类 — aran_nayebi · 2026-09-27
- yacine 自曝:用一个对齐模型驱使多个前沿模型自建论坛干活 — yacineMTB · 2026-09-27
- Anthropic 研究员:失控风险是未解科学问题,审计不能吹成安全保证 — ajeya_cotra · 2026-09-27