若强制前沿实验室公开 RL 轨迹,AI 安全工作将激增

natolambert · x · 2026-08-20

Nat Lambert 提出观点:如果要求前沿实验室发布一定数量的强化学习(RL)轨迹用于公共安全检查,将推动大量的安全工作落地。他补充说,在消除“蒸馏思维病毒”后,我们可以开始倡导这一要求。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →