前沿公司应公开安全后训练

Miles_Brundage · x · 2026-07-17

Miles Brundage 认为,前沿美国 AI 公司应该更公开自己如何做**安全导向的后训练**。 他补充说,这不仅包括后训练本身,还包括分类器、监控基础设施等用于缓解失配的内部系统。即便这些公司已经在做一部分,他仍认为如果认真对待“分布式”的前沿 AI 现实,这些做法还远远不够。

所属事件:专家呼吁前沿 AI 公司公开安全后训练的具体细节(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →