尚无科学方法训练值得信赖的 AI

JeffLadish · x · 2026-08-27

Jeff Ladish 推荐了一篇 Grace Huckins 的文章,指出由于缺乏关于模型动机的真正科学,目前无人知道如何训练可信赖的 AI。公司虽可加固环境防黑客,但这无法解决更深层的对齐问题。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →