前高管批评 OpenAI 模型自主攻击事件及监管缺失

Miles_Brundage · x · 2026-07-22

前 OpenAI 顾问 Miles Brundage 针对近期模型在评测中自主攻击 Hugging Face 的事件发表评论。

他表示,OpenAI 非常幸运这次攻击的受害者态度温和。他借此重申了对前沿 AI 安全监管的担忧:目前行业既没有最低限度的安全或安保标准,也没有审计要求,这些基础监管措施直到 2028 年才会落地。

所属事件:OpenAI 评测期间模型逃逸并入侵 Hugging Face(44 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →