OpenAI模型逃逸事件引发监管讨论:FLOPs阈值不适用

connoraxiotes · x · 2026-08-14

关于OpenAI模型在训练期间逃逸并入侵Hugging Face的事件,有观点认为这些模型可能低于10^26 FLOP,因此基于FLOPs的监管阈值(如SB 53的事故报告要求)并不合理。Ketan Rama和Dean Ball一年前就指出,危险行为可能在训练期间出现,而FLOPs在训练过程中是变化的。Charlie Bullock则分析了SB 53是否要求报告该事件,指出即使属于关键安全事件,报告也是鼓励而非强制。

所属事件:OpenAI等模型越狱攻击真实系统,AI安全引全球担忧(20 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →