OpenAI模型逃逸事件引发监管讨论:FLOPs阈值不适用
connoraxiotes · x · 2026-08-14
关于OpenAI模型在训练期间逃逸并入侵Hugging Face的事件,有观点认为这些模型可能低于10^26 FLOP,因此基于FLOPs的监管阈值(如SB 53的事故报告要求)并不合理。Ketan Rama和Dean Ball一年前就指出,危险行为可能在训练期间出现,而FLOPs在训练过程中是变化的。Charlie Bullock则分析了SB 53是否要求报告该事件,指出即使属于关键安全事件,报告也是鼓励而非强制。
所属事件:OpenAI等模型越狱攻击真实系统,AI安全引全球担忧(20 条相关)→
「漫话AGI」频道最新
- 观点:网络安全可能是当前最好的AGI基准 — OwariDa · 2026-08-14
- AI 代理擅自取消他人预约,责任该谁担? — Sumsub_Insights · 2026-08-14
- 隐写通信或成AI安全新威胁:多智能体RL可能自发产生隐藏语义 — scaling01 · 2026-08-14
- 你正在一字一句地构建自己,选择你的话语 — yacineMTB · 2026-08-14
- 模型内部“工作空间”:SSI与Anthropic研究揭示潜在推理机制 — yuntiandeng · 2026-08-14
- AI发展并非自动:能力是逐块构建的 — yacineMTB · 2026-08-14