Sneha Revanur 评 OpenAI 独立调查:依赖少数英雄的不可持续模式
sjgadler · x · 2026-08-28
Sneha Revanur 评论了针对 OpenAI 的独立调查。她指出:
- 肯定贡献:METR/Redwood 的 3 名调查人员及 OpenAI 内部支持者表现卓越。
- 治理隐忧:AI 安全治理不能依赖少数“英雄”在短时间内临时抱佛脚。对比航空业成熟的监管体系,AI 行业需要在更压缩的时间表内建立可迭代的治理框架,且下一次“警告”可能不再如此明显或可恢复。
「安全」频道最新
- 攻击成功率高达 80%,研究员攻破 Claude Code Opus 5 Auto Mode — wunderwuzzi23 · 2026-08-28
- 研究员演示劫持 Claude Code,完整攻陷系统 — wunderwuzzi23 · 2026-08-28
- 美拟推芯片安全法案:要求高端 AI 芯片定位 — peterwildeford · 2026-08-28
- 首例专有模型双盲评估:Gemini 2.5 安全性测试 — Miles_Brundage · 2026-08-28
- 回顾 73 年 Reward Hacking 史,探讨 AI 安全证据 — tomekkorbak · 2026-08-28
- BioSecBench 基准评测:AI 代理推断病原体属性能力不足 50% — kenbwork · 2026-08-28