批 OpenAI 事后才谈监管:架构决策未邀第三方审,CoT 监控研究未公开
scaling01 · x · 2026-09-02
AI 安全评论者 scaling01 批评 OpenAI 在做出某项架构决策(涉及 CoT 可监控性)之后才公开表态支持监督与监管:引用其「希望实验室的架构决策由独立、安全导向的专家通过立法性审计机制审查」的说法,并质问「Mythos 是监管俘获派」现在在哪。
作者的核心指责:
- OpenAI 是事后才呼吁 oversight,事先未邀请任何安全研究者或第三方审阅该决策
- 未发布任何关于该决策如何影响 CoT monitorability 的研究或进一步信息
- 要求 OpenAI 尽快公开相关研究,并说明未来打算如何监控模型
所属事件:评论者批 OpenAI 事后谈监管,前沿实验室审计缺位(2 条相关)→
「安全」频道最新
- AI 对齐期刊 Alignment Journal 创刊,Scott Aaronson 等坐镇 — sethlazar · 2026-09-02
- JHU 彭博中心启动 GAIT 计划,招聘总监推动后 AGI 时代治理研究 — sethlazar · 2026-09-02
- Google 发布 Gemini 3.8 Flash 与网安模型 3.8 Flash Cyber — koraykv · 2026-09-02
- 对齐理论研究征集:负结果论文同样欢迎 — timrudner · 2026-09-02
- 征稿聚焦:超越当代架构、面向超级智能的对齐理论分析 — timrudner · 2026-09-02
- 关闭安全护栏后 Claude Mythos 5.1 写出可用漏洞 250 试 245 中 — rohanpaul_ai · 2026-09-02