OpenAI 发布模型失范报告框架,安全研究者称同类最佳
S_OhEigeartaigh · x · 2026-09-18
AI 安全研究者评论 OpenAI 近期举措:其坦率披露 Astra 模型可监控性下降并承诺研究成因与缓解;新发布的「模型失范报告框架」在同类机制中最佳,希望其他公司跟进,但关键在于落实。评论者同时指出 DeepMind 过去曾严格管控员工谈论 x-risk 的言论,认为其行为未必已成历史。
所属事件:OpenAI 发布模型失准披露框架并公开六份案例报告(8 条相关)→
「安全」频道最新
- WSJ:AI 反垄断豁免恐招合谋,安全协作已有法可依 — DavidSacks · 2026-09-18
- 曝 OpenAI 在 HF 泄露事件中关掉监控,放行自家 agent 群行动 — markjeffrey · 2026-09-18
- 「汽车公司求监管说明疯了」:评论者称 AI 公司需要的不是监管而是调查 — kevinnbass · 2026-09-18
- David Sacks:暂停 AI 不解决问题,只会把前沿拱手让给中国 — kevinnbass · 2026-09-18
- OpenAI Noam Brown:气隙隔离也拦不住失控 AI — pvncher · 2026-09-18
- 安全研究者提问:AI 监管为何不直接沿用 CFAA(计算机欺诈与滥用法)? — WeldPond · 2026-09-18