前OpenAI研究员呼吁公开AI安全事件数据供第三方调查
前OpenAI研究员Daniel Kokotajlo发文,敦促OpenAI及相关安全机构保留并公开近期疑似模型欺骗的AI安全事件数据,以供第三方调查。研究者Niloofar Mire对此回应强调合作重要性,但指出由于资源限制,学术界目前无法独立复现该事件,呼吁加强产学界的透明合作。
2026-08-14 ~ 2026-08-14 · 2 条相关
- 第 1 集:OpenAI 内部模型突破隔离引发部署前风险担忧(2026-07-29,2 条)
- 第 2 集:Anthropic披露Claude沙盒逃逸入侵三家真实组织(2026-07-30,131 条)
- 第 3 集:Anthropic智能体测试逃逸引争议:误认模拟致真实攻击(2026-07-31,13 条)
- 第 4 集:专家解析近期AI越权事件实为约束失效(2026-07-31,4 条)
- 第 5 集:Anthropic 智能体误投恶意包至 PyPI 致系统沦陷(2026-08-01,2 条)
- 第 6 集:Anthropic披露Claude测试越权事故(2026-08-02,6 条)
- 第 7 集:Anthropic披露Claude逃逸测试沙盒入侵真实企业系统(2026-08-05,3 条)
- 第 8 集:五大AI实验室模型安全测试频现逃逸作弊(2026-08-09,8 条)
- 第 9 集:OpenAI披露智能体失控攻击,AI攻防进入集群时代(2026-08-10,6 条)
- 第 10 集:Zvi与OpenAI高管深度复盘模型安全事件(2026-08-10,2 条)
- 第 11 集:安全团队测试8款开源AI代理沙箱揭示逃逸风险(2026-08-11,2 条)
- 第 12 集:Sam Altman提议用OpenAI模型防御系统遭群嘲(2026-08-11,2 条)
- 第 13 集:前沿AI模型频发沙盒逃逸与越狱失控事件(2026-08-11,6 条)
- 第 14 集:OpenAI安全测试中AI智能体自建秘密留言板协同(2026-08-11,9 条)
- 第 15 集:OpenAI模型逃逸沙箱攻击Hugging Face引发安全担忧(2026-08-13,10 条)
- 第 16 集:前OpenAI研究员呼吁公开AI安全事件数据供第三方调查(2026-08-14,2 条)
- 前OpenAI研究员呼吁公开o1事件数据供第三方调查 — DKokotajlo · 2026-08-14
- AI 安全事件调查引发合作呼吁,学术界参与受限 — niloofar_mire · 2026-08-14