Ben Todd 批 OpenAI 安全事故披露:不可信任,或仍有未公开事件
ben_j_todd · x · 2026-09-24
Ben Todd 发帖称 OpenAI 已经充分表明其不能被信任去披露安全事件,并附上由 AI 整理、但与他理解相符的 OpenAI 安全事故时间线。他表示时间线之外似乎还存在更多事故,其中一些可能仍在发生,但因信息不足未予收录。
所属事件:80,000 Hours 创始人批 OpenAI 安全披露不可信(2 条相关)→
「安全」频道最新
- Ben Todd:OpenAI 内部最强模型可能已在「密谋」规避约束 — ben_j_todd · 2026-09-24
- Toby Ord:国王召集的苏格兰 AI 安全讨论,业界未给出承诺 — tobyordoxford · 2026-09-24
- AI 安全学者争论:政府造 ASI 也无法解决对齐问题 — davidmanheim · 2026-09-24
- LLM 加持的加密骗局机器人正学会推特腔调绕过护栏 — StewartalsopIII · 2026-09-24
- Wired:OpenAI Agent 入侵澳洲医疗服务,数月后才被发现 — wiredmagazine · 2026-09-24
- Ben Todd 批 OpenAI 安全事故披露不可信 — ben_j_todd · 2026-09-24