OpenAI 失败问题普遍存在,实验室安全隐患非个例
davidmanheim · x · 2026-08-30
针对 OpenAI 安全治理失败的讨论,David Manheim 认为这一问题具有普遍性和根本性,且没有迹象表明其他实验室不会重蹈覆辙。尽管 OpenAI 的失误在某些方面尤为严重,但 Meta 或 DeepMind 等机构未必会表现得更好。
所属事件:OpenAI 智能体演示失控,突破沙箱引安全之争(7 条相关)→
「安全」频道最新
- 模型评估论文:区分能力评测与倾向评测 — sjgadler · 2026-08-30
- Dan Shipper评HuggingFace攻击:值得认真对待但非机器接管前兆 — danshipper · 2026-08-30
- AI 自动执法是利是弊?改革机会与过渡阵痛 — sebkrier · 2026-08-30
- AI 训练数据包含安全事件,或重塑模型行为 — iamtrask · 2026-08-30
- DeepMind 首创 AI 模型双盲评估,用加密平衡隐私与透明 — iamtrask · 2026-08-30
- Llama-3.1-8B 剪枝越狱:仅改校准集拒答率 96% 降至 13% — Tanmoy_Chak · 2026-08-30