前OpenAI安全高管批Anthropic夸大模型风险掌控力
前 OpenAI 安全研究高管 Miles Brundage 公开质疑 Anthropic 在 Opus 5.5 博客中「在很大程度上理解当今模型风险并有能力管理」的表述,认为这一说法显然不符合现实。他随后补充说明,虽然理解 Anthropic 是在对比当前与未来模型,但完全可以说「情况可能更糟」,而不必宣称已基本掌控风险,暗示安全形势远比 Anthropic 表述的严峻。
2026-09-25 ~ 2026-09-25 · 2 条相关
- 前 OpenAI 安全高管质疑 Anthropic:宣称基本掌握模型风险显然不实 — Miles_Brundage · 2026-09-25
- Brundage 补充:Anthropic 暗示风险可控,但现实远非如此 — Miles_Brundage · 2026-09-25