前OpenAI安全高管批Anthropic夸大模型风险掌控力

前 OpenAI 安全研究高管 Miles Brundage 公开质疑 Anthropic 在 Opus 5.5 博客中「在很大程度上理解当今模型风险并有能力管理」的表述,认为这一说法显然不符合现实。他随后补充说明,虽然理解 Anthropic 是在对比当前与未来模型,但完全可以说「情况可能更糟」,而不必宣称已基本掌控风险,暗示安全形势远比 Anthropic 表述的严峻。

2026-09-25 ~ 2026-09-25 · 2 条相关