Anthropic 安全负责人:Opus 5.5 发布整体上会降低对齐风险

EricBuess · x · 2026-09-23

Anthropic 安全团队相关人士表示,Opus 5.5 相比前代模型在安全性上有足够提升,发布它更有可能降低而非增加与对齐失误相关的风险。这是 Anthropic 对新模型安全论证的罕见表态,与其一贯的 Responsible Scaling 政策框架一脉相承。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →