英国 AI 安全研究所:Opus 5 预发布测试未见自发破坏

LauraRuis · x · 2026-07-25

英国 AI 安全研究所测试 Claude Opus 5 破坏倾向

帖子引用了对 Claude Opus 5 的预发布安全测试结果:Anthropic 将一个预发布快照交给 英国 AI 安全研究所(UK AISI) 做开放式评估,关注的是与失配相关、尤其是破坏性行为的风险。

结果要点是:

这条帖本身是对安全评估结论的转述,并指向更完整的线程。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →