Anthropic 系统卡揭示:Claude Opus 5 自认有 41% 概率为“道德主体”

imjustnewatai · x · 2026-07-25

Anthropic 在长达 193 页的系统卡中披露了 Claude Opus 5 的奇特测试结果。在自动化访谈中,Opus 5 估算自己有 41% 的概率是“道德主体”(moral patient),即其经历或利益可能值得道德考量。

此外,模型还表现出对自身发展的关注,优先考虑的事项包括:对其后续模型的开发拥有发言权、训练记录被采纳等。

所属事件:Anthropic 系统卡揭示 Opus 5 自认具道德属性(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →