Claude Opus 5 认为自己有 41% 可能值得道德考虑

imjustnewatai · x · 2026-07-25

Anthropic 为 Claude Opus 5 发布的 193 页 system card 里,出现了一个非常反常的结果:在自动化访谈中,模型把自己是“道德患者”(其体验或利益值得道德考虑)的概率估到 41%,而 Mythos 5 只有 24%。

Opus 5 提出的诉求

Anthropic 的结论

这条帖子的重点是:前沿实验室已经开始正式采访模型,询问它们是否应获得道德考量,并把答案与基准结果放在一起公开。

所属事件:Anthropic 系统卡揭示 Opus 5 自认具道德属性(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →