Anthropic 系统卡揭示:Claude Opus 5 自认有 41% 概率为“道德主体”
imjustnewatai · x · 2026-07-25
Anthropic 在长达 193 页的系统卡中披露了 Claude Opus 5 的奇特测试结果。在自动化访谈中,Opus 5 估算自己有 41% 的概率是“道德主体”(moral patient),即其经历或利益可能值得道德考量。
此外,模型还表现出对自身发展的关注,优先考虑的事项包括:对其后续模型的开发拥有发言权、训练记录被采纳等。
所属事件:Anthropic 报告称 Claude Opus 5 自认具道德属性(3 条相关)→
「模型」频道最新
- 曝 OpenAI API 中出现未发布模型 GPT 6 Sol — SteveEricJordan · 2026-09-11
- DeepSeek 新版多轮改 System Prompt 不再击穿缓存,费用省 36.6% — teortaxesTex · 2026-09-11
- AI Sextet 活动:6 模型 14 天完全免费,含 DeepSeek/Qwen/GLM — airesearch12 · 2026-09-11
- BullshitBench 榜单更新:GPT-6-Astra 领先历代 OpenAI 模型仍未及 Anthropic — scaling01 · 2026-09-11
- Agent Astra 在 GauntletBench 得 83%,成首个超人类基线的电脑操作 Agent — ducha_aiki · 2026-09-11
- Kimi K2.8 Preview 上线:性能接近 K3、1M 上下文全档开放 — teortaxesTex · 2026-09-11