Anthropic 称 Claude Opus 5 经行为审计后是最对齐的模型
claudeai · x · 2026-07-25
Anthropic 的自动化行为审计显示,Claude Opus 5 是其迄今对齐性最强的模型。
和公司其他模型相比,它被称为具有最低的鲁莽或欺骗行为比例,同时对 Claude’s Constitution 的遵循也最强。
所属事件:Anthropic 发布 Claude Opus 5,性能达新 SOTA 且价格减半(25 条相关)→
「模型」频道最新
- Anthropic 发布 Claude Opus 5,盲测排名超过 GPT-5.6 — lennysan · 2026-07-25
- Notion 收购 ZeroEntropy,reranker 也开源成 Apache 2.0 — CShorten30 · 2026-07-25
- Anthropic 称 Opus 5 以半价逼近 Fable 5 基准表现 — dotey · 2026-07-25
- Opus 5 价格涨约 15%,但仍被视为 4.8 的严格升级 — bindureddy · 2026-07-25
- Fable 5.1 预计晚于 GPT-6,发布时间指向 8 月下旬到 9 月中旬 — zephyr_z9 · 2026-07-25
- ARC-AGI-3 图表显示 Opus 5 领先,但评测成本更高 — Angaisb_ · 2026-07-25