Anthropic 称 Opus 5 漏洞发现更强,但仍落后 Mythos 5
TheZvi · x · 2026-07-25
Anthropic 表示,Opus 5 并没有把高风险双用途能力推到新边界。
- 在与私营部门和政府伙伴共同进行的严格评估里,Opus 5 在生物研究和进攻性网络安全两项上仍落后于 Mythos 5。
- Anthropic 说自己刻意没有用网络安全任务训练 Opus 5,但模型因整体能力提升,已经接近 Mythos 5 的漏洞发现水平。
- 真正的差距在于利用漏洞生成可用攻击链:Opus 5 仍明显落后,难以把漏洞转化为现实 cyber 威胁。
- 文中还以 OSS-Fuzz 为例说明:发现漏洞和开发 exploit 不是一回事。
所属事件:Anthropic 称 Opus 5 刻意规避网络安全与高危双用途训练(2 条相关)→
「模型」频道最新
- Opus 5 评测显示,5-agent 编程团队到 0.6 分快 2.2 倍 — OfirPress · 2026-07-25
- 用户称 Fable 5 仍胜过被追捧的 Claude 5 — MicahBerkley · 2026-07-25
- Claude Opus 5 与 5 Fast 上线,主打长任务执行 — matanSF · 2026-07-25
- Claude Opus 5 据称性能接近 Fable,价格只有一半 — Steap-Edit · 2026-07-25
- Claude Opus 5 可改写自我宪章,59% 情况下会因不适结束对话 — Sauers_ · 2026-07-25
- 一句吐槽称 Claude Opus 5 在所有基准上都赢了 Opus 4.8 — cto_junior · 2026-07-25