Opus 5 刻意避开 cyber 训练,却仍接近 Mythos 5 的找洞能力
cedric_chee · x · 2026-07-25
Anthropic 这条信息透露,Opus 5 被刻意没有用 cyber 任务训练,原因是防御性限制;但即便如此,它在相关能力上仍然明显进步。
- 在发现安全漏洞方面,Opus 5 已经接近 Mythos 5。
- 但在把漏洞进一步转化为可用利用链/攻击能力上,Opus 5 仍明显落后于 Mythos 5。
- 配图还提到 OSS-Fuzz 评测:Opus 5 找漏洞的表现接近对手,但在 exploit 开发上的分数差很多。
所属事件:Anthropic 剖析 Opus 5 安全与漏洞发现能力(3 条相关)→
「模型」频道最新
- 马斯克称 Grok 4.6 两周内到,4.7 四周内到 — Acceptable-Debt-294 · 2026-07-25
- Quadrillion 实测:Opus 5 在 ML 任务上快过 Opus 4.8 — igarciacamargo · 2026-07-25
- Google 在多数基准上落后于开源权重模型 — burny_tech · 2026-07-25
- Claude Opus 5 在代码智能体基准拿到 67 分 — Hesamation · 2026-07-25
- 同规模对比评测显示:扩散模型整体落后,但在智能体循环更快 — Additional-Engine402 · 2026-07-25
- 图表显示 Opus 5 在中等思考模式下编码性能最佳 — dejavucoder · 2026-07-25