Claude Opus 5放宽源码漏洞挖掘限制

Anthropic最新发布的Claude Opus 5调整了安全护栏策略,大幅降低了防御性漏洞发现的拦截率,降至13.9%。新策略允许模型在源码中进行漏洞挖掘,但仍会拦截针对编译后二进制文件的漏洞发现。这一变化表明Anthropic正试图在赋能安全研究与防范潜在恶意滥用之间寻找新的平衡点。

2026-07-25 ~ 2026-07-25 · 2 条相关