Claude Opus 5 漏洞测试领先,但过度活跃也带来噪声

Thom_Wolf · x · 2026-07-29

在一个网络安全基准测试中,Claude Opus 5 找到的漏洞数量超过了其他前沿模型,表现略高于 GPT-5.6 Sol。

不过作者也指出,Opus 5 比前代更“hyperactive”:它会做更多不一定被要求的尝试,这确实提升了漏洞发现率,但也带来了更高的结果噪声。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →