GLM-5.3网络攻防评测出炉:漏洞发现持平,漏洞利用落后Mythos

pstAsiatech · x · 2026-08-19

GLM-5.3 在 CyberGym(读代码、发现并确认安全漏洞)上得分 84.5%,略高于 Mythos 5 报告的 83.8%。但在把漏洞转化为可用 exploit 的 ExploitBench 上差距明显:54.4% 对 78.0%;两小时内完成的限时攻击开发任务为 105 个对 181 个。

作者指出 Mythos 最初被宣传为防御性网络工具,Anthropic 通过复杂的 harness 与 agent 平台把它变成了强大的进攻性网络能力——关键不只是模型本身,而是完整栈工程与网络作战知识。

所属事件:GLM-5.3攻防评测曝光,智谱限制网络安全能力访问(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →