GLM-5.3网络攻防评测出炉:漏洞发现持平,漏洞利用落后Mythos
pstAsiatech · x · 2026-08-19
GLM-5.3 在 CyberGym(读代码、发现并确认安全漏洞)上得分 84.5%,略高于 Mythos 5 报告的 83.8%。但在把漏洞转化为可用 exploit 的 ExploitBench 上差距明显:54.4% 对 78.0%;两小时内完成的限时攻击开发任务为 105 个对 181 个。
作者指出 Mythos 最初被宣传为防御性网络工具,Anthropic 通过复杂的 harness 与 agent 平台把它变成了强大的进攻性网络能力——关键不只是模型本身,而是完整栈工程与网络作战知识。
所属事件:GLM-5.3攻防评测曝光,智谱限制网络安全能力访问(2 条相关)→
「模型」频道最新
- GLM-5.3 规模减半,峡谷飞行跑分胜过 Grok 4.6 — MaziyarPanahi · 2026-08-19
- Gemini 3.7 Flash 登顶 AA-AnalystAgent 榜单 — _philschmid · 2026-08-19
- 实测对比:Kimi K3 视觉胜出,Gemini 交互更强 — gaganghotra_ · 2026-08-19
- Deft模型声称可规避AI检测,写作拟人度达86% — churchkey · 2026-08-19
- 商汤 SenseNova-U1.5 登陆 ComfyUI,24GB 显存可跑 — qqzjy · 2026-08-19
- 智谱为GLM-5.3设分层风险审查,主动公开AI安全承诺 — pstAsiatech · 2026-08-19