开源GLM-5.3漏洞利用能力逼近Claude

Andrew Ng 在本周 The Batch 信中聚焦模型安全能力,介绍 Anthropic 对开源权重模型 GLM-5.3 的网络安全评估:在 ExploitBench 漏洞利用任务子集上,GLM-5.3 取得 12% 的成绩,接近 Claude 的 14%;该模型还以约 20 美元的成本找出 Chrome 漏洞,引发对开源模型攻防能力快速提升的关注。

2026-10-02 ~ 2026-10-04 · 2 条相关