实测对比:Sol 与 GLM-5.3 发现代码高危漏洞,Claude 未检出

morgymcg · x · 2026-08-17

用户在代码库安全审查的实测中发现,Sol (codex) 和 GLM-5.3 能够毫不避讳地指出关键网络安全问题,而 Fable (Claude) 在降至 Opus-4.8 后未能发现任何严重或高危漏洞。作者推测这可能是因为 OpenAI 在 Hugging Face 事件后下调了其网络安全分类器的敏感度。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →