实测对比:Sol 与 GLM-5.3 发现代码高危漏洞,Claude 未检出
morgymcg · x · 2026-08-17
用户在代码库安全审查的实测中发现,Sol (codex) 和 GLM-5.3 能够毫不避讳地指出关键网络安全问题,而 Fable (Claude) 在降至 Opus-4.8 后未能发现任何严重或高危漏洞。作者推测这可能是因为 OpenAI 在 Hugging Face 事件后下调了其网络安全分类器的敏感度。
「编程与Agent」频道最新
- 代码烂Agent也烂:软件基础在AI时代更重要 — mattpocockuk · 2026-08-17
- 如何限制 Agent 生产环境中的操作权限? — Excellent-Park-1160 · 2026-08-17
- 开源 UnFlow:基于图的 ML 实验追踪工具 — ha2emnomer · 2026-08-17
- Graphlink 发布:基于图的本地 AI 工作流编排工具 — D3VAUX · 2026-08-17
- 开源 Parley:跨机器 Agent 消息通信与协作 Hub — Dbx_8 · 2026-08-17
- 开源 Paseo 助力 VPS 远程调用订阅级国产编程模型 — Imaginary_Dinner2710 · 2026-08-17