1Password 实验:AI 修安全漏洞仅 26% 成功,未经审查补丁净负收益
GaryMarcus · x · 2026-09-06
1Password 研究人员用 Claude 和 ChatGPT 对真实漏洞跑了 6000 多个 AI 生成的补丁,结果很不乐观:AI 只有 26% 的时候能真正修好安全漏洞,一半的情况下连原始 bug 都没修掉,更有 4.5% 的情况引入了原本不存在的新漏洞。
研究还发现,审查一个 AI 生成的安全补丁所花的精力,往往超过自己直接写修复。因此报告结论直言:完全由 LLM 生成、不经人工审查的补丁,其期望收益「在相当大的幅度上是净负值」。
Gary Marcus 转发了这份研究,并点名 OpenAI 今年夏天推出的「Patch the Planet」计划——让 AI 找漏洞并自动生成修复——正建立在这种被质疑的前提上。
所属事件:研究称前沿 AI 修安全漏洞成功率仅 26%(2 条相关)→
「漫话AGI」频道最新
- 马斯克放话 3 年内机器人外科医生超越全球最佳医生 — r0ck3t23 · 2026-09-06
- "父母打电话说治疗有效":这才是最值得期待的 AI 未来 — rand_longevity · 2026-09-06
- azr:期待 Neuralink 实现「下载知识到大脑」的 text-to-LoRA — beffjezos · 2026-09-06
- 博客长文:人类不会是 LLM 的经济性互补者,「品味是瓶颈」论站不住 — zetalyrae · 2026-09-06
- Exponential View 第600期:GPT-6 Astra 登顶多项基准引安全争议 — Exponential View (Azeem Azhar) · 2026-09-06
- MIT SMR:只投资 AI 的领导层正在让深度思考与直觉流失 — marigo · 2026-09-06