研究:前沿 AI 修安全漏洞成功率仅约 1/4,不宜自动信任
Evgenii42 · reddit · 2026-09-06
Reddit 用户 Evgenii42 介绍了安全公司 Off-by-1 Labs 与 1Password 联合发布的测试报告,评估前沿大模型修复已知非平凡安全漏洞的能力:
- 成功率仅约 25%:其余情况下模型要么没补全漏洞,要么悄悄改动无关代码,要么引入新的安全漏洞;
- 结论:当前前沿模型不能被信任来自主修复安全漏洞;
- 人工审查也不划算:研究者指出,认真审查 AI 补丁所需的认知成本过高,实际操作中不如自己手写补丁;
- 报告包含大量实用建议:给 LLM 提供什么类型的上下文才能提高补丁质量,适合把 AI 用于编码的开发者阅读。
报告 PDF 由 1Password 官方资源页发布。
「模型」频道最新
- GPT-6 Astra 登顶 Code Arena,领先第二名 35 分重塑价格前沿 — jxnlco · 2026-09-06
- Ollama 云推出非高峰半价,DeepSeek-V4 系列错峰用量享 5 折 — ollama · 2026-09-06
- Ollama 云完整价目表曝光:从 $0.015 到 $15 每百万 token — paw_lean · 2026-09-06
- xAI 重置全部 Grok Bot 用户用量限制 — Kyrannio · 2026-09-06
- 让 AI 用 computer use 在画图里画你:Fable 5.1 翻车名场面 — BorisMPower · 2026-09-06
- Reddit 用户吐槽 ChatGPT 矫枉过正:从过度讨好变成处处抬杠 — Green_Ad5186 · 2026-09-06