Codex在成熟库里找出失败案例
ErnestRyu · x · 2026-07-14
SymPy 里的 agentic bug hunt
作者补充说,SymPy 作为数学基础设施,原本被认为已经很“经得起考验”。但在这个项目里,他的 UCLA 博士生 Xinjie 和 Hyunsik 使用 Codex + GPT-5.6,仍然在其中找到了很多“非常简单”的失败案例。
这强化了一个信号:即便是成熟、核心的开源项目,编程智能体也能作为真实的代码审计/漏洞发现工具发挥作用。
所属事件:Codex 在 SymPy 中挖出多处正确性漏洞(3 条相关)→
「编程与Agent」频道最新
- 有人想给软件工程任务建「形态分类」数据库,好按任务选模型 — StewartalsopIII · 2026-09-11
- 用 prompt 造硬件:一次对话让智能体组装定制设备寄到家 — paraschopra · 2026-09-11
- 模型之外才是关键:一文拆解 RAG 到多智能体的六大 AI 架构 — goyalshaliniuk · 2026-09-11
- 零基础开发者自建分层记忆架构,仅 20k token 记住一年对话 — matteoianni · 2026-09-11
- Warp 六个非工程团队全用 Linear 和 Claude Code 工程化运作 — mon__lim · 2026-09-11
- 九年后端老兵:AI 代码不比人写的差,变糟的只是速率 — Sweaty-Landscape-561 · 2026-09-11