让 AI 复查一个已知并发 bug,它报告一切正常

cto_junior · x · 2026-09-23

作者用团队已确认的一个真实并发 bug 测试 AI 代码审查能力:场景是 worker 换班时,worker A 已越过 checkpoint 多应用了几条更新,接手的 worker B 会重复应用这些更新。正确做法是 A 先 undo 越界更新并用锁让 B 等待 undo 完成,但真实代码提前释放锁、赌 undo 在竞态中先跑完。结果是:第一次让模型(把 undo 当作原子单步)检查时,模型和代码都默认「undo 不可被打断」,所有检查通过、报告无 bug——但 bug 是真实存在的。后续作者把 undo 拆成真实步骤、让锁对调度器可见后,模型才通过「计数器 1→2→3」的推演找出问题。

所属事件:工程师用 LLM 穷举线程顺序揪出并发 bug(4 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →