工程师用 AI 造并发测试工具:无规约语言也能抓真 bug
cto_junior · x · 2026-09-23
ctojunior 在推文串中分享:他们用 AI 帮忙构建了一个并发 bug 测试工具,不追求 TLA+ 式的形式化证明——TLA+ 检查器会穷举一定规模内的所有执行顺序,而他们的工具只尝试调度器给出的顺序。代价是不需要学习规约语言,但依然抓到了真实的并发 bug。
他的实用建议:如果你怀疑 AI 写的模型有问题,先拿一个你已经理解的 bug 来测试它——因为很容易把同一个错误假设自动化两次,自我验证会互相印证。后续推文还补充:一些失败其实是模型本身的错误而非代码 bug,所以每个失败都会对照真实代码检查,模型犯的错也被存成测试用例;他们借助 hypothesis 库做失败精简(shrink),把 40 步随机执行压缩成最小复现序列,再固化成普通单元测试。
所属事件:工程师用 LLM 穷举线程顺序揪出并发 bug(4 条相关)→
「编程与Agent」频道最新
- MCP+Codex 全自动迭代咖啡机接水盘:用户只需按打印键 — hrishioa · 2026-09-24
- Yacine 谈 LLM 强化学习:一切像带着 400 步梯度延迟在训练 — cephaloform · 2026-09-24
- 开源 barq:一句话驱动真实浏览器,不可逆操作前自动停下 — ibhajjaj · 2026-09-24
- Opus 5.5 半小时生成带音乐的赛博朋克像素动画,单 HTML 文件完成 — itsmnjn · 2026-09-24
- Gemini 应用新增一批 MCP 连接,可直接调用外部服务 — GeminiApp · 2026-09-24
- Gemini 接入 Webflow:一句话即可改版面并发布网站更新 — GeminiApp · 2026-09-24