让 AI 生成测试致测试目录指数膨胀,开发者热议如何把关
arthurcolle · x · 2026-09-08
- 开发者 granawkins 提问:大家是否任由 codex/claude 等 AI 构建「指数膨胀」的测试目录?自己虽在 PR 里扫一眼改动,但基本忽略 test 文件,结果 AI 加了大量测试。
- sadasant 先以玩笑回应(让 Astra 建测试、用高斯变异采样回归最优测试、用 GAN 让分支竞争、搞 ELO 排行榜),随后给出正经建议:设一个最低质量基准,让模型自报结果再抽查核验,保留 traces,勤做 postmortem。
所属事件:AI生成测试致目录指数膨胀,开发者热议把关(2 条相关)→
「编程与Agent」频道最新
- AI操控酵母菌落挑选仪,全自动酵母工程实现 — nlarusstone · 2026-09-08
- 开源chalkboarding技能:AI生成黑板风格教学动画 — Madisonkanna · 2026-09-08
- 调试 Agent 工作流:trace 里看着健康的步骤,凭什么敢排除? — Sensitive-Parsnip-12 · 2026-09-08
- Notch 晒体素渲染器压测:一条渲染管线描述都不用写 — anselm · 2026-09-08
- Agent 犯错之后谁来兜底?生产团队呼吁「可回滚层」 — Anxious-Variation508 · 2026-09-08
- 智库高管吐槽:没见过高智商的人同时跑一堆随机 Agent — examachine · 2026-09-08