AI 时代怎么写测试:六条规则治住 mock 泛滥与脆弱测试
dotey · x · 2026-09-15
姚钢强连续发帖讨论 vibe coding 时代的软件质量:有人抱怨 bug 太多觉得「人肉写代码可能更快」,而让 AI 写测试的现实现是——不调教的话,AI 写出的全是充满 mock、测试实现细节的脆弱测试。他给出的核心主张是 Quality is designed in, not tested in,并总结业务项目的测试规则:
- 测行为不测实现:如「重复下单不会重复扣款」,而非方法被调用几次;AI 特别容易写出重构即碎的测试
- 用 BDD:先写验收场景再写代码,Given/When/Then 描述,让用户和 PM 也看得懂
- 禁止 mock:Redis、PostgreSQL 用真的,外部系统注入 fake 并校验契约,时间逻辑用 fake timer;AI 太爱随手 mock
- 倾向 E2E:从用户入口走到可见结果,测试多了分级精准跑
- 覆盖率后置:先定 90%,重点是追问剩余未覆盖的失败路径,别让 AI 凑数字
- 规则 lint 化:把前面的约定尽量写成 lint
他还预告后续聊关键设计与 review 该看什么。
「编程与Agent」频道最新
- Brex CEO 主张别做 Agent 做 AI 员工:卖工作成果而非卖软件 — petergyang · 2026-09-15
- 社区版 Grok Build 累计 13 万安装,AFK Pilot 可手机远程驾驶编码智能体 — PawelHuryn · 2026-09-15
- 老机器跑不动 Claude Code,开发者自写 harness 却被短上下文卡住 — danja · 2026-09-15
- Blender 动效+MiniMax H3 重绘:一条动力学排版视频完整工作流 — Hailuo_AI · 2026-09-15
- tszl 发问:Twitter 能否做支持读取 DM 的 MCP 服务 — tszzl · 2026-09-15
- MiniMax 发布 Design 创作台:一个 brief 驱动 Agent 全流程出片 — Hailuo_AI · 2026-09-15