开发者实测:让 AI 只写 E2E 测试,砍掉事后单元测试
alexcovo_eth · x · 2026-09-21
- 开发者 anshnanda 分享自己写在 AGENTS.md 顶部的测试规则,背景是引用吐槽:Opus 会为一个常量字符串是否包含子串追加 10 个单元测试。
- 他的核心规则:绝不在写完代码后再补单元测试;优先用 E2E 测试作为唯一测试机制,用它验证复杂功能是否可用,并要求 E2E 最后产出可验证、可复现的 artifact。
- 如果必须对系统做隔离测试,则先穷举所有可能的失败方式,再写代码。
- 这一「先写失败路径、靠 E2E 兜底」的思路针对的是 LLM 生成大量低价值单元测试的通病。
「编程与Agent」频道最新
- Thorsten Ball 断言:代码评审将死,单元测试也难逃一劫 — rseroter · 2026-09-22
- Tinfield 1 开源发布:177B 参数终端编码模型自称超越 Claude Opus 4.8 — victormustar · 2026-09-22
- LangChain 推出决策模型 SemIf:结构化分类免费开放 — LangChain · 2026-09-22
- Qwen Code Desktop v0.24.3 发布:新增钉钉输出、bwrap 沙箱等更新 — github-actions[bot] · 2026-09-22
- Chris Ré 组:智能体接管抽象层,CUDA DSL 该退休了 — ricklamers · 2026-09-22
- 马斯克晒多智能体工作流:Grok Bot 统筹 Claude Code 与 Codex — elonmusk · 2026-09-22