CI 全绿功能却从未生效:开发者揪出 20+ 个「隐形死功能」bug
Initial_Orange2985 · reddit · 2026-09-14
一位 AI 应用开发者在 Reddit 长文复盘:最危险的 bug 不是崩溃,而是「已构建、已接线、测试通过、CI 全绿,但生产环境从未真正执行」的功能,他自己就找到 20 多个。几个典型案例:
- 定时任务从未运行:调度器把 lastrun 存在内存里,而团队每天推送部署 5 次导致进程不断重启,任务上线两周实际执行 0 次;修复方式是把时间戳落盘,而非直觉上的「启动时补跑」(那样会多花 20% 的大模型调用)。
- 间隔重复引擎服务错了对象:代码唯一调用者注释写着「全局状态,一个学生」,而这个「学生」是助手自己;对真实用户开放后还发现复习间隔没有上限,20 次完美复习后下次复习排在 1.08 亿年后。
- 门控条件永远为假:某关键分支的第二个条件来自另一模块的隐私决策(匿名用户不持久化),而线上流量全为匿名,分支从未触发。
- 预取反帮倒忙:预测用户下一问并预计算的 prefetch 被记为省钱,实际每次命中都是损失——它用无上下文无来源的小模型答案替换了完整管线输出,且每轮都预取 3 个问题。
作者现在上线的检查清单:是否在真实请求路径上、门控条件在生产是否为真、输出有没人读(「计算后丢弃」看起来和计算了一样)、它为谁服务、结果是否真的优于正常路径。他自建了主路由可达性检查与每步通过计数,能抓「死分支」,但「服务错人」「方向错」类 bug 只能靠读代码发现。文末在征集:有没有类似 coverage 但基于真实生产流量的「分支从未执行」检测方案。
「编程与Agent」频道最新
- 开源 ComfyUI 节点上线,用 MiniMax H3 一键重打光生成视频 — Emotional_Example_12 · 2026-09-14
- 让 Agent 跑两天 QA 耗尽 300% 额度,登录按钮还是坏的 — jarrodwatts · 2026-09-14
- Hugo Bowne 开设 Agentic 数据科学课程,主打独立验证防泄露 — hugobowne · 2026-09-14
- 圈内人称 DeepSeek Harness 是实验室外最强多智能体编排 — bookwormengr · 2026-09-14
- 上下文压缩工具对比:pi-vcc 亚秒级无损 vs pi-blackhole 三模型召回 — mailto_devnull · 2026-09-14
- 教授禁用编程 Agent,学生反应成 AI 圈新梗 — CSProfKGD · 2026-09-14