190 万轮真实对话后总结:生产级 Agent 的坑全在模型之外
thinkdifferent23225 · reddit · 2026-08-19
一位运营 150+ 生产环境销售 Agent(WhatsApp/SMS/Instagram DM,真实客户真金白银)的从业者分享了累计 190 万轮对话换来的实战教训:所有 Agent 在测试中都没问题,问题只在真实流量下暴露。
要点:
- 必须建终止状态门:没有停止条件的 Agent 会继续向已下单的用户推销,这是最丢人的翻车;「已购买/已预约/不合格」标志一翻就必须停。
- Agent 无法可靠上报自身状态:靠 prompt 让它设 flag 会静默失败,正确做法是用独立评估器事后读对话记录来设状态,会话 Agent 只负责说话。
- 跟进才是收入所在:多数线索不回第一条消息,赢家是第 2 天、第 5 天持续回来跟进的;某客户 1000 轮对话中 47 轮是在逐笔挽回拒付。
- 人工接管要设计成明确时刻,不是逃生舱:谁被通知、走什么渠道、带什么上下文都要定好。
- 指标是成交而非回复质量:花数月调出「读起来很美」的对话却零成交;改按预约/销量考核后,一半的「好实践」被证明只是 Agent 在讨好用户。
- 静默失败最致命:渠道断连仍显示「活跃」让某客户丢了 4 天线索,零流量窗口告警带来的留存提升超过任何新功能。
结论:换两次模型几乎没影响,模型外围的机器才是产品。
「编程与Agent」频道最新
- 开源多模型工作区 Legion:让 Grok、Claude、Gemini 同室协作互 @ — jasonkneen · 2026-08-19
- 4300 个真实编码 Agent 会话实测:缓存命中高但成本仍平方级增长 — CShorten30 · 2026-08-19
- Superset 智能体新增浏览器技能:可读 DOM、截图并点击 — ycombinator · 2026-08-19
- Google 推出 AI 动手实验:一个下午从想法到部署应用 — fhinkel · 2026-08-19
- SkillForge 开源:用红绿基线测试证明 Claude Code 技能有效 — tom_doerr · 2026-08-19
- 构想:由 AI Agent 维护的“无维护者”开源模式 — _Dave__White_ · 2026-08-19