很多 agent 失败,其实是人类交接没设计好
Fit_Average8352 · reddit · 2026-07-28
作者认为,很多 agent 真正最难的部分不是模型本身,而是交给人类接手的那一步:产物要被检查、重排版、判断能不能安全发送,实际工作量都转移到了这一步,但它往往没人正式负责。
在他们团队里,这个责任默认落到最谨慎、最不敢乱发的人身上。后来他们把它改成一个显式的审核环节:agent 先产出草稿,再由轮值的指定人员审阅签字,审核时间也明确记在这个人的工作量里,而不是被“最负责的人”无声吸收。结果并没有变慢,只是把原本隐形的劳动显性化了。
作者的结论很直接:如果一个 agent 每天都有人在背后默默收拾烂摊子,那你不是有了一个能工作的 agent,而是多了一个没人配人的岗位。
「编程与Agent」频道最新
- 12 个真实多应用智能体任务中,Fable 5 与 Kimi K3 同为 7/12 — Nearby_Pair_6483 · 2026-07-28
- 用户称本周要把 Codex 用到所有事情里,界面已显示周度额度 — rudrank · 2026-07-28
- 别被平均对话轮次误导:客服与编程 Agent 需要不同架构 — hugobowne · 2026-07-28
- 有人在 Claude Code 的 ultra mode 里测试 Qwen 3.8 Max — jasonkneen · 2026-07-28
- 有人想要能说能听还会调度 agent 的本地 ChatGPT Live — anonthatisopen · 2026-07-28
- EviBack 用教师回退训练 agentic RAG 的零奖励轨迹 — _reachsumit · 2026-07-28