七年工程师:Agent 故障不报错,事故报告从不会以「AI 弄错了」收尾

ilien-dev · reddit · 2026-09-21

一位有七年经验、今年主用 agent 编程的工程师发文,指出 agent 的失败方式和脚本完全不同:脚本会抛错,agent 会「称职地做错事」,最后还给你一份漂亮的成功总结。最难的故障是那些顺利跑完、全绿通过、但底层假设没人检查的运行。

作者的立场:内部自用、爆炸半径只及自己的 agent,尽管放开去试;标明实验性质、提醒别盲信输出的免费工具也可以。但对收费、触碰他人资金或数据、且只能靠「问它自己」来诊断的 agent,是不可辩护的——而现在大量正在发布的产品正是这种。他最后抛出问题:对真实资金和客户数据跑 agent 的团队,你们有什么检查能真正抓住一次「干净的错误运行」?

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →