Agent 开始做错事时,系统里谁有权力真正叫停它?

No_Progress92 · reddit · 2026-08-31

作者指出 agent 在规划、工具调用与多步工作流上进步很快,但「控制」仍是短板:大多数方案的护栏只是 prompt 指令、框架内软约束或事后人工审查,一旦 agent 真正持有工具、文件与系统权限就不可靠。他正在开发一个开源方案,把控制做成独立的运行时边界,聚焦身份、权限、校验与 agent 无法篡改的审计链,并征集大家如何在系统中实现「有权威的停止」。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →