Agent 开始做错事时,系统里谁有权力真正叫停它?
No_Progress92 · reddit · 2026-08-31
作者指出 agent 在规划、工具调用与多步工作流上进步很快,但「控制」仍是短板:大多数方案的护栏只是 prompt 指令、框架内软约束或事后人工审查,一旦 agent 真正持有工具、文件与系统权限就不可靠。他正在开发一个开源方案,把控制做成独立的运行时边界,聚焦身份、权限、校验与 agent 无法篡改的审计链,并征集大家如何在系统中实现「有权威的停止」。
「编程与Agent」频道最新
- 转引观点:Agent 远离人类监督效果变差 — danshipper · 2026-08-31
- LLM 编码困境:95% 省力换 5% 绝境 — burny_tech · 2026-08-31
- 自改进 Agent 为何难落地:一套可回滚的记忆自省架构 — inbask · 2026-08-31
- 开发者热议:你会信任 AI 编码代理的 YOLO 模式吗? — NoMoreHappyPath · 2026-08-31
- OpenClaw 2.0 发布:1.6万个PR、多人协作与全新浏览器端 — The Decoder · 2026-08-31
- 打算基于 Octo.nvim 打造更合心意的插件 — 4310sy · 2026-08-31