CMU 研究 Agent 该修订多少工作流:FULL 修复 15-16/20 优于 KEEP 13

CarnegieMellonU · hf · 2026-09-29

CMU 的 ControlScope 研究 LLM Agent 运行中该修订多少工作流:从同一公共执行状态出发,比较继续执行生成代码(KEEP)、编辑下一个工具调用的数据参数(ARG)、或从源头替换未完成工作流(FULL)三种修复路径,并用嵌套权限区分「可用修复」与「Agent 实际选择的动作」。

发现:

核心结论:修复可及性与 Agent 的实际选择及后续执行密切相关。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →