人工救场之后怎么办:把修正反馈写回 agent 技能版本

Jimcy-Maffesoli · reddit · 2026-09-14

作者讨论 agent 被人工干预救回后,修正信息该流向哪里的问题:如果修正只留在人的脑子里,下次运行同样的 agent 还会踩同样的坑。

帖子介绍了 Reef 的 harness 教程给出的反馈回路:记录原始请求,把评分和修正附着到该次运行的 receipt 上,让模型据此提出技能(skill)修改方案,然后在相同任务集上对比测试当前版本与修改后的 harness,再发布新版本。

作者承认这套流程仍留下两件事给人:定义「好修正」的标准、以及实际安装选定的版本。但关键是让人工干预成为下一次演化的输入,而不是随工单关闭而消失。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →