人工救场之后怎么办:把修正反馈写回 agent 技能版本
Jimcy-Maffesoli · reddit · 2026-09-14
作者讨论 agent 被人工干预救回后,修正信息该流向哪里的问题:如果修正只留在人的脑子里,下次运行同样的 agent 还会踩同样的坑。
帖子介绍了 Reef 的 harness 教程给出的反馈回路:记录原始请求,把评分和修正附着到该次运行的 receipt 上,让模型据此提出技能(skill)修改方案,然后在相同任务集上对比测试当前版本与修改后的 harness,再发布新版本。
作者承认这套流程仍留下两件事给人:定义「好修正」的标准、以及实际安装选定的版本。但关键是让人工干预成为下一次演化的输入,而不是随工单关闭而消失。
「编程与Agent」频道最新
- 开源 BountyScout:每小时自动扫描 GitHub 悬赏并推送提醒 — gleech · 2026-09-14
- AI 智能体扫描亚马逊和 eBay 自动套利赚钱 — gleech · 2026-09-14
- 编剧称愿放弃全部Claude额度只为换取Fable 5.1用量 — iannuttall · 2026-09-14
- 多 Agent 编排反而更慢?实测者称单强 Agent+编排器更靠谱 — duku-95 · 2026-09-14
- 不会写代码的用户靠 Grok 智能体把「机器人厅」搬进 VR — tetsuoai · 2026-09-14
- OpenAI 托管 Agent 运行时上线,可审计性成信任边界新问题 — Mediocre-Main-9870 · 2026-09-14