Living-Harness:让智能体 harness 进化,失败经验转为可复用记忆
burny_tech · x · 2026-07-31
LLM 智能体在单次任务中能自我纠错,但任务结束后往往会“遗忘”修复方法。这篇名为 Living-Harness Is an Interactive-Agent Evolver 的论文提出了一种让智能体框架自身进化的思路。
- 记忆与状态图:将评估器的反馈转化为情景记忆和状态图,使失败经验变成可复用的程序化修复手段。
- 工具冻结,工作流学习:底层工具保持不变,但工作流会学习何时触发修复、缺失了什么动作以及下次如何恢复。
- 效果:在 τ²-Bench 和 MultiWOZ-2.4 基准测试中,Pass@1 相比最强的交互式基线提升了约 10%。
「编程与Agent」频道最新
- Krea 2 多角色 LoRA 控件发布,精准解决面部混淆 — tekprodfx16 · 2026-07-31
- 用 Claude 一次提示生成完整 FPS 游戏 Demo — FinanceYF5 · 2026-07-31
- GPT-5.6 Luna 降价 80% 后实测:极速生成全栈代码 — BorisMPower · 2026-07-31
- 平民显卡玩转本地 AI Agent:云端大模型规划+本地小模型干活 — fire_inabottle · 2026-07-31
- AI Agent 也会崩溃?开发者吐槽需给智能体提供情绪支持 — mike64_t · 2026-07-31
- Google 发布免费 2 小时全栈 Agent 工程教程 — goyalshaliniuk · 2026-07-31