EVISKILL:用可重放证据卡让 LLM agent 技能持续进化
Yan Zhou · hf · 2026-10-07
论文提出 EVISKILL,解决 LLM agent 从交互经验中持续积累技能时证据丢失的问题。现有方法在编辑技能时可能丢失支撑修改的行为证据与任务上下文,且全局验证对局部修改的判断不完整。EVISKILL 将执行观察组织为可重放证据卡(Replayable Evidence Cards),编辑与支撑上下文显式关联;通过定向重放再执行来验证编辑并反馈修正。跨 epoch 时暂留有证据支撑的编辑供进一步精炼,全局验证决定是否并入最终技能。
在 3 个交互基准、6 个 LLM 骨干上验证有效。
「编程与Agent」频道最新
- 10.5k 星 video-shotcraft:用 Claude Code 自动产出电影感产品视频 — tom_doerr · 2026-10-07
- 让 SWE Agent 给自己的 RAG 定位:结论是「你还缺那个 R」 — Kooky-Sorbet-5996 · 2026-10-07
- 南洋理工实证:agent 判定检索无用,却几乎不会因此停手 — nanyang-technological-university-singapore · 2026-10-07
- 基因泰克 AutoSciBench:自动生成基准让 agent 准确率降 25 分 — Genentech · 2026-10-07
- CMU 提出 SSR:把推理改成选择,推理延迟降 90% — CarnegieMellonU · 2026-10-07
- GUI-HARVEST 冻结模型自动优化执行框架,GPT-5 提升 13.87 分 — CUHK-SZ · 2026-10-07