南大提出 HCL:不微调模型也能让 Agent 持续学习
机器之心 · wechat · 2026-08-28
南京大学与伍伦贡大学提出 Harness Continual Learning (HCL),将持续学习的对象从模型参数扩展到 Agent 的 Harness(包含提示词、记忆、技能、工具等)。在模型冻结的前提下,通过 Proposal-Evaluation-Commitment 闭环更新 Harness 状态。实验表明,该方法在 ALFWorld、Minecraft 和文本推理任务中显著提升了 Agent 性能(如 GSM8K 准确率从 49.4% 提升至 92%),并有效控制了遗忘。
「编程与Agent」频道最新
- 南京大学推 Procedura:基于 Agent 的可控 3D 建模 — nanjinguniv · 2026-08-28
- Agent 工具调用静默失效,生产环境难追踪怎么破? — Icy-Weakness8310 · 2026-08-28
- Helm MCP:让 AI 助手直接读取 Helm Chart 数据 — modelcontextprotocol · 2026-08-28
- SymPy Sandbox MCP:LLM 安全进行符号数学计算 — modelcontextprotocol · 2026-08-28
- LLM Agent 评估综述:构建二维分类框架与企业落地挑战 — kalyan_kpl · 2026-08-28
- 用 60 行 TS 构建科幻电影 RAG 智能体 — mastra_ai · 2026-08-28