SkillEvo:利用多轮反馈实现智能体技能持续进化
zju · hf · 2026-08-21
SkillEvo 是一种通过多轮交互反馈实现自我更新的进化梯度方法。它通过主动治理来维持进化梯度,从而改善 Agent 的技能表现,旨在解决智能体在长期交互中能力停滞的问题。
「研究」频道最新
- 中港团队开源 Libra,智能体训练吞吐提升 3 倍 — jiqizhixin · 2026-08-21
- Patronus 开源 200 小时 Figma 设计轨迹数据集 — Div_pradeep · 2026-08-21
- 模型评测深坑解析:Prompt、参数与引擎如何影响分数 — rsasaki0109 · 2026-08-21
- CMU 等联合发布 DelusionEval:揭示 LLM 强化幻觉与安全随长度退化 — burkov · 2026-08-21
- 预训练还有巨大优化空间,算力是唯一瓶颈 — zeeshanp_ · 2026-08-21
- PNAS研究:X算法常推送违背你价值观的内容 — msbernst · 2026-08-21