ICLR 论文:注入干扰项可提升 LLM 智能体跨域泛化能力

zhaoran_wang · x · 2026-07-27

一篇关于 LLM 智能体强化学习(RL)的研究论文探讨了如何降低跨域泛化带来的性能损失。

核心发现:

所属事件:ICLR论文:状态信息量决定LLM智能体泛化能力(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →