复旦 FEE 环境:以反馈增强引导长程任务自进化智能体
FudanUniversity · hf · 2026-09-09
复旦大学团队提出 Environments as Scaffold / Feedback-Enriched Environments (FEE) 框架。
核心方法:
- 让任务环境自适应调整,在观察层面提供引导性反馈
- 通过丰富环境反馈来提升强化学习的稳定性与探索效率
- 目标是让智能体在长程(long-horizon)任务中实现自进化(bootstrap)
属于智能体 RL 训练的环境设计方向。
「编程与Agent」频道最新
- 腾讯混元发布 Gander:全双工多模态交互智能体技术报告 — Tencent-Hunyuan · 2026-09-09
- Google 提出程序化图:自进化执行结构改善 LLM 智能体长程工具调用 — google · 2026-09-09
- Perplexity 搜索接入 Hermes Agent,索引超 4500 亿 URL — NousResearch · 2026-09-09
- FrogNano:4B 纯 RL 训练模型拿下 SWE-bench 61.5% — sivareddyg · 2026-09-09
- 免费 MIT 协议 AI 工程师指南:523 课 20 阶段约 342 小时 — Roger_M_Taylor · 2026-09-09
- freeCodeCamp 长文:用 Claude Code/Codex/Gemini CLI 重建 AI 原生 SDLC — Roger_M_Taylor · 2026-09-09