清华提出 CERA-MoA:路由器与智能体协同进化的强化学习框架
Tsinghua · hf · 2026-09-17
清华大学团队发布 CERA-MoA,解决现有 Mixture-of-Agents 中查询路由与智能体微调割裂的问题:
- 协同进化:迭代强化学习框架让动态路由器与各独立智能体策略共同演化,路由随智能体能力变化自适应调整
- 熟悉度估计器:利用中间层隐状态评估智能体间语义胜任度,避免完整 rollout 的开销
- 自适应路由:基于熟悉度分数的累积阈值机制,动态激活最小必要智能体子集,在性能与效率间取得平衡
- 定向训练:按智能体演化中的能力主动分配训练样本,促进能力分化
多领域实验显示,CERA-MoA 优于最先进的静态智能体路由与固定工作流微调基线。
「编程与Agent」频道最新
- 开发者用 LLM 对话式做出完整多人游戏 Tideball,回击「AI 做不出成品游戏」 — TAbrodi · 2026-09-17
- 多模态 RAG 被严重低估:别把音频视频先转成文本再检索 — victorialslocum · 2026-09-17
- Stripe Directory 实测:商家攻略让 Agent 购物成功率 20/28 升至 24/28 — jeff_weinstein · 2026-09-17
- 开发者分享 3D 浏览器游戏 vibe coding 全流程:几小时出成品 — chongdashu · 2026-09-17
- Mac MCP 2.1.4 发布:公网端点、SSRF 加固与事务撤销 — bulutarkan · 2026-09-17
- AI 电影制作的难点已不是画质,而是跨集连续性 — Ok_Low_5536 · 2026-09-17