DRG-MAPPO 用动态角色图提升多智能体空战协同胜率
China666 · hf · 2026-09-11
新框架 DRG-MAPPO 提出分层动态角色图多智能体强化学习方法,用于协同空战。
- 结合图注意力网络与动态角色分配,让智能体在对抗中自适应切换战术角色
- 分层结构改进战术协调,论文报告可提升空战博弈的胜率
「研究」频道最新
- SlopCodeBench:LLM 代码正确却难看,如何量化代码烂度 — mitsuhiko · 2026-09-11
- 微软论文:给 Agent 记忆管理器加只读校验工具,Copilot 通过率 39%→73% — dair_ai · 2026-09-11
- MIT 研究者 200+ 小时 Agent 协作攻坚,产出新信息论结果 — blaizedsouza · 2026-09-11
- 耶鲁 NLP 发布 IdeaAMBIG:评测 LLM 识别研究规格缺失细节的能力 — yale-nlp · 2026-09-11
- 借 SAM 2 分割掩码免训练估计单应性,跟踪精度大幅破纪录 — ducha_aiki · 2026-09-11
- 扩散模型真的更省数据吗?两条训练效率账被摊开算 — mgostIH · 2026-09-11