博弈论与机器学习交汇:单/多智能体学习与均衡综述

bronzeagepapi · x · 2026-08-12

Panayotis Mertikopoulos 发布了关于博弈中学习理论的综述论文。文章从单智能体在未知对抗环境下的序列决策,延伸到多智能体交互环境。

核心探讨了基于正则化的学习策略,通过惩罚项鼓励探索并避免陷入次优选择。论文给出了对抗性多臂老虎机的遗憾界,证明了零和博弈中的均衡收敛性,并揭示了纳什均衡与动态稳定性的关联。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →