北京时间2023年4月28日,,,,,第八期 优德官网-TNSE 团结优异讲座系列运动在线上乐成举行。。。。。。此次,,,,,我们有幸约请到北京大学的邓小铁教授先容基于马尔科夫博弈的近似完善平衡,,,,,并分享他在这个领域内的相关研究效果与有趣发明。。。。。。

本次讲座由 优德官网 副院长兼群体智能中心主任、香港中文大学(深圳)协理副校长、校长讲座教授、IEEE TNSE 主编黄建伟教授担当执行主席和主持人。。。。。。
马尔科夫博弈与马尔科夫决议历程相类似,,,,,支持了许多人工智能和机械学习的相关研究,,,,,虽然其在看法上直截了当,,,,,并且不涉及不可信的威胁(比平衡属性更强),,,,,可是在马尔科夫博弈中寻找完善平衡仍然很是难题。。。。。。现有的要领主要研究马尔科夫博弈的特殊情形,,,,,或是忽略其动态性子以将研究限制在较弱的纳什平衡看法。。。。。。邓小铁教授及其相助者针对上述挑战,,,,,证实晰马尔科夫博弈中近似完善平衡的盘算等同于简单状态设置中的纳什平衡,,,,,并展示了其 PPAD 难的完整性。。。。。。
邓小铁教授及其相助者首先在战略概况空间上结构了函数,,,,,使每个战略概况都是该函数的不动点,,,,,当且仅当它是马尔科夫博弈的完善平衡,,,,,通过函数的一连性证实及 Brouwer 不动点定理包管了不动点的保存。。。。。。随后,,,,,通过对该函数的近似属性剖析,,,,,将目的转换为寻找 Lipschitz 函数的近似不动点。。。。。。最后,,,,,藉由 Papadimitriou 提出的定理证实完成该问题 PPAD 难的完整性。。。。。。
邓小铁教授的精彩分享发人深思,,,,,在加入者与两位教授的起劲讨论中,,,,,涌现了许多有趣的问题。。。。。。例如,,,,,思量具有一连行动或状态空间的马尔科夫强化学习;;;;;马尔科夫博弈与平均场博弈之间的区别与联系;;;;;博弈动态属性在详细场景中的应用等。。。。。。
视频回首:https://www.bilibili.com/video/BV16o4y1L7k8/
*特殊鸣谢李想对本文的孝顺
