近日,中南大学自动化学院教授、博士生导师罗彪应邀为我院师生作题为“深度强化学习多目标决策”的学术讲座。讲座围绕深度强化学习在复杂控制与决策问题中的应用展开,重点介绍了多目标决策任务的基本特点以及Pareto多目标强化学习方法。湘潭大学计算机学院郑金华教授主持了本次讲座。

讲座中,罗彪教授指出,许多实际决策任务同时包含多个相互冲突的目标,标准强化学习方法在实用性和灵活性方面因此面临挑战。针对单智能体和多智能体多目标决策问题,他介绍了PA2D-MORL与MO-MIX两类Pareto多目标强化学习方法,并分享了通过相关方法获得高质量Pareto策略集的研究思路,为复杂多目标控制与决策问题提供了新的研究视角。

讲座结束后,现场听众积极参与提问,谢教授一一给予了详尽的回答,现场氛围热烈而融洽。整场讲座不仅让参与者对深度伪造视频有了更加全面和深入的理解,同时也激发了他们对相关研究工作的兴趣和热情。
罗彪教授长期从事智能控制与决策、博弈、深度学习和强化学习研究。近年来,他在IEEE TPAMI、Automatica、AAAI、ICML、《自动化学报》等国际国内重要期刊和会议发表学术论文100余篇,主持或参与多项高水平科研工作,曾获国家自然科学基金青年科学基金项目、湖南省科技创新领军人才、湖南省杰出青年科学基金等项目或人才称号,并担任中国自动化学会自适应动态规划与强化学习专业委员会副主任。
本次讲座系统梳理了深度强化学习面向多目标决策的研究问题与方法,为师生进一步理解Pareto策略集及其在复杂决策场景中的应用提供了参考,吸引了众多师生前来参加,现场气氛热烈,参会人员与罗彪教授进行了深入的交流和讨论,得到了在场学生的高度评价。




