Constrained Multi-Objective Reinforcement Learning with Max-Min Criterion
带最大最小准则的约束多目标强化学习
机构 * Robotics Institute, University of Toronto(多伦多大学机器人研究所) ; Faculty of Engineering, Bar-Ilan University(巴伊兰大学工程学院)
AI总结 提出一种融合最大最小准则与显式约束满足的多目标强化学习框架,通过理论分析和表格实验验证收敛性,并在建筑热控制、多目标运动控制和温室气体排放感知交通管理中展示其平衡公平性与约束满足的有效性。
Comments Accepted to ICML 2026