Adaptive Robust Estimator for Multi-Agent Reinforcement Learning
自适应稳健估计器用于多智能体强化学习
机构 * Beihang University(北京理工大学) ; Peking University(北京大学) ; Chinese Academy of Sciences(中国科学院) ; Tsinghua University(清华大学) ; Department of XXX, University of YYY, Location, Country(XXX系,YYY大学,地点,国家) ; School of ZZZ, Institute of WWW, Location, Country(ZZZ学院,WWW研究所,地点,国家)
专题命中 数学推理 :reasoning(abstract);分类 cs.AI
AI总结 本文提出自适应稳健估计器和双智能体回答-批判-重写框架,解决多智能体协作中的信用分配和奖励噪声问题,提升训练稳定性与鲁棒性。