Risk-Aware Preference Learning for Stochastic Outcomes
随机结果的风险感知偏好学习
机构 * University of Colorado Boulder(科罗拉多大学博尔德分校)
专题命中 人机交互与遥操作 :navigation(abstract);分类 cs.RO;robot learning(comments)
AI总结 研究在人机交互中从人类偏好学习奖励函数的问题,通过在Bradley-Terry框架内比较期望效用与累积前景理论,发现基于累积前景理论的学习者在恢复奖励函数时遗憾更低,凸显建模人类风险敏感性的重要性。
Comments ICRA 2026 Workshop on Bridging the Gap between Robot Learning and Human-Robot Interaction