Dream2Reward: Transition-Alignment Reward Models from Positive Demonstrations for Robotic Manipulation
Dream2Reward:基于正演示的机器人操纵转换对齐奖励模型
机构 * School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) ; Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) ; JD Explore Academy(京东探索学院)
专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);robot learning(abstract);分类 cs.RO
AI总结 Dream2Reward从正演示学习成功潜在转换场,通过转换级比较生成密集因果奖励,可提升机器人操纵的成功-失败区分度与下游策略性能。
Comments 12 pages, 7 figures