Multi-Objective Reinforcement Learning for Large-Scale Tote Allocation in Human-Robot Collaborative Fulfillment Centers
大规模人机协作分拣中心中的多目标强化学习用于托盘分配
机构 * Department of Computer and Information Science, University of Pennsylvania, Philadelphia, PA, USA(计算机与信息科学系,宾夕法尼亚大学,费城,PA,USA) ; Amazon(亚马逊)
AI总结 本文提出了一种多目标强化学习方法,用于解决大规模人机协作分拣中心中的托盘分配问题,通过权衡处理速度、资源使用和空间利用等目标,实现了高效且满足约束的策略学习。