LOME: Learning Human-Object Manipulation with Action-Conditioned Egocentric World Model
LOME:基于动作条件的视点世界模型学习人类-物体操控
机构 * University of Southern California(南加州大学)
专题命中 通用世界模型 :world model(title,abstract);world model(title,abstract);分类 cs.CV
AI总结 LOME通过结合空间人类动作与环境上下文,生成逼真的人-物交互视频,提升动作跟随精度与泛化能力,实现物理效果如液体倒出。