VLESA: Vision-Language Embodied Safety Agent for Human Activity Monitoring
VLESA: 用于人类活动监测的视觉语言具身安全智能体
机构 * Carnegie Mellon University(卡内基梅隆大学) ; Mitsubishi Electric Research Laboratories(三菱电机研究实验室) ; Harvard University(哈佛大学)
专题命中 安全训练 :safety(title,abstract);分类 cs.LG
AI总结 提出VLESA框架,通过自我中心视频监测人类活动,利用GRPO训练的目标条件安全Q过滤器进行实时安全干预,在ASIMOV-2.0基准上实现更高干预精度。
Comments 18 pages, 5 tables, 5 figures