HomeSafeBench: Benchmarking Embodied Vision-Language Models in Free-Exploration Home Safety Inspection
HomeSafeBench:面向自由探索式家庭安全检查的具身视觉-语言模型基准
机构 * Beijing Institute of Technology(北京理工大学) ; Beihang University(北京航空航天大学)
AI总结 研究针对家庭安全隐患检查需求构建HomeSafeBench基准,提出CueBack数据构建方法,微调4B规模VLM使分布外测试集F1值显著提升,缩小了与人类检查员的性能差距。
Comments Preprint