BeSafe-Bench: Unveiling Behavioral Safety Risks of Situated Agents in Functional Environments
BeSafe-Bench:揭示功能环境中情境代理的行为安全风险
机构 * Southern University of Science and Technology(南方科技大学) ; Huawei RAMS Lab(华为RAMS实验室)
专题命中 幻觉与鲁棒性 :VLM(abstract);分类 cs.AI
AI总结 本文提出BeSafe-Bench,通过构建功能环境和引入九类安全关键风险,评估代理在Web、Mobile、Embodied VLM和Embodied VLA等领域的行为安全风险,发现最佳性能代理在安全约束下完成任务的比例不足40%。