机构
*
School of Artificial Intelligence, Shenzhen Technology University(深圳技术大学人工智能学院)
;
School of Innovation Design, Shenzhen Technology University(深圳技术大学创新设计学院)
;
Stanford University(斯坦福大学)
Taming I2V models for Image HOI Editing: A Cognitive Benchmark and Agentic Self-Correcting Framework
驯服I2V模型用于图像HOI编辑:认知基准与智能体自校正框架
Jiayi Gao, Qingchao Chen, Yuxin Peng, Yang Liu
机构
*
Wangxuan Institute of Computer Technology, Peking University, Beijing, China(王轩计算机技术研究所,北京大学,北京,中国)
;
National Institute of Health Data Science, Peking University, Beijing, China(国家健康数据科学研究院,北京大学,北京,中国)
AERMANI-PLACE: Language Guided Object Placement with Aerial Manipulators
AERMANI-PLACE: 基于语言引导的空中机械臂物体放置
Sarthak Mishra, Ritama Sanyal, Rishabh Dev Yadav, Wei Pan, Spandan Roy
机构
*
Robotics Research Center, IIIT Hyderabad(海得拉巴国际信息技术学院机器人研究中心)
;
Department of Computer Science, University of Manchester(曼彻斯特大学计算机科学系)
;
Newcastle University(纽卡斯尔大学)
EmCom-Diffusion: Probing Visual Reflection in Emergent Languages via Image Generation
EmCom-Diffusion:通过图像生成探究新兴语言中的视觉反射
Haruumi Omoto, Tadahiro Taniguchi
机构
*
Graduate School of Informatics, Kyoto University, Kyoto, Japan(京都大学信息学研究科)
;
Research Organization of Science and Technology, Ritsumeikan University, Shiga, Japan(立命馆大学科学技术研究机构)