机构
*
School of Artificial Intelligence, Shenzhen Technology University(深圳技术大学人工智能学院)
;
School of Innovation Design, Shenzhen Technology University(深圳技术大学创新设计学院)
;
Stanford University(斯坦福大学)
Taming I2V models for Image HOI Editing: A Cognitive Benchmark and Agentic Self-Correcting Framework
驯服I2V模型用于图像HOI编辑:认知基准与智能体自校正框架
Jiayi Gao, Qingchao Chen, Yuxin Peng, Yang Liu
机构
*
Wangxuan Institute of Computer Technology, Peking University, Beijing, China(王轩计算机技术研究所,北京大学,北京,中国)
;
National Institute of Health Data Science, Peking University, Beijing, China(国家健康数据科学研究院,北京大学,北京,中国)
机构
*
Human Informatics Research Institute, National Institute of Advanced Industrial Science and Technology (AIST)(国家先进工业科学与技术研究所(AIST)人类信息学研究所)
;
Graduate School of Engineering, The University of Tokyo(东京大学工学研究科)
;
Human Biology & Primate Cognition, Institute of Biology, Leipzig University(莱比锡大学生物研究所人类生物学与灵长类认知)
;
Araya Inc.(Araya公司)
;
Center for the Evolutionary Origins of Human Behavior (EHuB), Kyoto University(京都大学人类行为进化起源中心(EHuB))
CCRC: A Change-Aware Captioning and Reasoning Chain for Image Change Captioning and Segmentation
CCRC:面向图像变化描述与分割的变化感知描述与推理链
Jinhong Hu, Xiaoping Wang, Shuyin Huang, Guojin Zhong, Kaitai Liu, Kai Lu
机构
*
College of Computer Science and Electronic Engineering, Hunan University, China(湖南大学计算机科学与电子工程学院,中国)
;
Guangxi Minzu University, China(广西民族大学,中国)
;
National University of Defense Technology, China(国防科学技术大学,中国)