SceneCraft: Interactive System for Image Editing via Scene Graph
SceneCraft: 基于场景图的交互式图像编辑系统
Duc-Manh Phan, Ngoc-Dai Tran, Duy-Khang Do, Tam V. Nguyen, Minh-Triet Tran, Trung-Nghia Le
机构
*
University of Science, Ho Chi Minh, Vietnam(胡志明市理科大学)
;
Vietnam National University, Ho Chi Minh, Vietnam(越南国家大学胡志明市)
;
University of Dayton, Dayton, Ohio, USA(代顿大学)
An Extensive Benchmark for Single-round and Multi-round Instruction-based Image Editing
单轮与多轮指令式图像编辑的广泛基准
Yiwei Ma, Ke Ye, Weihuang Lin, Jiayi Ji, Xiaoshuai Sun, Tat-Seng Chua, Rongrong Ji
机构
*
Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University(厦门大学多媒体可信感知与高效计算教育部重点实验室)
;
National University of Singapore(新加坡国立大学)
Adaptive Inference-Time Scaling via Early-Step Latent Verification for Image Editing
自适应推理时间缩放:基于早期步骤潜在验证的图像编辑
Yue Yu, Yang Jiao, Jiayu Wang, Qi Dai, Jingjing Chen
机构
*
College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院)
;
Microsoft Research Asia(微软亚洲研究院)
;
Institute of Trustworthy Embodied AI, Fudan University(复旦大学可信具身人工智能研究所)
机构
*
Peking University(北京大学)
;
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
;
Tsinghua University(清华大学)
;
Beihang University(北京航空航天大学)
;
Xiaohongshu Inc.(小红书公司)
Reversible Inversion for Training-Free Exemplar-guided Image Editing
可逆反演用于免训练示例引导图像编辑
Yuke Li, Lianli Gao, Ji Zhang, Pengpeng Zeng, Lichuan Xiang, Hongkai Wen, Heng Tao Shen, Jingkuan Song
机构
*
school of Computer Science and Engineering, University of Electronic Science and Technology of China(电子科技大学计算机科学与工程学院)
;
School of Computing and Artificial Intelligence, Southwest Jiaotong University, China(西南交通大学计算机科学与人工智能学院)
;
School of Computer Science and Technology, Tongji University, China(同济大学计算机科学与技术学院)
;
Department of Computer Science, University of Warwick, United Kingdom(英国沃里克大学计算机科学系)
How Well Do Models Follow Visual Instructions? VIBE: A Systematic Benchmark for Visual Instruction-Driven Image Editing
模型能多好地遵循视觉指令?VIBE:一个系统性的视觉指令驱动图像编辑基准
Huanyu Zhang, Xuehai Bai, Chengzu Li, Chen Liang, Haochen Tian, Haodong Li, Ruichuan An, Yifan Zhang, Anna Korhonen, Zhang Zhang, Liang Wang, Tieniu Tan
机构
*
School of Artificial Intelligence, University of Chinese Academy of Science(中国科学院大学人工智能学院)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Language Technology Lab, University of Cambridge(剑桥大学语言技术实验室)
;
Peking University(北京大学)
;
South China University of Technology(华南理工大学)
;
Nanjing University(南京大学)
机构
*
School of Cyber Science and Engineering, Zhengzhou University(郑州大学信息科学与工程学院)
;
School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院)
;
School of Journalism and New Media, Xi’an Jiaotong University(西安交通大学新闻与传播学院)
;
Research Center for Space Computing System, Zhejiang Lab(浙江实验室空间计算系统研究中心)
SpatialReward: Bridging the Perception Gap in Online RL for Image Editing via Explicit Spatial Reasoning
SpatialReward: 通过显式空间推理弥合在线强化学习中图像编辑的感知差距
Yancheng Long, Yankai Yang, Hongyang Wei, Wei Chen, Tianke Zhang, Haonan fan, Changyi Liu, Kaiyu Jiang, Jiankang Chen, Kaiyu Tang, Bin Wen, Fan Yang, Tingting Gao, Han Li, Shuo Yang
机构
*
Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))
;
The Hong Kong University of Science and Technology(香港科学与技术大学)
;
Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生学院,清华大学)
EditRefiner: A Human-Aligned Agentic Framework for Image Editing Refinement
EditRefiner:一种对齐人类的代理框架用于图像编辑细化
Zitong Xu, Huiyu Duan, Yifei Nie, Mingda Du, Sijing Wu, Xiongkuo Min, Tianyi Zheng, Jian Zhang, Shusong Xu, Jinwei Chen, Bo Li, Guangtao Zhai
机构
*
Shanghai Jiao Tong University(上海交通大学)
;
Vivo Mobile Communication Co., Ltd(Vivo移动通信有限公司)
;
University of Electronic Science and Technology of China(电子科学与技术大学)