From Scale to Speed: Adaptive Test-Time Scaling for Image Editing
从尺度到速度:面向图像编辑的自适应测试时间缩放
Xiangyan Qu, Zhenlong Yuan, Jing Tang, Rui Chen, Datao Tang, Meng Yu, Lei Sun, Yancheng Bai, Xiangxiang Chu, Gaopeng Gou, Gang Xiong, Yujun Cai
机构
*
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
;
School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络空间安全学院)
;
AMAP, Alibaba Group(阿里巴巴集团高德地图)
;
University of Queensland(昆士兰大学)
WiFi-GEN: High-Resolution Indoor Imaging from WiFi Signals Using Generative AI
WiFi-GEN:利用生成式人工智能进行高分辨率室内成像
Jianyang Shi, Bowen Zhang, Amartansh Dubey, Ross Murch, Liwen Jing
机构
*
Pengcheng Laboratory(鹏城实验室)
;
College of Big Data and Internet(大数据与互联网学院)
;
Shenzhen Technology University(深圳技术大学)
;
Department of Electrical Engineering(电子工程系)
;
Indian Institute of Technology Delhi(印度理工学院德里分校)
;
Department of Electronic and Computer Engineering(电子与计算机工程系)
;
HKUST(香港科技大学)
;
School of Computer Science and Technology(计算机科学与技术学院)
;
Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))
Translating MRI to PET through Conditional Diffusion Models with Enhanced Pathology Awareness
通过增强病理意识的条件扩散模型将MRI翻译为PET
Yitong Li, Igor Yakushev, Dennis M. Hedderich, Christian Wachinger
机构
*
Lab for Artificial Intelligence in Medical Imaging, Institute for Diagnostic and Interventional Radiology, School of Medicine and Health, TUM Klinikum, Technical University of Munich (TUM)(人工智能医学成像实验室,诊断与介入放射学研究所,医学院与健康学院,TUM医院,慕尼黑技术大学)
;
Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心)
;
Department of Nuclear Medicine, School of Medicine and Health(核医学系,医学院与健康学院)
;
Department of Neuroradiology, School of Medicine and Health(神经放射学系,医学院与健康学院)
RECODE: Reasoning Through Code Generation for Visual Question Answering
RECODE: 通过代码生成进行视觉问答的推理
Junhong Shen, Mu Cai, Bo Hu, Ameet Talwalkar, David A Ross, Cordelia Schmid, Alireza Fathi
专题命中
多模态生成
:multimodal(abstract);分类 cs.CV、cs.AI
AI总结
RECODE通过代码生成实现视觉问答的可验证推理,优于传统方法。
CommentsThe authors are withdrawing this manuscript temporarily to conduct additional checks of the experimental setup and implementation. We plan to post an updated version after completing these checks
Rethinking Driving World Model as Synthetic Data Generator for Perception Tasks
重新思考驾驶世界模型作为感知任务的合成数据生成器
Kai Zeng, Zhanqian Wu, Kaixin Xiong, Xiaobao Wei, Xiangyu Guo, Zhenxin Zhu, Kalok Ho, Lijun Zhou, Bohan Zeng, Ming Lu, Haiyang Sun, Bing Wang, Guang Chen, Hangjun Ye, Wentao Zhang
机构
*
Peking University(北京大学)
;
Xiaomi EV(小米电动车)
;
Huazhong University of Science and Technology(华中科技大学)
;
Beijing Key Laboratory of Data Intelligence and Security (Peking University)(北京数据智能与安全重点实验室(北京大学))
;
Zhongguancun Academy(中关村学院)
InEdit-Bench: Benchmarking Intermediate Logical Pathways for Intelligent Image Editing Models
InEdit-Bench:智能图像编辑模型中间逻辑路径的基准测试
Zhiqiang Sheng, Xumeng Han, Zhiwei Zhang, Zenghui Xiong, Yifan Ding, Aoxiang Ping, Xiang Li, Tong Guo, Yao Mao
机构
*
State Key Laboratory of Optical Field Manipulation Science and Technology, Institute of Optics and Electronics, Chinese Academy of Sciences(光学场操控科学与技术国家重点实验室,光学电子研究所,中国科学院)
;
National Laboratory on Adaptive Optics(自适应光学国家实验室)
;
University of Chinese Academy of Sciences(中国科学院大学)
Towards Transferable Defense Against Malicious Image Edits
面向恶意图像编辑的可迁移防御
Jie Zhang, Shuai Dong, Shiguang Shan, Xilin Chen
机构
*
State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences (CAS)(人工智能安全国家重点实验室,计算技术研究所,中国科学院)
;
University of China Academy of Sciences(中国科学院大学)
;
School of Computer Science, China University of Geosciences(中国地质大学(武汉)计算机学院)
专题命中
多模态生成
:image-text(abstract);分类 cs.CV、cs.AI
AI总结
TDAE通过双模优化提升图像对恶意编辑的免疫性,实现跨模型的可迁移防御。
Comments14 pages, 5 figures, accepted by IEEE TPAMI
机构
*
Guangzhou Institute of Technology, Xidian University, Xi’an, China(广州科技研究院,西安电子科技大学,中国)
;
Department of Computer Science, Tianjin University of Technology, Tianjin, China(天津理工大学计算机学院,天津,中国)
;
Department of Respiratory, The Second Hospital of Tianjin Medical University, China(天津医科大学第二医院呼吸科,中国)
;
College of Pulmonary and Critical Care Medicine, Chinese PLA General Hospital, Beijing, China(中国人民解放军总医院呼吸与危重症医学科,北京,中国)
;
HeartVoice Medical Technology, Hefei, China(合肥心声医疗技术有限公司,中国)
;
School of Life Science and Technology, Xidian University, Xi’an, China(西安电子科技大学生命科学与技术学院,中国)
;
National Institute of Health Data Science, Peking University, Beijing, China(北京大学国家健康数据科学研究院,北京,中国)
;
Institute for Artificial Intelligence, Peking University, Beijing, China(北京大学人工智能研究院,北京,中国)
Junbo Wang, Haofeng Tan, Bowen Liao, Albert Jiang, Teng Fei, Qixing Huang, Bing Zhou, Zhengzhong Tu, Shan Ye, Yuhao Kang
机构
*
The University of Texas at Austin(德克萨斯大学奥斯汀分校)
;
University of Tennessee, Knoxville(田纳西大学基洛纳分校)
;
University of South Carolina(南卡罗来纳大学)
;
Arizona State University(亚利桑那州立大学)
;
University of Canterbury(坎特伯雷大学)
;
Texas A&M University(德克萨斯A&M大学)
;
University of Wisconsin-Madison(威斯康星大学麦迪逊分校)
EfficientPosterGen: Semantic-aware Efficient Poster Generation via Token Compression and Accurate Violation Detection
EfficientPosterGen: 通过令牌压缩和准确违规检测的语义感知高效海报生成
Wenxin Tang, Jingyu Xiao, Yanpei Gong, Fengyuan Ran, Tongchuan Xia, Junliang Liu, Man Ho Lam, Wenxuan Wang, Michael R. Lyu
机构
*
Tsinghua University(清华大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
Harbin Institute of Technology(哈尔滨工业大学)
;
Wuhan University(武汉大学)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Dalian Maritime University(大连海事大学)
;
Renmin University of China(中国人民大学)