DeltaEdit: Exploring Text-free Training for Text-Driven Image Manipulation
Yueming Lyu, Tianwei Lin, Fu Li, Dongliang He, Jing Dong, Tieniu Tan
机构
*
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
CRIPAC, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所CRIPAC)
;
VIS, Baidu Inc.(百度公司VIS)
机构
*
Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院航空信息研究所)
;
School of Electronic, Electrical and Communication Engineering, University of Chinese Academy of Sciences(中国科学院大学电子电气与通信工程学院)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Key Laboratory of Target Cognition and Application Technology(TCAT), Aerospace Information Research Institute, Chinese Academy of Sciences(目标认知与应用技术重点实验室)
;
Department of Electronic Engineering, Tsinghua University(清华大学电子工程系)
;
School of Automation, Northwestern Polytechnical University(西北工业大学自动化学院)
机构
*
School of Computer Science and Engineering, Huizhou University(惠州大学计算机科学与工程学院)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Xi’an Jiaotong-Liverpool University(西安交通大学利物浦大学)
SurgVisAgent: Multimodal Agentic Model for Versatile Surgical Visual Enhancement
Zeyu Lei, Hongyuan Yu, Jinlin Wu, Zhen Chen
机构
*
University of Chinese Academy of Sciences Multimedia Department, Xiaomi Inc Chinese Academy of Sciences, Institute of Automation Hong Kong Institute of Science \& Innovation, Chinese Academy of Sciences
机构
*
College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算机与数据科学学院)
;
Center of China-Singapore International Joint Research Institute(中国-新加坡国际联合研究机构中心)
;
School of Information Science and Engineering, Shandong Normal University(山东师范大学信息科学与工程学院)
;
School of Engineering Science, Simon Fraser University(西蒙弗雷泽大学工程科学学院)
;
School of Computer Science and Technology, University of Chinese Academy of Sciences(中国科学院大学计算机科学与技术学院)
;
Institute of Information Science, Beijing Jiao Tong University(北京交通大学信息科学学院)
机构
*
Key Lab of Intelligent Information Processing, Institute of Computing Technology, Chinese Academy of Sciences (CAS)(智能信息处理重点实验室,计算技术研究所,中国科学院)
;
State Key Lab of AI Safety(人工智能安全国家重点实验室)
;
University of Chinese Academy of Sciences, CAS(中国科学院大学)
;
Zhejiang University(浙江大学)
Comments19 pages, 3 figures. Accepted by ACL 2025 (main)
机构
*
Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Shenzhen University of Advanced Technology(深圳先进技术大学)
Rethinking All Evidence: Enhancing Trustworthy Retrieval-Augmented Generation via Conflict-Driven Summarization
Juan Chen, Baolong Bi, Wei Zhang, Jingyan Sui, Xiaofei Zhu, Yuanzhuo Wang, Lingrui Mei, Shenghua Liu
机构
*
University of Chinese Academy of Sciences(中国科学院大学)
;
Chinese Academy of Sciences(中国科学院)
;
National University of Defense Technology(国防科技大学)
;
Chongqing University of Technology(重庆理工大学)
机构
*
Faculty of Applied Sciences, Macao Polytechnic University(应用科学学院,澳门理工学院)
;
Netherlands Cancer Institute, Department of Radiology(荷兰癌症研究所,放射科)
;
Radboud University Medical Centre, Department of Radiology and Nuclear Medicine(拉德堡德大学医学中心,放射科和核医学科)
;
College of Aerospace Science and Engineering, National University of Defense Technology(航空航天科学与工程学院,国防科技大学)
;
Medical Department of Breast Cancer, Hunan Cancer Hospital(乳腺癌医学部,湖南癌症医院)
;
the Affiliated Cancer Hospital of Xiangya School of Medicine, Central South University(湘雅医学院附属肿瘤医院,中南大学)
;
Faculty of Biomedical Engineering, Eindhoven University of Technology(生物医学工程学院,埃因霍温理工大学)
;
Laboratory of Advanced Theranostic Materials and Technology, University of Chinese Academy of Sciences(先进诊疗材料与技术实验室,中国科学院大学)
PSELDNets: Pre-trained Neural Networks on a Large-scale Synthetic Dataset for Sound Event Localization and Detection
Jinbo Hu, Yin Cao, Ming Wu, Fang Kang, Feiran Yang, Wenwu Wang, Mark D. Plumbley, Jun Yang
机构
*
Key Laboratory of Noise and Vibration Research, Institute of Acoustics, Chinese Academy of Sciences(中国科学院噪声与振动研究所噪声与振动实验室)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Department of Intelligent Science, Xi’an Jiaotong Liverpool University(西安交通大学利物浦大学智能科学系)
;
Center for Machine Vision and Signal Analysis (CMVS), University of Oulu(奥卢大学机器视觉与信号分析中心)
;
State Key Laboratory of Acoustics, Institute of Acoustics, Chinese Academy of Sciences(中国科学院声学研究所声学国家重点实验室)
;
Centre for Vision, Speech and Signal Processing, University of Surrey(Surrey大学视觉、语音与信号处理中心)
Comments16 pages, 9 figures, accepted by IEEE Transactions on Audio, Speech, and Language Processing. The code is available at https://github.com/Jinbo-Hu/PSELDNets
Semantic Equitable Clustering: A Simple and Effective Strategy for Clustering Vision Tokens
Qihang Fan, Huaibo Huang, Mingrui Chen, Ran He
机构
*
MAIS & NLPR, Institute of Automation, Chinese Academy of Sciences, Beijing, China(自动化研究所,中国科学院,北京)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences, Beijing, China(中国科学院大学人工智能学院,北京)
DAM-VSR: Disentanglement of Appearance and Motion for Video Super-Resolution
Zhe Kong, Le Li, Yong Zhang, Feng Gao, Shaoshu Yang, Tao Wang, Kaihao Zhang, Zhuoliang Kang, Xiaoming Wei, Guanying Chen, Wenhan Luo
机构
*
Shenzhen Campus of Sun Yat-sen University, China, Meituan, China and Division of AMC and Department of ECE, HKUST(深圳中山大学校园,中国,美团,中国及AMC部门和HKUST电子工程系)
;
Department of ECE, HKUST Hong Kong(HKUST电子工程系,香港)
;
Tianjin University China(天津大学,中国)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences China(中国科学院大学人工智能学院,中国)
;
Nanjing University China(南京大学,中国)
;
Harbin Institute of Technology, Shenzhen China(哈尔滨工业大学深圳校区,中国)
;
Shenzhen Campus of Sun Yat-sen University China(深圳中山大学校园,中国)
;
Department of ECE, HKUST(HKUST电子工程系)
;
Tianjin University(天津大学)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Nanjing University(南京大学)
;
Harbin Institute of Technology, Shenzhen(哈尔滨工业大学深圳校区)
;
Shenzhen Campus of Sun Yat-sen University(深圳中山大学校园)
机构
*
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Sun Yat-sen University(中山大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
MoE Key Laboratory of Information Technology(教育部信息科学技术重点实验室)
;
Guangdong Key Laboratory of Information Security Technology(广东省信息安全技术重点实验室)
pUniFind: a unified large pre-trained deep learning model pushing the limit of mass spectra interpretation
Jiale Zhao, Pengzhi Mao, Kaifei Wang, Yiming Li, Yaping Peng, Ranfei Chen, Shuqi Lu, Xiaohong Ji, Jiaxiang Ding, Xin Zhang, Yucheng Liao, Weinan E, Weijie Zhang, Han Wen, Hao Chi
机构
*
Key Laboratory of Intelligent Information Processing of Chinese Academy of Sciences (CAS)(中国科学院智能信息处理重点实验室)
;
Institute of Computing Technology(计算技术研究所)
;
DP Technology Co., Ltd.(DP科技有限公司)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
AI for Science Institute(AI for Science研究院)
;
Center for Machine Learning Research(机器学习研究中心)
;
School of Mathematical Sciences(数学科学学院)
;
State Key Laboratory of Medical Proteomics(医学蛋白质组学国家重点实验室)
机构
*
Institute of Software Chinese Academy of Science, Beijing, China(中国科学院软件研究所)
;
University of Chinese Academy of Sciences, Beijing, China(中国科学院大学)
;
Advanced Institute of Big Data, Beijing, China(大数据先进研究院)
Semi-supervised Semantic Segmentation for Remote Sensing Images via Multi-scale Uncertainty Consistency and Cross-Teacher-Student Attention
Shanwen Wang, Xin Sun, Changrui Chen, Danfeng Hong, Jungong Han
机构
*
Faculty of Data Science, City University of Macau(数据科学学院,澳门城市大学)
;
WMG, University of Warwick(沃里克大学工程学院)
;
Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院航天信息研究所)
;
School of Electronic, Electrical and Communication Engineering, University of Chinese Academy of Sciences(中国科学院大学电子、电气与通信工程学院)
;
Department of Automation, Tsinghua University(清华大学自动化系)
Industrial brain: a human-like autonomous neuro-symbolic cognitive decision-making system
Junping Wang, Bicheng Wang, Yibo Xuea, Yuan Xie
机构
*
State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences, Beijing, China(多模态人工智能系统国家重点实验室,自动化研究所,中国科学院,北京,中国)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences, Beijing, China(人工智能学院,中国科学院大学,北京,中国)
;
School of Computer Science and Technology, East China Normal University, Shanghai, China(计算机科学与技术学院,华东师范大学,上海,中国)
机构
*
Beijing National Laboratory for Condensed Matter Physics, Institute of Physics, Chinese Academy of Sciences(北京凝聚态物理国家实验室,物理研究所,中国科学院)
;
School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Science(中国科学院大学先进交叉学科学院)
;
Beijing Gongyu Zhiyan Technology Co., Ltd(北京公誉智研科技有限公司)
;
Key Laboratory of Optical Astronomy, National Astronomical Observatories, Chinese Academy of Sciences(光学天文重点实验室,国家天文台,中国科学院)
;
College of Astronomy and Space Sciences, University of Chinese Academy of Sciences(中国科学院大学天文与空间科学学院)
;
State Key Laboratory of Isotope Geochemistry, Guangzhou Institute of Geochemistry, Chinese Academy of Sciences(同位素地球化学国家重点实验室,广州地球化学研究所,中国科学院)
;
College of Earth and Planetary Sciences, University of Chinese Academy of Sciences(中国科学院大学地球与行星科学学院)
;
Alibaba Cloud, Hangzhou, Zhejiang, China(阿里云,杭州,浙江,中国)
;
College of Information and Engineering, Wenzhou Medical University(温州医学院信息与工程学院)
;
Wenzhou Institute, University of Chinese Academy of Sciences(温州研究所,中国科学院大学)
;
Department of science and development, Chinese academy of sciences, Beijing, China(科学与发展部门,中国科学院,北京,中国)
FOCUS: Fine-grained Optimization with Semantic Guided Understanding for Pedestrian Attributes Recognition
Hongyan An, Kuan Zhu, Xin He, Haiyun Guo, Chaoyang Zhao, Ming Tang, Jinqiao Wang
机构
*
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Foundation Model Research Center, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所基础模型研究中心)
;
Peng Cheng Laboratory(鹏城实验室)
;
Wuhan AI Research(武汉人工智能研究院)
;
Objecteye Inc.(Objecteye公司)
FlexRAG: A Flexible and Comprehensive Framework for Retrieval-Augmented Generation
Zhuocheng Zhang, Yang Feng, Min Zhang
机构
*
Key Laboratory of Intelligent Information Processing, Institute of Computing Technology, Chinese Academy of Sciences (ICT/CAS)(中国科学院智能信息处理重点实验室)
;
University of Chinese Academy of Sciences, China(中国科学院大学)
;
Key Laboratory of AI Safety, Chinese Academy of Sciences(中国科学院人工智能安全重点实验室)
;
Institute of Computing and Intelligence, Harbin Institute of Technology (Shenzhen), China(哈尔滨工业大学(深圳)计算机与智能信息研究院)
Super Co-alignment of Human and AI for Sustainable Symbiotic Society
Yi Zeng, Feifei Zhao, Yuwei Wang, Enmeng Lu, Yaodong Yang, Lei Wang, Chao Liu, Yitao Liang, Dongcheng Zhao, Bing Han, Haibo Tong, Yao Liang, Dongqi Liang, Kang Sun, Boyuan Chen, Jinyu Fan
机构
*
Beijing Key Laboratory of Safe AI and Superalignment(北京安全人工智能与超对齐关键实验室)
;
Beijing Institute of AI Safety and Governance(北京人工智能安全与治理研究院)
;
Brain-inspired Cognitive AI Lab(脑启发认知人工智能实验室)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Wenge Technology Co., Ltd.(Wenger 技术有限公司)
;
Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院)
;
Long-term AI(长期人工智能)
;
State Key Laboratory of Cognitive Neuroscience and Learning, Beijing Normal University(北京师范大学认知神经科学与学习国家重点实验室)
Achieving binary weight and activation for LLMs using Post-Training Quantization
Siqing Song, Chuang Wang, Ruiqi Wang, Yi Yang, Xu-Yao Zhang
机构
*
MAIS, Institute of Automation, Chinese Academy of Sciences(自动化研究所,中国科学院)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Central Media Technology Institute, Huawei Technologies Ltd.(华为技术有限公司媒体技术研究所)
Deep Multi-Manifold Transformation Based Multivariate Time Series Fault Detection
Hong Liu, Xiuxiu Qiu, Yiming Shi, Miao Xu, Zelin Zang, Zhen Lei
机构
*
School of Information and Electrical Engineering, Hangzhou City University(杭州城市大学信息与电子工程学院)
;
Academy of Edge Intelligence, Hangzhou City University(杭州城市大学边缘智能研究院)
;
College of Information Engineering, Zhejiang University of Technology(浙江工业大学信息工程学院)
;
Institute of Cyber-Systems and Control, Zhejiang University(浙江大学网络系统与控制研究所)
;
Centre for Artificial Intelligence and Robotics (CAIR), HKISI-CAS(人工智能与机器人中心(CAIR))
;
State Key Laboratory of Multimodal Artificial Intelligence Systems (MAIS), Institute of Automation, Chinese Academy of Sciences (CASIA)(多模态人工智能系统国家重点实验室(MAIS))
;
School of Artificial Intelligence, University of Chinese Academy of Sciences (UCAS)(中国科学院大学人工智能学院)
Brain-inspired and Self-based Artificial Intelligence
Yi Zeng, Feifei Zhao, Yuxuan Zhao, Dongcheng Zhao, Enmeng Lu, Qian Zhang, Yuwei Wang, Hui Feng, Zhuoya Zhao, Jihang Wang, Qingqun Kong, Yinqian Sun, Yang Li, Guobin Shen, Bing Han, Yiting Dong, Wenxuan Pan, Xiang He, Aorigele Bao, Jin Wang
机构
*
Brain-inspired Cognitive AI Lab, Institute of Automation, Chinese Academy of Sciences, China.
;
Beijing Key Laboratory of Safe AI
;
Beijing Institute of AI Safety
;
Key Laboratory of Brain Cognition
;
Brain-inspired Intelligence Technology, Chinese Academy of Sciences, China.
;
University of Chinese Academy of Sciences, China.
;
Department of Philosophy, School of Humanities, University of Chinese Academy of Sciences, China.
Demystifying Singular Defects in Large Language Models
Haoqi Wang, Tong Zhang, Mathieu Salzmann
机构
*
EPFL(苏黎世联邦理工学院)
;
School of Computer and Communication Sciences(计算机与通信科学学院)
;
Swiss Data Science Center(瑞士数据科学中心)
;
University of Chinese Academy of Sciences(中国科学院大学)
WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation
Lu Han, Junqi Zhao, Renhua Peng
机构
*
Laboratory of Noise and Audio Research, Institute of Acoustics, Chinese Academy of Sciences(声学研究所噪声与音频研究实验室)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Centre for Vision, Speech and Signal Processing (CVSSP), University of Surrey(塞夫尔大学视觉、语音与信号处理中心(CVSSP))
机构
*
Sun Yat-sen University(中山大学)
;
Beihang University(北航)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Beijing National Research Center for Information Science and Technology, Tsinghua University(北京信息科学与技术国家研究中心,清华大学)
;
Department of Automation, Tsinghua University(清华大学自动化系)
机构
*
School of Electronic, Electrical and communication Engineering, UCAS, Beijing.(电子电气与通信工程学院,中国科学院大学,北京)
;
Key Laboratory of Intelligent Information Processing, Institute of Computing Technology, CAS, Beijing.(智能信息处理重点实验室,计算技术研究所,中国科学院,北京)
;
School of Computer Science and Technology, UCAS, Beijing.(计算机科学与技术学院,中国科学院大学,北京)
;
Key Laboratory of Big Data Mining and Knowledge management, UCAS, Beijing(大数据挖掘与知识管理重点实验室,中国科学院大学,北京)
;
Nanyang Technological University, Singapore.(南洋理工大学,新加坡)
;
Shenzhen Campus of Sun Yat-sen University, Shenzhen.(孙中山大学深圳校区,深圳)
Spatial Degradation-Aware and Temporal Consistent Diffusion Model for Compressed Video Super-Resolution
Hongyu An, Xinfeng Zhang, Shijie Zhao, Li Zhang, Ruiqin Xiong
机构
*
School of Computer Science and Technology, University of Chinese Academy of Sciences(中国科学院大学计算机科学与技术学院)
;
ByteDance Inc.(字节跳动公司)
;
Institute of Digital Media, School of Electronic Engineering and Computer Science, Peking University(北京大学电子工程与计算机科学学院数字媒体研究所)