机构
*
MAIS, Institute of Automation, Chinese Academy of Sciences(自动化研究所,中国科学院)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Hujing Digital Media & Entertainment Group(华景数字媒体与娱乐集团)
;
Geely AI lab(吉利AI实验室)
机构
*
University of Science(科学大学)
;
SKL of Processors, Institute of Computing Technology, CAS(处理器研究所,计算技术研究所,中国科学院)
;
University of Chinese Academy of Sciences(中国科学院大学)
机构
*
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
机构
*
State Key Laboratory of AI Safety, Institute of Computing Technology, CAS(人工智能安全国家重点实验室,计算技术研究所,中国科学院)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Huawei Inc.(华为公司)
机构
*
Shenyang Institute of Computing Technology, Chinese Academy of Sciences(中国科学院沈阳计算技术研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Heilongjiang Academy of Sciences Intelligent Manufacturing Institute(黑龙江科学院智能制造研究所)
机构
*
Institute of Software at Chinese Academy of Sciences(中国科学院软件研究所)
;
Hangzhou Institute for Advanced Study at University of Chinese Academy of Sciences(中国科学院大学杭州高等研究 institute)
;
University of Chinese Academy of Sciences(中国科学院大学)
机构
*
Institute of Neuroscience, State Key Laboratory of Brain Cognition and Brain-inspired Intelligence Technology, Center for Excellence in Brain Science and Intelligence Technology, Chinese Academy of Sciences, Shanghai, 200031, China(中国科学院神经科学研究所、脑认知与脑启发智能技术重点实验室、脑科学与智能技术卓越中心、中国科学院、上海)
;
University of Chinese Academy of Sciences, School of Future Technology, Beijing, 100049, China(中国科学院大学、未来技术学院、北京)
;
Microsoft(微软公司)
Metis-SPECS: Decoupling Multimodal Learning via Self-distilled Preference-based Cold Start
Metis-SPECS: 通过基于偏好自我蒸馏的冷启动解耦多模态学习
Kun Chen, Peng Shi, Haibo Qiu, Zhixiong Zeng, Siqi Yang, Wenji Mao, Lin Ma
机构
*
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所MAIS)
;
Meituan(美团)
机构
*
University of Chinese Academy of Sciences(中国科学院大学)
;
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
;
Johns Hopkins University(约翰霍普金斯大学)
;
Henan University(河南大学)
LightRetriever: A LLM-based Text Retrieval Architecture with Extremely Faster Query Inference
LightRetriever: 一种基于大语言模型的文本检索架构,具有极快的查询推理速度
Guangyuan Ma, Yongliang Ma, Xuanrui Gou, Zhenpeng Su, Ming Zhou, Songlin Hu
机构
*
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
;
School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院)
;
Langboat Technology(兰舟科技)
NAG: A Unified Native Architecture for Encoder-free Text-Graph Modeling in Language Models
NAG:一种用于语言模型中无编码文本图建模的统一原生架构
Haisong Gong, Zhibo Liu, Qiang Liu, Shu Wu, Liang Wang
机构
*
New Laboratory of Pattern Recognition (NLPR), Institute of Automation, Chinese Academy of Sciences, Beijing, China
;
School of Artificial Intelligence, University of Chinese Academy of Sciences (UCAS), Beijing, China
;
School of Advanced Interdisciplinary Sciences, UCAS, Beijing, China
机构
*
The University of Hong Kong(香港大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Tsinghua University(清华大学)
;
Beijing Academy of Artificial Intelligence(北京人工智能研究院)
机构
*
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
;
School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院)
;
Sangfor Technologies(Sangfor技术有限公司)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
CAIR, Hong Kong Institute of Science and Innovation, Chinese Academy of Sciences(中国科学院香港科学与创新研究院)
Training-Free Representation Guidance for Diffusion Models with a Representation Alignment Projector
无需训练的表示引导用于扩散模型的表示对齐投影器
Wenqiang Zu, Shenghao Xie, Bo Lei, Lei Ma
机构
*
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Peking University(北京大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Beijing Academy of Artificial Intelligence(北京人工智能研究院)
Jingcheng Deng, Liang Pang, Zihao Wei, Shicheng Xu, Zenghao Duan, Kun Xu, Yang Song, Huawei Shen, Xueqi Cheng
机构
*
State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences, Beijing, China(人工智能安全国家重点实验室,计算技术研究所,中国科学院,北京)
;
University of Chinese Academy of Sciences, Beijing, China(中国科学院大学,北京)
机构
*
The Chinese University of Hong Kong(香港中文大学)
;
Hangzhou Institute of Medicine, CAS(杭州医学研究所,中国科学院)
;
Hangzhou Institute for Advanced Study, UCAS(杭州先进研究 institute,中国科学院大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Tianjin University(天津大学)
机构
*
Beijing Key Laboratory of Safe AI and Superalignment(北京安全人工智能与超对齐重点实验室)
;
Beijing Institute of AI Safety and Governance(北京人工智能安全与治理研究院)
;
Brain-inspired Cognitive AI Lab, Institute of Automation, Chinese Academy of Sciences(脑启发认知人工智能实验室,中国科学院自动化研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Long-term AI(长期人工智能)
ToolWeaver: Weaving Collaborative Semantics for Scalable Tool Use in Large Language Models
ToolWeaver: 为大语言模型中的可扩展工具使用编织协作语义
Bowen Fang, Wen Ye, Yunyue Su, Jinghao Zhang, Qiang Liu, Yesheng Liu, Xin Sun, Shu Wu, Jiabing Yang, Baole Wei, Liang Wang
机构
*
New Laboratory of Pattern Recognition (NLPR), Institute of Automation, Chinese Academy of Sciences (CASIA)(模式识别新实验室(NLPR),自动化研究所,中国科学院(CASIA))
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(人工智能学院,中国科学院大学)
;
Zhongguancun Academy(中关村学院)
;
Zhongguancun Institute of Artificial Intelligence(中关村人工智能研究所)
Dynamic Topology Awareness: Breaking the Granularity Rigidity in Vision-Language Navigation
动态拓扑感知:突破视觉语言导航中的粒度刚性
Jiankun Peng, Jianyuan Guo, Ying Xu, Yue Liu, Jiashuang Yan, Xuanwei Ye, Houhua Li, Xiaoming Wang
机构
*
Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院航空航天信息研究所)
;
School of Electronic, Electrical and Communication Engineering, University of Chinese Academy of Sciences(中国科学院大学电子电气与通信工程学院)
;
Department of Computer Science, City University of Hong Kong(香港城市大学计算机科学系)
Dynamical Adapter Fusion: Constructing A Global Adapter for Pre-Trained Model-based Class-Incremental Learning
动态适配器融合:为基于预训练模型的类增量学习构建一个全局适配器
Ruiqi Liu, Boyu Diao, Zijia An, Zhulin An, Fei Wang, Yongjun Xu
机构
*
Institute of Computing Technology, Chinese Academy of Sciences, Beijing, China(中国科学院计算技术研究所)
;
University of Chinese Academy of Sciences, Beijing, China(中国科学院大学)
机构
*
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
D-Models and E-Models: Diversity-Stability Trade-offs in the Sampling Behavior of Large Language Models
D模型和E模型:大语言模型采样行为中的多样性-稳定性权衡
Jia Gu, Liang Pang, Huawei Shen, Xueqi Cheng
机构
*
State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(人工智能安全国家重点实验室,计算技术研究所,中国科学院)
;
University of Chinese Academy of Sciences(中国科学院大学)
Causality-guided Prompt Learning for Vision-language Models via Visual Granulation
基于视觉粒化的因果引导提示学习用于视觉语言模型
Mengyu Gao, Qiulei Dong
机构
*
State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,自动化研究所,中国科学院)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(人工智能学院,中国科学院大学)
机构
*
State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,自动化研究所,中国科学院)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
The Grainger College of Engineering, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校格拉inger工程学院)
;
CAS Center for Excellence in Brain Science and Intelligence Technology(中国科学院脑科学与智能技术卓越创新中心)
;
Joint Laboratory of Intelligence Science and Technology, Institute of Systems Engineering, Macau University of Science and Technology(澳门科技大学系统工程学院智能科学与技术联合实验室)
Scaling Offline Model-Based RL via Jointly-Optimized World-Action Model Pretraining
通过联合优化的世界-动作模型扩展离线模型基于的强化学习
Jie Cheng, Ruixi Qiao, Yingwei Ma, Binhua Li, Gang Xiong, Qinghai Miao, Yongbin Li, Yisheng Lv
机构
*
State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,自动化研究所,中国科学院)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Alibaba Group(阿里巴巴集团)
GDCNet: Generative Discrepancy Comparison Network for Multimodal Sarcasm Detection
GDCNet:用于多模态讽刺检测的生成不一致比较网络
Shuguang Zhang, Junhong Lian, Guoxin Yu, Baoxun Xu, Xiang Ao
机构
*
State Key Laboratory of AI Safety, Institute of Computing Technology (ICT), Chinese Academy of Sciences (CAS)(人工智能安全国家重点实验室,计算技术研究所(ICT),中国科学院(CAS))
;
University of Chinese Academy of Sciences, CAS(中国科学院大学)
;
Pengcheng Laboratory(鹏城实验室)
;
Shenzhen Stock Exchange(深圳证券交易所)
AI总结
GDCNet通过生成事实性图像描述和文本对比,提升多模态讽刺检测的准确性和鲁棒性。
CommentsAccepted to 2026 IEEE International Conference on Acoustics, Speech, and Signal Processing (ICASSP 2026)