机构
*
State Key Lab of Processors, Institute of Computing Technology, CAS(处理器国家重点实验室,计算技术研究所,中国科学院)
;
Jiangsu Key Laboratory of AI for Industries, Institute of AI for Industries, CAS(江苏人工智能工业重点实验室,人工智能工业研究所,中国科学院)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Cambricon Technologies(寒武科技)
;
Intelligent Software Research Center, Institute of Software, CAS(软件研究所智能软件研究中心,中国科学院)
;
University of Science and Technology of China(中国科学技术大学)
Move-Then-Operate: Behavioral Phasing for Human-Like Robotic Manipulation
移动-然后-操作:用于类人机器人操作的行为相位
Haoming Xu, Lei Lei, Jie Gu, Chu Tang, Jingmin Chen, Ruiqi Wang
机构
*
Hangzhou Institute for Advanced Study, University of Chinese Academy of Sciences, Hangzhou, China.(杭州高等研究院,中国科学院大学,中国杭州)
;
University of Science and Technology of China, Hefei, China.(中国科学技术大学,中国合肥)
;
School of Aritificial intelligence, Institute of Artificial Intelligence, University of Science and Technology Beijing, Beijing, China(人工智能学院,人工智能研究院,北京科技大学,中国北京)
Ming Wen, Yuxuan Liu, Kun Yang, Yunhao Feng, Zhuoer Xu, Yuhao Sun, Shiwen Cui, Xiang Zheng, Yi Liu, Xingjun Ma, Yu-Gang Jiang
机构
*
Institute of Trustworthy Embodied AI(可信具身人工智能研究院)
;
Fudan University(复旦大学)
;
Shanghai Innovation Institute(上海创新研究院)
;
Ant Group(蚂蚁集团)
;
Zhejiang University(浙江大学)
;
City University of Hong Kong(香港城市大学)
专题命中
VLM训练与架构
:multimodal large language model(abstract);分类 cs.AI、cs.LG
Ablation-Corrected Evaluation of Attribution Maps in Echocardiographic Ejection-Fraction Models
解剖结构忠实但时间上盲目:超声心动图左心室射血分数估计的归因审核
Hyunkyung Han, Min Jung Kim
机构
*
School of Integrated Medicine, Yonsei University(延世大学统合医学院)
;
Department of Radiology, Research Institute of Radiologic Science, Yonsei University College of Medicine(延世大学医学院放射科学研究所放射科)
Comments12 pages, 4 figures. v2: the chance level is now measured rather than computed, which corrects the ratios reported in v1. Adds a composition-matched ablation with an equal-area control, a reliability estimate for it, an ablation-derived score to report alongside overlap, seed repetition, and pediatric validation
Token-Based Detection of Spurious Correlations in Vision Transformers
基于Token的视觉Transformer虚假相关性检测
Solha Kang, Esla Timothy Anzaku, Wesley De Neve, Arnout Van Messem, Joris Vankerschaver, Francois Rameau, Utku Ozbulak
机构
*
Center for Biosystems and Biotech Data Science(生物系统与生物技术数据科学中心)
;
Ghent University Global Campus(根特大学全球校区)
;
State University of New York Korea(纽约州立大学韩国分校)
;
Department of Mathematics(数学系)
;
Université de Liège(列日大学)
;
Department of Applied Mathematics, Computer Science and Statistics(应用数学、计算机科学与统计学系)
;
Ghent University(根特大学)
;
Department of Electronics and Information Systems(电子与信息系统系)
机构
*
East China Normal University Shanghai China
;
Centre for Artificial Intelligence
;
Robotics, Hong Kong Institute of Science \& Innovation, Chinese Academy of Sciences Hong Kong China
;
Department of Computing, The Hong Kong Polytechnic University Hong Kong China
;
East China Normal University
;
Robotics, Hong Kong Institute of Science \& Innovation, Chinese Academy of Sciences
;
Department of Computing, The Hong Kong Polytechnic University
机构
*
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
National University of Singapore(新加坡国立大学)
;
Southeast University, Nanjing, China(南京东南大学)
;
Wuhan AI Research, Wuhan, China(武汉人工智能研究院)
专题命中
VLM训练与架构
:multimodal large language model(abstract);分类 cs.AI、cs.LG
CommentsPublished in the Proceedings of the 64th Annual Meeting of the Association for Computational Linguistics (ACL 2026), Volume 1: Long Papers. 14 pages. Code is available at https://github.com/yueluoshuangtian/PASs-MoE
Journal refProceedings of the 64th Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers), pages 31959--31972, San Diego, California, United States, July 2026. Association for Computational Linguistics
InverseScope: Scalable Activation Inversion for Interpreting Large Language Models
InverseScope:用于解释大语言模型的可扩展激活反演
Yifan Luo, Zhennan Zhou, Bin Dong
机构
*
School of Mathematical Science, Peking University(北京大学数学科学学院)
;
School of Science, Westlake University(西湖大学理学院)
;
Beijing International Center for Mathematical Research(北京国际数学研究中心)
;
New Cornerstone Science Laboratory, Peking University(北京大学新基石科学实验室)
MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion
MVCL-DAF++: 通过原型感知对比对齐和由粗到细动态注意力融合增强多模态意图识别
Haofeng Huang, Yifei Han, Long Zhang, Bin Li, Yangfan He, Yaxin Xue
机构
*
University of Shanghai for Science and TechnologyChina(上海科学技术大学中国)
;
Shenzhen Institute of Advanced Technology, Chinese Academy of SciencesChina(深圳先进技术研究院,中国科学院中国)
;
University of Minnesota-Twin Cities, USA(明尼苏达大学双城分校,美国)
;
University of LeedsUK(利兹大学,英国)
MACS: Modality-Aware Capacity Scaling for Efficient Multimodal MoE Inference
MACS: 模态感知容量缩放用于高效多模态MoE推理
Bo Li, Chuan Wu, Shaolin Zhu
机构
*
School of Software, Tsinghua University, Beijing, China(清华大学软件学院,北京,中国)
;
TJUNLP Lab, School of Computer Science and Technology, Tianjin University, China(天津大学计算机科学与技术学院,中国)
;
School of New Media and Communication, Tianjin University, China(天津大学新媒体与传播学院,中国)
专题命中
VLM训练与架构
:multimodal large language model(abstract);分类 cs.AI、cs.LG