PreDiff-LM: Pretrained Discrete Masked Diffusion Language Modeling with Hybrid Attention
PreDiff-LM:具有混合注意力的预训练离散掩码扩散语言模型
Zhengtao Yao, Runhao Li, Xupeng Chen, Jiayi Cheng, Chenqian Le, Michael Yue, Jesson Wang, Siheng Wang, Guang Yang, Haoyan Xu, Chenhao Wei, Zhengqing Yuan, Youran Shen, Yanfang Ye, Junhao Dong
机构
*
University of Southern California(南加州大学)
;
New York University(纽约大学)
;
Columbia University(哥伦比亚大学)
;
University of California, Berkeley(加州大学伯克利分校)
;
Stevens Institute of Technology(史蒂文斯理工学院)
;
University of Notre Dame(圣母大学)
;
Nanyang Technological University(南洋理工大学)
DecodeShare: Tracing the Shared Subspace of LLM Decode-Time Decisions
DecodeShare:追踪大语言模型解码时刻决策的共享子空间
Zishan Shao, Lixun Zhang, Kangning Cui, Yixiao Wang, Ting Jiang, Hancheng Ye, Qinsi Wang, Zhixu Du, Yuzhe Fu, Fan Yang, Danyang Zhuo, Yiran Chen, Hai Helen Li
专题命中
效率与部署
:LLM(title);large language model(abstract);language model(abstract);分类 cs.AI
Beyond Activation Alignment:The Alignment-Diversity Tradeoff in Task-Aware LLM Quantization
超越激活对齐:任务感知的大语言模型量化中的对齐-多样性权衡
Fei Wang, Chao Xue, Taoran Liu, Li Shen, Ye Liu, ChangXing Ding
机构
*
South China University of Technology(华南理工大学)
;
Shenzhen Campus of Sun Yat-sen University(中山大学深圳校区)
;
Ocean University of China(中国海洋大学)
;
Center for AI Theoretical Foundation and Systems, Shenzhen Loop Area Institute(深圳环区研究所人工智能理论基础与系统中心)
专题命中
效率与部署
:LLM(title);large language model(abstract);language model(abstract);分类 cs.LG
Attend, Transform, or Silence: Operator-Level Visual Skipping for Efficient Multimodal LLM Inference
关注、变换或静默:面向高效多模态大语言模型推理的算子级视觉跳跃
Zhaoyang Luo, Runmin Dong, Miao Yang, Fan Wei, Yushan Lai, Bin Luo, Haohuan Fu
机构
*
Tsinghua Shenzhen International Graduate School(清华大学深圳国际研究生院)
;
Sun Yat-sen University(中山大学)
;
National Supercomputing Center in Shenzhen(国家超级计算深圳中心)
;
Tsinghua University(清华大学)
专题命中
效率与部署
:LLM(title);large language model(abstract);language model(abstract);分类 cs.AI
机构
*
The University of Tokyo(东京大学)
;
National Institute of Advanced Industrial Science and Technology(产业技术综合研究所)
;
Technical University of Munich(慕尼黑工业大学)
;
Keio University(庆应义塾大学)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Nara Women’s University(奈良女子大学)
AVIS: Adaptive Test-Time Scaling for Vision-Language Models
AVIS: 视觉语言模型的自适应测试时缩放
Ahmadreza Jeddi, Minh Ngoc Le, Amirhossein Kazerouni, Hakki Can Karaimer, Hue Nguyen, Iqbal Mohomed, Michael Brudno, Alex Levinshtein, Konstantinos G. Derpanis, Babak Taati, Radek Grzeszczuk
机构
*
AI Center-Toronto, Samsung Electronics(三星电子多伦多AI中心)
;
University of Toronto(多伦多大学)
;
Vector Institute(向量研究所)
;
York University(约克大学)
机构
*
Cyberspace Institute of Advanced Technology, Guangzhou University(广州大学先进技术网络空间研究院)
;
Huangpu Research School of Guangzhou University(广州大学黄埔研究院)
;
Iwate Biotechnology Research Center(岩手生物技术研究中心)
;
Nanjing University of Posts and Telecommunications(南京邮电大学)
专题命中
效率与部署
:LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
Comments7 pages, 5 figures, 2 tables. Authors' accepted version of a paper published in Proc. IEEE CoDIT 2026. The version of record is available at the DOI below
Journal ref2026 12th International Conference on Control, Decision and Information Technologies (CoDIT), Bari, Italy, 2026, pp. 169-175
机构
*
Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Baidu Inc.(百度公司)