PreDiff-LM: Pretrained Discrete Masked Diffusion Language Modeling with Hybrid Attention
PreDiff-LM:具有混合注意力的预训练离散掩码扩散语言模型
Zhengtao Yao, Runhao Li, Xupeng Chen, Jiayi Cheng, Chenqian Le, Michael Yue, Jesson Wang, Siheng Wang, Guang Yang, Haoyan Xu, Chenhao Wei, Zhengqing Yuan, Youran Shen, Yanfang Ye, Junhao Dong
机构
*
University of Southern California(南加州大学)
;
New York University(纽约大学)
;
Columbia University(哥伦比亚大学)
;
University of California, Berkeley(加州大学伯克利分校)
;
Stevens Institute of Technology(史蒂文斯理工学院)
;
University of Notre Dame(圣母大学)
;
Nanyang Technological University(南洋理工大学)
机构
*
University of Southern California(南加州大学)
;
New York University(纽约大学)
;
Columbia University(哥伦比亚大学)
;
University of California, Berkeley(加利福尼亚大学伯克利分校)
;
City College of New York, CUNY(纽约市立大学城市学院)
;
Stevens Institute of Technology(史蒂文斯理工学院)
;
Nanyang Technological University(南洋理工大学)
Why Does Grounding Hurt Medical VQA? Benchmarking, Diagnosis, and Fine-Tuning of Vision-Language Models
对前沿视觉-语言模型进行审计以实现可信的医学视觉问答:定位失败、格式崩溃和领域适应
Xupeng Chen, Binbin Shi, Chenqian Le, Qifu Yin, Lang Lin, Haowei Ni, Ran Gong, Panfeng Li
机构
*
New York University, New York, USA(纽约大学)
;
Tsinghua University, Beijing, China(清华大学)
;
Columbia University, New York, USA(哥伦比亚大学)
;
University of Michigan, Ann Arbor, USA(密歇根大学)