机构
*
Swiss Institute of Allergy and Asthma Research, Davos, Switzerland(瑞士过敏与哮喘研究所,达沃斯,瑞士)
;
ETH Zurich, Zurich, Switzerland(苏黎世联邦理工学院,苏黎世,瑞士)
;
Swiss Institute of Bioinformatics, Lausanne, Switzerland(瑞士生物信息学研究所,洛桑,瑞士)
机构
*
Cho Chun Shik Graduate School of Mobility, Korea Advanced Institute of Science and Technology(韩国科学技术院赵春植移动研究生院)
;
Department of Mechanical Engineering, Hanyang University(汉阳大学机械工程系)
;
Narnia Labs(纳尼亚实验室)
Re-evaluating Confidence Remasking in Masked Diffusion Language Models
重新评估掩蔽扩散语言模型中的置信度重新掩蔽
Stipe Frkovic, Metod Jazbec, Dan Zhang, Christian A. Naesseth, Ilija Bogunovic, Eric Nalisnick
机构
*
UvA-Bosch Delta Lab, University of Amsterdam(阿姆斯特丹大学UvA-Bosch Delta实验室)
;
Bosch Center for AI(博世人工智能中心)
;
University of Basel(巴塞尔大学)
;
Johns Hopkins University(约翰霍普金斯大学)
LakeFM: Toward a Foundation Model for Aquatic Ecosystems Using Irregular Multivariate Multi-depth Time Series Data
LakeFM:基于不规则多变量多深度时间序列数据的水生生态系统基础模型
Abhilash Neog, Sepideh Fatemi, Medha Sawhney, Kazi Sajeed Mehrab, Aanish Pradhan, Bennett J. McAfee, Emma Marchisin, Arka Daw, Robert Ladwig, Cayelan C. Carey, Paul Hanson, Anuj Karpatne
机构
*
Virginia Tech(弗吉尼亚理工大学)
;
Grand Valley State University(大峡谷州立大学)
;
University of Wisconsin - Madison(威斯康星大学麦迪逊分校)
;
Amazon AGI(亚马逊AGI)
;
Aarhus University(奥胡斯大学)
RAIL: Rethinking Auditory Intelligence in Large Audio-Language Models with a CHC-Grounded Benchmark
RAIL: 基于CHC框架重新思考大型音频语言模型中的听觉智能
Hongyu Jin, Siyi Wang, Yang Xiao, Jiaheng Dong, Shihong Tan, Kaiyuan peng, Georgiana Juravle, Shanquan Chen, Gongping Huang, Hong Jia, Eun-Jung Holden, James Bailey, Ting Dang
机构
*
School of Computing and Information Systems, The University of Melbourne(墨尔本大学计算与信息系统学院)
;
Faculty of Psychology and Educational Sciences, Alexandru Ioan Cuza University of Iași(亚历山德鲁伊万库扎大学心理学与教育科学学院)
;
School of Electronic Information, Wuhan University(武汉大学电子信息学院)
;
School of Public Health, The University of Hong Kong(香港大学公共卫生学院)
;
School of Computer Science, The University of Auckland(奥克兰大学计算机科学学院)
;
Department of Data Science and Artificial Intelligence, Monash University(莫纳什大学数据科学与人工智能系)
Visual Prompting Meets Feature Reconstruction-Based Anomaly Detection with Dual-Teacher Supervision
视觉提示结合基于特征重建的双教师监督异常检测
Mateo Diaz-Bone, Daniel Caraballo, Florian Scheidegger, Thomas Frick, Mattia Rigotti, Andrea Bartezzaghi, Roy Assaf, Niccolo Avogaro, Yagmur G. Cinar, Brown Ebouky, Filip M. Janicki, Piotr S. Kluska, Cezary Skura, Cristiano Malossi
机构
*
Dwarkadas Jivanlal Sanghvi College of Engineering(达沃拉斯·吉万拉尔·桑格维工程学院)
;
King’s College London(伦敦国王学院)
;
Indian Institute of Technology Jodhpur(印度理工学院朱罗普尔)
MMBU: A Massive Multi-modal Biomedical Understanding Benchmark to Probe the Perception Capabilities of Vision-Language Models
MMBU: 大规模多模态生物医学理解基准,用于探测视觉语言模型的感知能力
Ryan D'Cunha, Alejandro Lozano, Xiaoxiao Sun, Daniel Vela Jarquin, Min Woo Sun, Josiah Aklilu, James Burgess, Yuhui Zhang, Ryan Nayebi, Paola Avila, Robayo, Jin Ye, Ming Hu, Zhongying Deng, Junjun He, Xin Chen, Yue Yao, Robert Tibshirani, Jeffrey J. Nirschl, Serena Yeung-Levy
机构
*
Stanford University(斯坦福大学)
;
University of Wisconsin–Madison(威斯康星大学麦迪逊分校)
;
Instituto Tecnológico de Monterrey(蒙特雷技术学院)
;
Monash University(墨尔本大学)
;
University of Cambridge(剑桥大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
Shandong University(山东大学)
AnchorBench: A Multi-Pathway Benchmark for the Anchoring Effect in LLMs
AnchorBench:针对大语言模型中锚定效应的多路径基准测试
Yiderigun Borjigin, Alexander Hermann, Christian Cyron, Roland Aydin
机构
*
Saarland University(萨尔大学)
;
Hamburg University of Technology(汉堡工业大学)
;
Helmholtz-Zentrum Hereon(亥姆霍兹中心赫伦)
;
German Research Centre for Artificial Intelligence (DFKI)(德国人工智能研究中心(DFKI))
专题命中
评测与基准
:LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI