When Discourse Pressures Conflict: Information Structure in Vision-Language Model Outputs
当话语压力冲突时:视觉-语言模型输出中的信息结构
Marcell Fekete, Johannes Bjerva, Tamás Káldi
机构
*
Department of Computer Science, Aalborg University(奥尔堡大学计算机科学系)
;
Department of Psycholinguistics and Neurolinguistics, ELTE Research Centre for Linguistics(ELTE语言研究中心心理学语言学与神经语言学系)
;
ELTE Bárczi Gusztáv Faculty of Special Needs Education(ELTE巴尔茨吉斯塔夫特殊教育学院)
TSHA: A Benchmark for Visual Language Models in Trustworthy Safety Hazard Assessment Scenarios
TSHA:用于可信安全危害评估场景的视觉语言模型基准
Qiucheng Yu, Ruijie Xu, Mingang Chen, Jianfeng Dong, Xin Tan
机构
*
City University of Hong Kong(香港城市大学)
;
East China Normal University(华东师范大学)
;
University of Western Australia(西澳大学)
;
Shanghai AI Laboratory(上海人工智能实验室)
;
Shanghai Development Center of Computer Software Technology(上海计算机软件技术开发中心)
;
Zhejiang Gongshang University(浙江工商大学)
Maijunxian Wang, Yijiang Li, Bingyang Wang, Tianwei Zhao, Ran Ji, Qingying Gao, Emmy Liu, Hokin Deng, Dezhi Luo
机构
*
Cognitive Science Program, University of California, Berkeley(加州大学伯克利分校认知科学项目)
;
Department of Electrical and Computer Engineering, University of California San Diego(加州大学圣地亚哥分校电气与计算机工程系)
;
School of Computer Science, Georgia Institute of Technology & Emory University(佐治亚理工学院计算机科学学院及埃默里大学)
;
Department of Computer Science, Johns Hopkins University(约翰霍普金斯大学计算机科学系)
;
Department of Cognitive Science, University of California San Diego(加州大学圣地亚哥分校认知科学系)
;
Equal Advising Department of Computer Science & Wilmer Eye Institute, Johns Hopkins University(约翰霍普金斯大学计算机科学系及威尔默眼科研究所)
;
Language Technologies Institute, Carnegie Mellon University(卡内基梅隆大学语言技术研究所)
;
Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)
;
Weinberg Institute for Cognitive Science, University of Michigan(密歇根大学韦恩伯格认知科学研究所)
VIBE: Voice-Induced open-ended Bias Evaluation for Large Audio-Language Models via Real-World Speech
VIBE:通过真实世界语音进行大型音频-语言模型生成偏见评估的语音诱导开放式偏见评估
Yi-Cheng Lin, Yusuke Hirota, Sung-Feng Huang, Hung-yi Lee
机构
*
Graduate Institute of Communication Engineering, National Taiwan University, Taiwan(台湾大学通信工程研究所)
;
NVIDIA, Taiwan(台湾NVIDIA)
;
Artificial Intelligence Center of Research Excellence, National Taiwan University, Taiwan(台湾大学人工智能卓越研究中心)
Towards Cellular-Scale Interpretability in Pathology Foundation Models for Biomarker Assessment
面向生物标志物评估的病理基础模型中的细胞级可解释性
Jingsong Liu, Han Li, Zhengyang Xu, Franz-Leonard Klaus, Fabian Stögbauer, Shihui Zu, Weiwei Zhou, Atsuko Kasajima, Felix Schicktanz, Alexander Muckenhuber, Julius Shakhtour, Jiale Yu, Tiannan Zheng, Xun Ma, Maggie Wang, Christian Grashei, Bao Li, Guiyang Jiang, Hongming Xu, Shaohua Kevin Zhou, Nassir Navab, Peter J. Schüffler
机构
*
Institute of Pathology, Technical University of Munich(慕尼黑技术大学病理学研究所)
;
School of Computation, Information and Technology, Technical University of Munich(慕尼黑技术大学计算、信息与技术学院)
;
Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心)
;
Computer Aided Medical Procedures (CAMP), Technical University of Munich(慕尼黑技术大学计算机辅助医疗程序中心)
;
School of Biomedical Engineering, Faculty of Medicine, Dalian University of Technology(大连理工大学医学院生物医学工程学院)
;
Affiliated Hospital of Chifeng University(赤峰大学附属医院)
;
Center for Medical Imaging, Robotics, and Analytic Computing & Learning (MIRACLE), Suzhou Institute for Advanced Research, USTC, Suzhou, China(苏州先进研究院医学影像、机器人与分析计算与学习中心)
;
Department of Biomedical Informatics, Harvard Medical School(哈佛医学院生物医学信息学系)
;
The First Hospital and the College of Basic Medical Sciences of China Medical University(中国医科大学第一医院及基础医学科学学院)
;
Munich Data Science Institute (MDSI)(慕尼黑数据科学研究所)
Explaining Tabular Foundation Model Differences Through Meta-Features
重新审视元特征以解释表格数据上的模型差异
Markus Herre, Andrej Tschalzev, Sascha Marton, Christian Bartelt
机构
*
Clausthal University of Technology, Clausthal-Zellerfeld, Germany(Clausthal技术大学,Clausthal-Zellerfeld,德国)
;
University of Mannheim, Mannheim, Germany(曼海姆大学,曼海姆,德国)
机构
*
Technical University of Munich, MCML(慕尼黑技术大学,MCML)
;
University of Tübingen(图宾根大学)
;
Tübingen AI Center(图宾根人工智能中心)
;
MPI for Intelligent Systems, ELLIS Institute(智能系统Max Planck研究所,ELLIS研究所)
MedLayBench-V: A Large-Scale Benchmark for Expert-Lay Semantic Alignment in Medical Vision Language Models
MedLayBench-V:面向医学视觉语言模型中专家与普通人语义对齐的大规模基准
Han Jang, Junhyeok Lee, Heeseong Eum, Kyu Sung Choi
机构
*
Seoul National University(首尔国立大学)
;
Seoul National University College of Medicine(首尔国立大学医学院)
;
Department of Radiology, Seoul National University Hospital(首尔国立大学医院放射科)
;
Healthcare AI Research Institute, Seoul National University Hospital(首尔国立大学医院健康人工智能研究所)
;
The Advanced Imaging and Computational Neuroimaging (AICON) Laboratory(先进影像与计算神经影像实验室)
Robustness assessment of large audio language models in multiple-choice evaluation
大型音频语言模型在多项选择评估中的鲁棒性评估
Fernando López, Santosh Kesiraju, Jordi Luque
机构
*
Scientific Research, Telefónica Innovación Digital, Spain(Telefónica Innovación Digital科研部,西班牙)
;
Universidad Autónoma de Madrid, Spain(马德里自治大学,西班牙)
;
Brno University of Technology, Czech Republic(布拉格技术大学,捷克)
EEG-FM-Bench: A Comprehensive Benchmark for the Systematic Evaluation and Diagnostic Analyses of EEG Foundation Models
EEG-FM-Bench:脑电图基础模型系统评估与诊断分析的综合基准
Wei Xiong, Jiangtong Li, Jie Li, Kun Zhu, Changjun Jiang
机构
*
School of Computer Science and Technology, Tongji University, Shanghai, China(同济大学计算机科学与技术学院,上海,中国)
;
Translational Research Center, Shanghai Yangzhi Rehabilitation Hospital (Shanghai Sunshine Rehabilitation Center), China(上海杨氏康复医院(上海阳光康复中心)转化研究中心,中国)
Dual-branch Prompting for Multimodal Machine Translation
双分支提示用于多模态机器翻译
Jie Wang, Zhendong Yang, Liansong Zong, Xiaobo Zhang, Dexian Wang, Ji Zhang
机构
*
School of Computing and Artificial Intelligence, Southwest Jiaotong University(西南交通大学计算机与人工智能学院)
;
School of Computer and Software Engineering, Xihua University(西华大学计算机与软件工程学院)
;
School of Intelligent Medicine, Chengdu University of Traditional Chinese Medicine(成都中医药大学针灸推拿学院)
Comments10 pages (36 including references and appendices), 11 figures, accepted at COLM 2026, earlier version accepted at AAAI 2025 Workshop on Document Understanding and Intelligence
Persona-Pruner: Sculpting Lightweight Models for Role-Playing
Persona-Pruner: 为角色扮演雕琢轻量级模型
Jinsu Kim, Jihoon Tack, Noah Lee, Jongheon Jeong
机构
*
Department of Artificial Intelligence, Korea University, Seoul, South Korea(韩国大学人工智能系)
;
Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院)