机构
*
Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)
;
Khalifa University(哈里发大学)
;
Indian Institute of Technology Delhi(印度理工学院德里分校)
MVI-Bench: A Comprehensive Benchmark for Evaluating Robustness to Misleading Visual Inputs in LVLMs
MVI-Bench:评估大型视觉语言模型对误导性视觉输入鲁棒性的综合基准
Huiyi Chen, Jiawei Peng, Dehai Min, Changchang Sun, Kaijie Chen, Yan Yan, Xu Yang, Lu Cheng
机构
*
Department of Computer Science, University of Illinois Chicago, Chicago, USA
;
School of Computer Science \& Engineering, Southeast University, Nanjing, China
;
Guohao School, Tongji University, Shanghai, China
机构
*
School of Airspace and Engineering, Shandong University(山东大学航空航天与工程学院)
;
School of Computer Science and Technology, Shandong University of Finance and Economics(山东财经大学计算机科学与技术学院)
;
School of Psychology and Neuroscience, University of Glasgow(格拉斯哥大学心理学与神经科学学院)
;
Faculty of Information Science and Engineering, Ocean University of China(中国海洋大学信息科学与工程学院)
ROK-FORTRESS: Measuring the Effect of Geopolitical Transcreation for National Security and Public Safety
ROK-FORTRESS:衡量地缘政治转译对国家安全和公共安全的影响
Michael S. Lee, Yash Maurya, Drew Rein, Bert Herring, Jonathan Nguyen, Kyungho Song, Udari Madhushani Sehwag, Jiyeon Cho, Kaustubh Deshpande, Yeongkyun Jang, Jiyeon Joo, Minn Seok Choi, Evi Fuelle, Christina Q. Knight, Joseph Brandifino, Max Fenkell
Bridging Mechanistic Interpretability and Prompt Engineering with Gradient Ascent for Interpretable Persona Control
通过梯度上升实现可解释人格控制与提示工程的桥梁
Harshvardhan Saini, Yiming Tang, Dianbo Liu
机构
*
Department of Computer Science(计算机科学系)
;
Indian Institute of Technology (ISM), Dhanbad(印度理工学院(ISM),丹巴德)
;
National University of Singapore(新加坡国立大学)
;
CIFAR Fellow(CIFAR研究员)
机构
*
University of Chinese Academy of Sciences(中国科学院大学)
;
State Key Lab of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences, Beijing, China(中国科学院人工智能安全国家重点实验室,计算技术研究所,北京,中国)
;
Harbin Institute of Technology (Weihai)(哈尔滨工业大学(威海))
专题命中
幻觉与鲁棒性
:multimodal large language model(abstract);分类 cs.CV
Physiology-Aware CNN and Zero-Shot Multimodal LLMs for ECG Image Classification: A Comparative Study
生理感知CNN与零样本多模态大语言模型在心电图图像分类中的比较研究
Khalil Ahammad, Derek Abbott, Mohsen Dorraki
机构
*
School of Computer Science and Information Technology, Adelaide University(阿德莱德大学计算机科学与信息学院)
;
Australian Institute for Machine Learning (AIML)(澳大利亚机器学习研究所)
;
Pi MedTech(Pi医疗科技)
;
School of Electrical and Electronic Engineering, Adelaide University(阿德莱德大学电子与电气工程学院)
专题命中
幻觉与鲁棒性
:multimodal large language model(abstract);分类 cs.LG