Unveiling Trust in Multimodal Large Language Models: Evaluation, Analysis, and Mitigation
Yichi Zhang, Yao Huang, Yifan Wang, Yitong Sun, Chang Liu, Zhe Zhao, Zhengwei Fang, Huanran Chen, Xiao Yang, Xingxing Wei, Hang Su, Yinpeng Dong, Jun Zhu
机构
*
Department of Computer Science and Technology, College of AI, Institute for AI, Tsinghua-Bosch Joint ML Center, THBI Lab, BNRist Center, Tsinghua University(计算机科学与技术系、人工智能学院、人工智能研究所、清华-博世联合机器学习中心、THBI实验室、BNRist中心、清华大学)
;
Institute of Artificial Intelligence, Beihang University(人工智能研究院、北航)
;
RealAI
机构
*
University of Maryland, College Park(马里兰大学学院公园分校)
;
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
Brown University(布朗大学)
;
San Francisco State University(旧金山州立大学)
;
Stanford University(斯坦福大学)
Advancing Welding Defect Detection in Maritime Operations via Adapt-WeldNet and Defect Detection Interpretability Analysis
Kamal Basha S, Athira Nambiar
机构
*
Department of Computational Intelligence, Faculty of Engineering and Technology, SRM Institute of Science and Technology(计算智能系,工程与技术学院,SRM科学与技术学院)
机构
*
Institute of Artificial Intelligence (TeleAI), China Telecom(电信人工智能研究院)
;
Institute of Artificial Intelligence and Robotics(IAIR), Xi’an Jiaotong University(人工智能与机器人研究院)
;
Advanced Technique of Artificial Intelligence(ATAI), Chongqing University of Technology(人工智能先进技术研究院)
Retrieval-Augmented Clinical Benchmarking for Contextual Model Testing in Kenyan Primary Care: A Methodology Paper
Fred Mutisya, Shikoh Gitau, Christine Syovata, Diana Oigara, Ibrahim Matende, Muna Aden, Munira Ali, Ryan Nyotu, Diana Marion, Job Nyangena, Nasubo Ongoma, Keith Mbae, Elizabeth Wamicha, Eric Mibuari, Jean Philbert Nsengemana, Talkmore Chidede
机构
*
University of New South Wales \& CSIRO's Data61 Sydney Australia
;
Macquarie University Sydney Australia
;
University of New South Wales Sydney Australia
;
University of Illinois at Urbana–Champaign Champaign
;
University of New South Wales \& CSIRO's Data61
;
Macquarie University
;
University of New South Wales
;
University of Illinois at Urbana–Champaign
Mechanistic Interpretability of Emotion Inference in Large Language Models
Ala N. Tak, Amin Banayeeanzade, Anahita Bolourani, Mina Kian, Robin Jia, Jonathan Gratch
机构
*
Institute for Creative Technologies, University of Southern California (USC)(创意技术研究所,南加州大学)
;
Information Sciences Institute, University of Southern California (USC)(信息科学研究所,南加州大学)
;
Department of Computer Science, University of Southern California (USC)(计算机科学系,南加州大学)
;
Department of Statistics and Data Science, University of California, Los Angeles (UCLA)(统计与数据科学系,加州大学洛杉矶分校)
V2X-VLM: End-to-End V2X Cooperative Autonomous Driving Through Large Vision-Language Models
Junwei You, Haotian Shi, Zhuoyu Jiang, Zilin Huang, Rui Gan, Keshu Wu, Xi Cheng, Xiaopeng Li, Bin Ran
机构
*
organization= Department of Civil
;
Environmental Engineering, University of Wisconsin–Madison , city= Madison , state= WI , postcode= 53706 , country= USA
;
organization= College of Computing
;
Data Science, Nanyang Technological University , city= Singapore , postcode= 639798 , country= Singapore
;
organization= College of Transportation, Tongji University , city= Shanghai , postcode= 201804 , country= China
;
organization= Zachry Department of Civil
;
Environmental Engineering, Texas A\&M University , city= College Station , state= TX , postcode= 77840 , country= USA
;
organization= School of Civil
;
Environmental Engineering, Cornell University , city= Ithaca , state= NY , postcode= 14853 , country= USA
机构
*
National Engineering Research Center for Big Data Technology and Systems(大数据技术与系统国家工程研究中心)
;
Services Computing Technology and System Lab(服务计算技术与系统实验室)
;
Cluster and Grid Computing Lab(集群与网格计算实验室)
;
School of Computer Science and Technology(计算机科学与技术学院)
;
Huazhong University of Science and Technology(华中科技大学)
;
Wuhuan University(吴奂大学)
;
Zhejiang University(浙江大学)
机构
*
Department of Computer Science and Information Engineering(计算机科学与信息工程系)
;
National Taiwan University of Science and Technology(台湾科技大学)
;
Bachelor’s Program in Computer Science(计算机科学学士班)
;
University of London(伦敦大学)
RE-Bench: Evaluating frontier AI R&D capabilities of language model agents against human experts
Hjalmar Wijk, Tao Lin, Joel Becker, Sami Jawhar, Neev Parikh, Thomas Broadley, Lawrence Chan, Michael Chen, Josh Clymer, Jai Dhyani, Elena Ericheva, Katharyn Garcia, Brian Goodrich, Nikola Jurkovic, Holden Karnofsky, Megan Kinniment, Aron Lajko, Seraphina Nix, Lucas Sato, William Saunders, Maksym Taran, Ben West, Elizabeth Barnes