BELIEF: Structured Evidence Modeling and Uncertainty-Aware Fusion for Biomedical Question Answering
BELIEF: 结构化证据建模与不确定性感知融合用于生物医学问答
Chang Zong, Hao Ning, Siliang Tang, Jie Huang, Jian Wan
机构
*
School of Computer Science and Technology, Zhejiang University of Science and Technology(浙江理工大学计算机科学与技术学院)
;
College of Artificial Intelligence, Zhejiang University(浙江大学人工智能学院)
;
Zhejiang Key Laboratory of Biomedical Intelligent Computing Technology, Zhejiang University of Science and Technology(浙江理工大学生物医学智能计算技术重点实验室)
机构
*
School of IC, Peking University(北京大学集成电路学院)
;
School of EECS, Peking University(北京大学电子信息技术学院)
;
School of Microelectronics, Xidian University(西安电子科技大学微电子学院)
;
Institute of EDA, Peking University(北京大学EDA研究院)
;
Beijing Advanced Innovation Center for IC(北京集成电路先进创新中心)
T-FIX: Text-Based Explanations with Features Interpretable to eXperts
T-FIX:基于文本的可解释性方法,具备可解释的专家特征
Shreya Havaldar, Weiqiu You, Chaehyeon Kim, Anton Xue, Helen Jin, Marco Gatti, Bhuvnesh Jain, Helen Qu, Amin Madani, Daniel A. Hashimoto, Gary E. Weissman, Rajat Deo, Sameed Khatana, Lyle Ungar, Eric Wong
机构
*
Department of Computer and Information Science, University of Pennsylvania(宾夕法尼亚大学计算机与信息科学系)
;
Department of Computer Science, University of Texas at Austin(德克萨斯大学奥斯汀分校计算机科学系)
;
Department of Physics and Astronomy, University of Pennsylvania(宾夕法尼亚大学物理与天文学系)
;
Flatiron Institute(Flatiron研究所)
;
Department of Surgery, Perelman School of Medicine, University of Pennsylvania(宾夕法尼亚大学佩雷尔曼医学院外科系)
;
Division of Pulmonary, Allergy, and Critical Care, Perelman School of Medicine, University of Pennsylvania(宾夕菲亚大学佩雷尔曼医学院呼吸、过敏与危重医学科)
;
Division of Cardiovascular Medicine, Perelman School of Medicine, University of Pennsylvania(宾夕法尼亚大学佩雷尔曼医学院心血管医学科)
;
Department of Surgery, University of Toronto(多伦多大学外科系)
;
University Health Network(大学健康网络)
FinAuditing: A Financial Taxonomy-Structured Multi-Document Benchmark for Evaluating LLMs
FinAuditing: 一个基于财务分类结构的多文档基准,用于评估LLMs
Yan Wang, Keyi Wang, Shanshan Yang, Jaisal Patel, Jeff Zhao, Fengran Mo, Xueqing Peng, Lingfei Qian, Yankai Chen, Víctor Gutiérrez-Basulto, Jimin Huang, Guojun Xiong, Xiao-Yang Liu, Xue Liu, Jian-Yun Nie
机构
*
Columbia University(哥伦比亚大学)
;
Stevens Institute of Technology(史蒂文斯理工学院)
;
Rensselaer Polytechnic Institute(拉特格斯理工学院)
;
University of Montreal(蒙特利尔大学)
;
McGill University(麦吉尔大学)
;
MBZUAI(麦吉尔大学人工智能研究所)
;
Cardiff University(卡迪夫大学)
;
The University of Manchester(曼彻斯特大学)
;
Harvard University(哈佛大学)
机构
*
Northeastern University(东北大学)
;
University of Southern California(南加州大学)
;
Stony Brook University(石溪大学)
;
Independent Researcher(独立研究者)
;
Ohio State University(俄亥俄州立大学)
;
University of Notre Dame(Notre Dame 大学)
;
Columbia University(哥伦比亚大学)
HalluScore: Large Language Model Hallucination Question Answering Benchmark
HalluScore: 大语言模型幻觉问答基准
Aisha Alansari, Hamzah Luqman
机构
*
Department of Information and Computer Science, King Fahd University of Petroleum and Minerals(国王法赫德石油与矿物大学信息与计算机科学系)
;
SDAIA-KFUPM Joint Research Center for Artificial Intelligence(SDAIA-KFUPM人工智能联合研究中心)
Ranking-Aware Calibration for Reliable Multimodal Reinforcement Learning
基于排名的校准:可靠多模态强化学习
Peng Cui, Boyao Yang, Jun Zhu
机构
*
Dept. of Comp. Sci. & Tech., Institute for AI, BNRist Center, Tsinghua-Bosch Joint ML Center, THBI Lab, Tsinghua University, Beijing(计算机科学与技术系,人工智能研究院,BNRist中心,清华大学-博世联合机器学习中心,THBI实验室,清华大学,北京)
;
Dept. of Automation, Tsinghua University, Beijing(自动化系,清华大学,北京)
机构
*
Nanjing University(南京大学)
;
Huazhong University of Science and Technology(华中科技大学)
;
Southwest Jiaotong University(西南交通大学)
;
The Chinese University of Hong Kong(香港中文大学)
SE-GA: Memory-Augmented Self-Evolution for GUI Agents
SE-GA:基于记忆的自进化GUI代理
Shilong Jin, Lanjun Wang, Zhuosheng Zhang
机构
*
College of Intelligence and Computing, Tianjin University, Tianjin, China(天津大学智能与计算学院)
;
School of New Media and Communication, Tianjin University, Tianjin, China(天津大学新媒体与传播学院)
;
School of Computer Science, Shanghai Jiao Tong University, Shanghai, China(上海交通大学计算机科学学院)
Multi-Paradigm Agent Interaction in Practice:A Systematic Analysis of Generator-Evaluator, ReAct Loop,and Adversarial Evaluation in the buddyMe Framework
多范式代理交互实践:buddyMe框架中生成器-评估器、ReAct循环和对抗性评估的系统分析
Xiaohua Wang, Chao Han, Kai Yu, XiaoLiang Xu, Liang Wang
机构
*
BuddyMe Research Team(buddyMe研究团队)
;
CHARMMIRAEL Biotech Co., Ltd(CHARMMIRAEL生物技术有限公司)
机构
*
Peking University Health Science Center, Peking University, Beijing, China(北京大学北京医院科学中心,北京大学,北京,中国)
;
Shanghai AI Laboratory, Shanghai, China(上海人工智能实验室,上海,中国)
;
Academy for Advanced Interdisciplinary Studies, Peking University, Beijing, China(北京大学先进跨学科研究学院,北京大学,北京,中国)
机构
*
Bradley Department of Electrical and Computer Engineering, Virginia Tech(弗吉尼亚理工大学电子与计算机工程系 Bradley 部门)
;
Research and Innovation Labs, InterDigital Communications Inc.(InterDigital Communications Inc. 研究与创新实验室)
DisasterVQA: A Visual Question Answering Benchmark Dataset for Disaster Scenes
DisasterVQA: 一个用于灾难场景的视觉问答基准数据集
Aisha Al-Mohannadi, Ayisha Firoz, Yin Yang, Muhammad Imran, Ferda Ofli
机构
*
Qatar Computing Research Institute(卡塔尔计算研究所)
;
Hamad Bin Khalifa University(哈马德·本·卡伊夫大学)
;
College of Science & Engineering(科学与工程学院)
;
Qatar University(卡塔尔大学)
机构
*
Department of Urban and Regional Planning, University of Florida(城市与区域规划系,佛罗里达大学)
;
Singapore-MIT Alliance for Research and Technology Centre (SMART)(新加坡-麻省理工联合研究中心(SMART))
;
Department of Landscape Architecture and Urban Planning, Texas A&M University(景观建筑与城市规划系,德克萨斯大学安德森分校)
;
Department of Agronomy, University of Florida(农业系,佛罗里达大学)
机构
*
Faculty of Engineering, University of Peradeniya(工程学院,珀德尼亚大学)
;
Faculty of Dental Sciences, University of Peradeniya(牙科学院,珀德尼亚大学)
;
Simula Metropolitan Center for Digital Engineering(模拟 Metropolitan 数字工程中心)
Tactile-based Multimodal Fusion in Embodied Intelligence: A Survey of Vision, Language, and Contact-Driven Paradigms
基于触觉的多模态融合在具身智能中的应用:视觉、语言和接触驱动范式的综述
Zhixiang Cao, Di Tian, Runwei Guan, Yanzhou Mu, Xiaolou Sun, Shaofeng Liang, Daizong Liu, Tao Huang, Yutao Yue, Henghui Ding, Bin Fang, Alex Zhou, Qing-Long Han, Hui Xiong
机构
*
School of Electronic Science and Engineering, Xi’an Jiaotong University, China(西安交通大学电子科学与技术学院)
;
Thrust of Artificial Intelligence, The Hong Kong University of Science and Technology (Guangzhou), China(香港科技大学(广州)人工智能研究所)
;
State Key Laboratory for Novel Software Technology, Nanjing University, China(南京大学新型软件技术国家重点实验室)
;
Purple Mountain Laboratory, China(紫金山实验室)
;
Institute for Math & AI, Wuhan University, China(武汉大学数学与人工智能学院)
;
Centre for AI and Data Science Innovation and the School of Science and Engineering, James Cook University, Australia(詹姆斯库克大学人工智能与数据科学创新中心及科学与工程学院)
;
School of Artificial Intelligence, Beijing University of Posts and Telecommunications, China(北京邮电大学人工智能学院)
;
Institute of Big Data, Fudan University, China(复旦大学大数据研究院)
;
Linkerbot (Beijing) Technology Co., Ltd, China(北京链动科技有限公司)
;
School of Engineering, Swinburne University of Technology, Melbourne(斯威本技术大学工程学院)
EPIC-Bench: A Perception-Centric Benchmark for Fine-Grained Embodied Visual Grounding in Vision-Language Models
EPIC-Bench: 一种以感知为中心的细粒度具身视觉 grounding 的基准
Haozhe Shan, Xiancong Ren, Han Dong, Haoyuan Shi, Yingji Zhang, Jiayu Hu, Yi Zhang, Yong Dai, Bin Shen, Lizhen Qu, Zenglin Xu, Xiaozhu Ju
机构
*
X-Humanoid
;
Fudan University(复旦大学)
;
University of Science and Technology of China(中国科学技术大学)
;
University of Manchester(曼彻斯特大学)
;
Monash University(墨尔本大学)
;
Celonis AI
;
University of New South Wales(新南威尔士大学)