CGC: Compositional Grounded Contrast for Fine-Grained Multi-Image Understanding
CGC:基于组成性 grounded 对比的细粒度多图像理解
Lihao Zheng, Zhenwei Shao, Yu Zhou, Yan Yang, Xintian Shen, Jiawei Chen, Hao Ma, Tao Wei
机构
*
School of Computer Science and Technology, Hangzhou Dianzi University(杭州电子科技大学计算机科学与技术学院)
;
School of Computer Science(计算机科学学院)
;
Technology, Hangzhou Dianzi University(技术,杭州电子科技大学)
机构
*
Department of Electrical and Computer Engineering, University of Washington(华盛顿大学电气与计算机工程系)
;
Applied Physics Laboratory, University of Washington(华盛顿大学应用物理实验室)
Inter-Stance: A Dyadic Multimodal Corpus for Conversational Stance Analysis
跨实例:一种双人多模态语料库用于对话立场分析
Xiang Zhang, Xiaotian Li, Taoyue Wang, Nan Bi, Xin Zhou, Cody Zhou, Zoie Wang, Andrew Yang, Yuming Su, Jeff Cohn, Qiang Ji, Lijun Yin
机构
*
State University of New York at Binghamton(纽约州立大学布法罗分校)
;
Choate Rosemary Hall(乔斯-罗丝玛丽高中)
;
Rensselaer Polytechnic Institute(拉特格斯理工学院)
;
Ward Melville High School(沃德梅尔维尔高中)
;
University of Pittsburgh(匹兹堡大学)
SpikingBrain2.0: Brain-Inspired Foundation Models for Efficient Long-Context and Cross-Platform Inference
SpikingBrain2.0:面向高效长上下文和跨平台推理的脑启发基础模型
Yuqi Pan, Jinghao Zhuang, Yupeng Feng, Fangzhi Zhong, Siyu Ding, Xuerui Qiu, Shaowei Gu, Bohan Sun, Zhiyong Qin, Yibo Zhong, Lingtao Ouyang, Kun Yang, Zehao Liu, Yuhong Chou, Shurong Wang, Anjie Hu, Han Xu, Bo Xu, Guoqi Li
机构
*
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Beijing Key Laboratory of Brain-Inspired General Intelligence Large Model(北京脑启发通用智能大模型重点实验室)
;
Key Laboratory of Brain Cognition and Brain-inspired Intelligence Technology(脑认知与脑启发智能技术重点实验室)
;
The Hong Kong Polytechnic University(香港理工大学)
Lightweight Retrieval-Augmented Generation and Large Language Model-Based Modeling for Scalable Patient-Trial Matching
轻量级检索增强生成与基于大语言模型的建模用于可扩展的患者试验匹配
Xiaodi Li, Yang Xiao, Munhwan Lee, Konstantinos Leventakos, Young J. Juhn, David Jones, Terence T. Sio, Wei Liu, Maria Vassilaki, Nansu Zong
机构
*
Department of Artificial Intelligence and Informatics, Mayo Clinic(人工智能与信息学系,梅奥诊所)
;
Computer Science Department, University of Tulsa(图兰大学计算机科学系)
;
Mayo Clinic Comprehensive Cancer Center, Mayo Clinic(梅奥诊所综合癌症中心,梅奥诊所)
;
Division of Community Pediatric and Adolescent Medicine, Department of Pediatrics, Mayo Clinic(社区儿科与青少年医学分会,儿科部,梅奥诊所)
;
Department of Neurology, Mayo Clinic(神经病学部,梅奥诊所)
;
Department of Radiation Oncology, Mayo Clinic(放射肿瘤学部,梅奥诊所)
;
Department of Quantitative Health Sciences, Mayo Clinic(定量健康科学部,梅奥诊所)
Selective Contrastive Learning For Gloss Free Sign Language Translation
选择性对比学习用于无 gloss 手语翻译
Changhao Lai, Rui Zhao, Xuewen Zhong, Jinsong Su, Yidong Chen
机构
*
School of Informatics, Xiamen University, China(厦门大学信息学院)
;
Key Lab of Digital Protection and Intelligent Processing of Intangible Cultural Heritage of Fujian-Taiwan (XMU), Ministry of Culture and Tourism, China(福建省 Fujian-Taiwan 非物质文化遗产数字保护与智能处理重点实验室,文化部,中国)
;
National Language Resources Monitoring and Research Center for Education and Teaching Media, Xiamen University, China(教育与教学媒体语言资源监测与研究中心,厦门大学,中国)
Unlocking Optical Prior: Spectrum-Guided Knowledge Transfer for SAR Generalized Category Discovery
解锁光学先验:基于频谱引导的知识迁移用于SAR广义类别发现
Jingyuan Xia, Ruikang Hu, Ye Li, Zhixiong Yang, Xu Lan, Zhejun Lu
机构
*
College of Electronic Science and Technology, National University of Defense Technology(电子科学与技术学院,国防科技大学)
;
State Key Laboratory of Complex System Simulation and Modeling Technology(复杂系统仿真与建模技术国家重点实验室)
机构
*
School of Software, Shandong University(山东大学软件学院)
;
Department of Computing, Hong Kong Polytechnic University(香港理工大学计算机系)
;
School of Computer Science and Technology, Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)计算机科学与技术学院)
From Classical Machine Learning to Emerging Foundation Models: Review on Multimodal Data Integration for Cancer Research
从经典机器学习到新兴基础模型:癌症研究中多模态数据整合的综述
Amgad Muneer, Muhammad Waqas, Maliazurina B Saad, Eman Showkatian, Rukhmini Bandyopadhyay, Hui Xu, Wentao Li, Joe Y Chang, Zhongxing Liao, Cara Haymaker, Luisa Solis Soto, Carol C Wu, Natalie I Vokes, Xiuning Le, Lauren A Byers, Don L Gibbons, John V Heymach, Jianjun Zhang, Jia Wu
机构
*
Department of Imaging Physics, The University of Texas MD Anderson Cancer Center(影像物理系,德克萨斯大学MD安德森癌症中心)
;
Department of Thoracic/Head and Neck Medical Oncology, The University of Texas MD Anderson Cancer Center(胸腔/头颈医学肿瘤科,德克萨斯大学MD安德森癌症中心)
;
Department of Thoracic Radiation Oncology, The University of Texas MD Anderson Cancer Center(胸腔放射肿瘤科,德克萨斯大学MD安德森癌症中心)
;
Department of Translational Molecular Pathology, The University of Texas MD Anderson Cancer Center(转化分子病理学系,德克萨斯大学MD安德森癌症中心)
;
Department of Thoracic Imaging, The University of Texas MD Anderson Cancer Center(胸腔影像科,德克萨斯大学MD安德森癌症中心)
Flexible Multitask Learning with Factorized Diffusion Policy
灵活的多任务学习与因子化扩散策略
Chaoqi Liu, Haonan Chen, Sigmund H. Høeg, Shaoxiong Yao, Yunzhu Li, Kris Hauser, Yilun Du
机构
*
University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
Harvard University(哈佛大学)
;
Norwegian University of Science and Technology(挪威科学与技术大学)
;
Columbia University(哥伦比亚大学)
EuropeMedQA Study Protocol: A Multilingual, Multimodal Medical Examination Dataset for Language Model Evaluation
欧洲医学问答研究协议:一个多语言、多模态的医学考试数据集用于语言模型评估
Francesco Andrea Causio, Vittorio De Vita, Olivia Riccomi, Michele Ferramola, Federico Felizzi, Alessandro Tosi, Antonio Cristiano, Lorenzo De Mori, Chiara Battipaglia, Melissa Sawaya, Luigi De Angelis, Marcello Di Pumpo, Alessandra Piscitelli, Pietro Eric Risuleo, Alessia Longo, Giulia Vojvodic, Mariapia Vassalli, Bianca Destro Castaniti, Nicolò Scarsi, Manuel Del Medico
UNIKIE-BENCH: Benchmarking Large Multimodal Models for Key Information Extraction in Visual Documents
UNIKIE-BENCH:用于视觉文档中关键信息提取的大型多模态模型基准测试
Yifan Ji, Zhipeng Xu, Zhenghao Liu, Zulong Chen, Qian Zhang, Zhibo Yang, Junyang Lin, Yu Gu, Ge Yu, Maosong Sun
机构
*
School of Computer Science and Engineering, Northeastern University, Shenyang, China(东北大学计算机科学与工程学院)
;
Department of Computer Science and Technology, Tsinghua University, Beijing, China(清华大学计算机科学与技术系)
;
Alibaba Group, Hangzhou, China(阿里巴巴集团)