GeoBridge: A Semantic-Anchored Multi-View Foundation Model Bridging Images and Text for Geo-Localization
GeoBridge:一种语义锚定的多视图基础模型,用于图像与文本之间的地理定位
Zixuan Song, Jing Zhang, Di Wang, Zidie Zhou, Wenbin Liu, Haonan Guo, En Wang, Bo Du
机构
*
School of Computer Science and Technology, Jilin University(吉林大学计算机科学与技术学院)
;
School of Computer Science, Wuhan University(武汉大学计算机学院)
;
Zhongguancun Academy, Beijing, China(中关村学院,北京,中国)
;
State Key Laboratory of Information Engineering in Surveying, Mapping and Remote Sensing, Wuhan University(武汉大学测绘遥感信息工程国家重点实验室)
机构
*
Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)
;
The University of Hong Kong(香港大学)
;
Beijing University of Chemical Technology(北京化工大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
Shenzhen University of Infomation Technology(深圳信息大学)
机构
*
Department of Biological and Agricultural Engineering, University of Arkansas(亚拉巴马大学生物与农业工程系)
;
Department of Food Science, University of Arkansas(亚拉巴马大学食品科学系)
A Study of Failure Modes in Two-Stage Human-Object Interaction Detection
两阶段人-物交互检测中故障模式的研究
Lemeng Wang, Qinqian Lei, Vidhi Bakshi, Daniel Yi, Yifan Liu, Jiacheng Hou, Asher Seng Hao, Zheda Mai, Wei-Lun Chao, Robby T. Tan, Bo Wang
机构
*
The Ohio State University(俄亥俄州立大学)
;
National University of Singapore(新加坡国立大学)
;
Boston University(波士顿大学)
;
Independent Researcher(独立研究者)
;
University of Mississippi(密西西比大学)
4th Workshop on Maritime Computer Vision (MaCVi): Challenge Overview
第四届海上计算机视觉研讨会(MaCVi):挑战概述
Benjamin Kiefer, Jan Lukas Augustin, Jon Muhovič, Mingi Jeong, Arnold Wiliem, Janez Pers, Matej Kristan, Alberto Quattrini Li, Matija Teršek, Josip Šarić, Arpita Vats, Dominik Hildebrand, Rafia Rahim, Mahmut Karaaslan, Arpit Vaishya, Steve Xie, Ersin Kaya, Akib Mashrur, Tze-Hsiang Tang, Chun-Ming Tsai, Jun-Wei Hsieh, Ming-Ching Chang, Wonwoo Jo, Doyeon Lee, Yusi Cao, Lingling Li, Vinayak Nageli, Arshad Jamal, Gorthi Rama Krishna Sai Subrahmanyam, Jemo Maeng, Seongju Lee, Kyoobin Lee, Xu Liu, LiCheng Jiao, Jannik Sheikh, Martin Weinmann, Ivan Martinović, Jose Mateus Raitz Persch, Rahul Harsha Cheppally, Mehmet E. Belviranli, Dimitris Gahtidis, Hyewon Chun, Sangmun Lee, Philipp Gorczak, Hansol Kim, Jeeyeon Jeon, Borja Carrillo Perez, Jiahui Wang, Sangmin Park, Andreas Michel, Jannick Kuester, Bettina Felten, Wolfgang Gross, Yuan Feng, Justin Davis
机构
*
LOOKOUT
;
Helmut Schmidt University(海姆·施密特大学)
;
catskill GmbH(catskill公司)
;
University of Ljubljana(卢布尔雅那大学)
;
Virginia Tech(弗吉尼亚理工大学)
;
Shield AI
;
Queensland University of Technology(昆士兰理工大学)
;
Dartmouth College(达特茅斯学院)
;
LinkedIn
;
University of Tuebingen(图宾根大学)
;
Konya Technical University(科尼亚技术大学)
;
Schneider Electric Taiwan Co., Ltd.(施耐德电气台湾有限公司)
;
University of Taipei(台北大学)
;
National Yang Ming Chiao Tung University(阳明交通大学)
;
University at Albany, SUNY(阿尔巴尼大学,SUNY)
;
Inventec Corporation(Inventec公司)
;
HD Korea Shipbuilding & Offshore Engineering Co., Ltd.(韩国海事造船与海洋工程公司)
;
Seoul National University(首尔国立大学)
;
Xidian University(西安电子科技大学)
;
Indian Institute of Technology, Tirupati(印度泰浦蒂理工学院)
;
Centre for Artificial Intelligence and Robotics (CAIR), Bangalore, India(人工智能与机器人中心(CAIR),印度班加罗尔)
;
Gwangju Institute of Science and Technology(全州科学技术院)
;
Fraunhofer IOSB(弗劳恩霍夫 IOSB研究所)
;
Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院)
;
Kansas State University(堪萨斯州立大学)
;
Colorado School of Mines(科罗拉多矿业学院)
;
Arquimea Research Center(Arquimea研究中心)
;
Independent Researcher(独立研究员)
C$^2$T: Captioning-Structure and LLM-Aligned Common-Sense Reward Learning for Traffic--Vehicle Coordination
C$^2$T:基于图像描述与大语言模型对齐的常识奖励学习用于交通-车辆协调
Yuyang Chen, Kaiyan Zhao, Yiming Wang, Ming Yang, Bin Rao, Zhenning Li
机构
*
The State Key Laboratory of Internet of Things for Smart City, University of Macau(物联网智能城市国家重点实验室,澳门大学)
;
Wuhan University(武汉大学)
;
Hong Kong Polytechnic University(香港理工大学)
;
Computer and Information Science, University of Macau(澳门大学计算机与信息科学)
ChartNet: A Million-Scale, High-Quality Multimodal Dataset for Robust Chart Understanding
ChartNet: 一个百万级、高质量的多模态数据集,用于稳健的图表理解
Jovana Kondic, Pengyuan Li, Dhiraj Joshi, Isaac Sanchez, Ben Wiesel, Shafiq Abedin, Amit Alfassy, Eli Schwartz, Daniel Caraballo, Yagmur Gizem Cinar, Florian Scheidegger, Steven I. Ross, Daniel Karl I. Weidele, Hang Hua, Ekaterina Arutyunova, Roei Herzig, Zexue He, Zihan Wang, Xinyue Yu, Yunfei Zhao, Sicong Jiang, Minghao Liu, Qunshu Lin, Peter Staar, Luis Lastras, Aude Oliva, Rogerio Feris
机构
*
MIT(麻省理工学院)
;
MIT-IBM Watson AI Lab(麻省理工-IBM沃森人工智能实验室)
;
IBM Research(IBM研究院)
;
Abaka AI & 2077AI(Abaka AI及2077AI)
A Dataset and Evaluation for Complex 4D Markerless Human Motion Capture
一个用于复杂4D无标记人体运动捕捉的 数据集和评估
Yeeun Park, Miqdad Naduthodi, Suryansh Kumar
机构
*
Visual and Spatial AI Lab(视觉与空间人工智能实验室)
;
VCCM Section College of PVFA(VCCM学院物理与虚拟现实学院)
;
Department of ECEN(电子工程系)
;
Department of CSCE(计算机科学与工程系)
;
Texas A&M University(德克萨斯农工大学)