机构
*
University of Technology Sydney (UTS)(悉尼技术大学)
;
University of Chinese Academy of Sciences (UCAS)(中国科学院大学)
;
University of Alabama at Birmingham(阿拉巴马大学伯明翰分校)
;
Peking University(北京大学)
ReXGroundingCT: A 3D Chest CT Dataset for Segmentation of Findings from Free-Text Reports
Mohammed Baharoon, Luyang Luo, Michael Moritz, Abhinav Kumar, Sung Eun Kim, Xiaoman Zhang, Miao Zhu, Mahmoud Hussain Alabbad, Maha Sbayel Alhazmi, Neel P. Mistry, Lucas Bijnens, Kent Ryan Kleinschmidt, Brady Chrisler, Sathvik Suryadevara, Sri Sai Dinesh Jaliparthi, Noah Michael Prudlo, Mark David Marino, Jeremy Palacio, Rithvik Akula, Di Zhou, Hong-Yu Zhou, Ibrahim Ethem Hamamci, Scott J. Adams, Hassan Rayhan AlOmaish, Pranav Rajpurkar
机构
*
Department of Biomedical Informatics, Harvard Medical School(哈佛医学院生物医学信息学系)
;
SSM Health, St. Louis, MO(SSM健康系统,圣路易斯,密苏里州)
;
Saint Louis University School of Medicine(圣路易斯大学医学院)
;
Icahn School of Medicine at Mount Sinai(西奈山医院伊坎医学院)
;
National Strategic Technology Research Institute, Seoul National University Hospital(首尔国立大学医院国家战略技术研究机构)
;
Brigham and Women’s Hospital(布里金和妇女医院)
;
Chest Radiology Division, Medical Imaging Department, King Abdullah Specialized Children’s Hospital(国王阿卜杜勒阿齐兹特殊儿童医院放射科,医学成像部门)
;
King Abdulaziz Medical City, Ministry of National Guard Health Affairs(国王阿卜杜勒阿齐兹医疗城,国民卫队卫生事务部)
LLM-RG: Referential Grounding in Outdoor Scenarios using Large Language Models
Pranav Saxena, Avigyan Bhattacharya, Ji Zhang, Wenshan Wang
机构
*
Birla Institute of Technology and Science Pilani, K.K Birla Goa Campus(比拉理工学院和科学学院,K.K Birla Goa校区)
;
Carnegie Mellon University, Robotics Institute(卡内基梅隆大学,机器人研究所)
SAGE: Scene Graph-Aware Guidance and Execution for Long-Horizon Manipulation Tasks
Jialiang Li, Wenzheng Wu, Gaojing Zhang, Yifan Han, Wenzhao Lian
机构
*
School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院)
;
ShanghaiTech University(上海科技大学)
;
University of Sussex(Sussex大学)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
VLM-E2E: Enhancing End-to-End Autonomous Driving with Multimodal Driver Attention Fusion
Pei Liu, Haipeng Liu, Haichao Liu, Xin Liu, Jinxin Ni, Jun Ma
机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
Li Auto Inc.(Li汽车公司)
;
the School of Aeronautics and Astronautics, Xiamen University(厦门大学航空航天学院)
;
The Hong Kong University of Science and Technology(香港科技大学)
机构
*
School of Computer Science and Engineering, South China University of Technology(华南理工大学计算机科学与工程学院)
;
South China University of Technology(华南理工大学)
;
Guangdong Engineering Center for Large Model and GenAI Technology(广东省大模型与生成式人工智能技术工程中心)
;
Guangdong Provincial Key Lab of Computational Intelligence and Cyberspace Information(广东省计算智能与网络信息重点实验室)
;
Centre for Smart Health, Hong Kong Polytechnic University(香港理工大学智能健康研究中心)
;
CAS-Hong Kong Joint Laboratory for Multimodal Medical Molecular Imaging(中国科学院-香港联合多模态医学分子成像联合实验室)
;
School of Electronic and Information Engineering, South China University of Technology(华南理工大学电子与信息学院)
;
Pazhou Lab, Guangzhou, Guangdong, China(广州琶洲实验室)
;
School of Computing and Information Systems, Singapore Management University(新加坡国立大学计算机与信息系统学院)