机构
*
Shanghai AI Laboratory(上海人工智能实验室)
;
Nanjing University(南京大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
The Chinese University of Hong Kong(香港中文大学)
机构
*
Shenzhen Campus of Sun Yat-sen University(中山大学深圳校区)
;
Westlake University(西湖大学)
;
Li Auto Inc.(Li汽车公司)
;
The University of Toronto(多伦多大学)
;
University of Macau(澳门大学)
SlideGen: Collaborative Multimodal Agents for Scientific Slide Generation
SlideGen:用于科学幻灯片生成的协作多模态智能体
Xin Liang, Xiang Zhang, Yiwei Xu, Siqi Sun, Chenyu You
机构
*
Stony Brook University(石溪大学)
;
University of British Columbia(不列颠哥伦比亚大学)
;
University of California, Los Angeles(加州大学洛杉矶分校)
;
Fudan University(复旦大学)
CtrlVDiff: Controllable Video Generation via Unified Multimodal Video Diffusion
通过统一多模态视频扩散实现可控视频生成
Dianbing Xi, Jiepeng Wang, Yuanzhi Liang, Xi Qiu, Jialun Liu, Hao Pan, Yuchi Huo, Rui Wang, Haibin Huang, Chi Zhang, Xuelong Li
机构
*
State Key Laboratory of CAD&CG(计算机辅助设计与图形学国家重点实验室)
;
Institute of Artificial Intelligence, China Telecom (TeleAI)(中国电信人工智能研究院)
;
Tsinghua University(清华大学)
机构
*
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Nanyang Technological University(南洋理工大学)
;
Beijing Key Laboratory of Network System and Network Culture(北京网络系统与网络文化重点实验室)
;
Key Laboratory of Interactive Technology and Experience System, Ministry of Culture and Tourism(文化和旅游部交互技术与体验系统重点实验室)
;
Zhongguancun Academy, Beijing, China(中关村学院,北京,中国)
A Smart-Glasses for Emergency Medical Services via Multimodal Multitask Learning
Liuyi Jin, Pasan Gunawardena, Amran Haroon, Runzhi Wang, Sangwoo Lee, Radu Stoleru, Michael Middleton, Zepeng Huo, Jeeeun Kim, Jason Moats
机构
*
Computer Engineering, Texas A\&M University 3 Texas A\&M University Emergency Medical Services (EMS), 4 Biomedical Data Science, Stanford University, 5 Texas A\&M School of Public Health
Integrating Genomics into Multimodal EHR Foundation Models
Jonathan Amar, Edward Liu, Alessandra Breschi, Liangliang Zhang, Pouya Kheradpour, Sylvia Li, Lisa Soleymani Lehmann, Alessandro Giulianelli, Matt Edwards, Yugang Jia, David Nola, Raghav Mani, Pankaj Vats, Jesse Tetreault, T. J. Chen, Cory Y. McLean
机构
*
Verily Life Sciences(Verily生命科学公司)
;
Nvidia(英伟达公司)
;
Google(谷歌公司)
机构
*
IRMV Lab, the Department of Automation, Shanghai Jiao Tong University(IRMV实验室,自动化系,上海交通大学)
;
Meta Reality Labs(Meta现实实验室)
;
the Department of Electronic Engineering, Shanghai Jiao Tong University(电子工程系,上海交通大学)
;
the School of Information and Control Engineering, China University of Mining and Technology(信息与控制工程学院,中国矿业大学)
;
the College of Intelligence Science and Technology, National University of Defense Technology(智能科学与技术学院,国防科技大学)
VietMEAgent: Culturally-Aware Few-Shot Multimodal Explanation for Vietnamese Visual Question Answering
Hai-Dang Nguyen, Minh-Anh Dang, Minh-Tan Le, Minh-Tuan Le
机构
*
Faculty Of Information Technology, VNU University of Engineering and Technology(信息科技学院,越南工程与技术大学)
;
IT-BT Convergence Technology Division, Vietnam-Korea Institute of Science and Technology(IT-BT融合技术部,越南-韩国科学技术院)
;
TADI Global Lab, TADI Global Company Limited(TADI全球实验室,TADI全球公司)
;
Faculty of Finance, Banking Academy of Vietnam(金融学院,越南银行学院)
Isaac Lab: A GPU-Accelerated Simulation Framework for Multi-Modal Robot Learning
NVIDIA, :, Mayank Mittal, Pascal Roth, James Tigue, Antoine Richard, Octi Zhang, Peter Du, Antonio Serrano-Muñoz, Xinjie Yao, René Zurbrügg, Nikita Rudin, Lukasz Wawrzyniak, Milad Rakhsha, Alain Denzler, Eric Heiden, Ales Borovicka, Ossama Ahmed, Iretiayo Akinola, Abrar Anwar, Mark T. Carlson, Ji Yuan Feng, Animesh Garg, Renato Gasoto, Lionel Gulich, Yijie Guo, M. Gussert, Alex Hansen, Mihir Kulkarni, Chenran Li, Wei Liu, Viktor Makoviychuk, Grzegorz Malczyk, Hammad Mazhar, Masoud Moghani, Adithyavairavan Murali, Michael Noseworthy, Alexander Poddubny, Nathan Ratliff, Welf Rehberg, Clemens Schwarke, Ritvik Singh, James Latham Smith, Bingjie Tang, Ruchik Thaker, Matthew Trepte, Karl Van Wyk, Fangzhou Yu, Alex Millane, Vikram Ramasamy, Remo Steiner, Sangeeta Subramanian, Clemens Volk, CY Chen, Neel Jawale, Ashwin Varghese Kuruttukulam, Michael A. Lin, Ajay Mandlekar, Karsten Patzwaldt, John Welsh, Huihua Zhao, Fatima Anes, Jean-Francois Lafleche, Nicolas Moënne-Loccoz, Soowan Park, Rob Stepinski, Dirk Van Gelder, Chris Amevor, Jan Carius, Jumyung Chang, Anka He Chen, Pablo de Heras Ciechomski, Gilles Daviet, Mohammad Mohajerani, Julia von Muralt, Viktor Reutskyy, Michael Sauter, Simon Schirm, Eric L. Shi, Pierre Terdiman, Kenny Vilella, Tobias Widmer, Gordon Yeoman, Tiffany Chen, Sergey Grizan, Cathy Li, Lotus Li, Connor Smith, Rafael Wiltz, Kostas Alexis, Yan Chang, David Chu, Linxi "Jim" Fan, Farbod Farshidian, Ankur Handa, Spencer Huang, Marco Hutter, Yashraj Narang, Soha Pouya, Shiwei Sheng, Yuke Zhu, Miles Macklin, Adam Moravanszky, Philipp Reist, Yunrong Guo, David Hoeller, Gavriel State
机构
*
Zhejiang Sci-Tech University
;
Style3D Research Hangzhou China
;
State Key Lab of CAD\&CG, Zhejiang University
;
Shanghai Jiao Tong University Shanghai China
;
State Key Lab of CAD\&CG, Zhejiang University Hangzhou China
;
Style3D Research
;
Shanghai Jiao Tong University