Vision-as-Inverse-Graphics Agent via Interleaved Multimodal Reasoning
通过交错多模态推理的视觉-反图形代理
Shaofeng Yin, Jiaxin Ge, Zora Zhiruo Wang, Chenyang Wang, Xiuyu Li, Michael J. Black, Trevor Darrell, Angjoo Kanazawa, Haiwen Feng
机构
*
University of California, Berkeley(加州大学伯克利分校)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所)
;
Impossible, Inc.(Impossible公司)
BAAI Cardiac Agent: An intelligent multimodal agent for automated reasoning and diagnosis of cardiovascular diseases from cardiac magnetic resonance imaging
BAAI心脏代理:一种智能多模态代理,用于从心脏磁共振成像自动推理和诊断心血管疾病
Taiping Qu, Hongkai Zhang, Lantian Zhang, Can Zhao, Nan Zhang, Hui Wang, Zhen Zhou, Mingye Zou, Kairui Bo, Pengfei Zhao, Xingxing Jin, Zixian Su, Kun Jiang, Huan Liu, Yu Du, Maozhou Wang, Ruifang Yan, Zhongyuan Wang, Tiejun Huang, Lei Xu, Henggui Zhang
机构
*
Beijing Academy of Artificial Intelligence(北京智源人工智能研究院)
;
Department of Radiology, Beijing Anzhen Hospital, Beijing Institute of Heart, Lung & Vascular Diseases, Capital Medical University(首都医科大学附属北京安贞医院放射科,北京市心肺血管疾病研究所)
;
Department of MR, the First Affiliated Hospital, Henan Medical University(河南医科大学第一附属医院磁共振科)
;
Department of Cardiology, Clinical Center for Coronary Heart Disease, Beijing Institute of Heart, Lung and Blood Vessel Disease, Beijing Anzhen Hospital, Capital Medical University(首都医科大学附属北京安贞医院心内科,冠心病临床中心,北京市心肺血管疾病研究所)
;
Department of Cardiac Surgery, Beijing Anzhen Hospital, Institute of Heart, Lung and Vascular Diseases, Capital Medical University(首都医科大学附属北京安贞医院心脏外科,心肺血管疾病研究所)
机构
*
University of California, Los Angeles(加州大学洛杉矶分校)
;
Tencent Hunyuan(腾讯混元)
;
The Chinese University of Hong Kong(香港中文大学)
;
The Hong Kong University of Science and Technology(香港科技大学)
AGCD: Agent-Guided Cross-Modal Decoding for Weather Forecasting
AGCD:面向天气预报的代理引导跨模态解码
Jing Wu, Yang Liu, Lin Zhang, Junbo Zeng, Jiabin Wang, Zi Ye, Guowen Li, Shilei Cao, Jiashun Cheng, Fang Wang, Meng Jin, Yerong Feng, Hong Cheng, Yutong Lu, Haohuan Fu, Juepeng Zheng
机构
*
Sun Yat-sen University(中山大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
Jiangxi Science and Technology Normal University(江西科技师范大学)
;
China Meteorological Administration(中国气象局)
;
Huawei Technologies Co., Ltd(华为技术有限公司)
;
Guangdong-Hong Kong-Macao Greater Bay Area Weather Research Center for Monitoring Warning and Forecasting(粤港澳大湾区气象监测预警与预报研究中心)
;
National Supercomputing Center in Shenzhen(深圳国家超算中心)
;
Tsinghua University(清华大学)
ProtRLSearch: A Multi-Round Multimodal Protein Search Agent with Large Language Models Trained via Reinforcement Learning
ProtRLSearch: 一种基于大语言模型的多轮多模态蛋白质搜索代理,通过强化学习进行训练
Congying Liu, Taihao Li, Ming Huang, Xingyuan Wei, Peipei Liu, Yiqing Shen, Yanxu Mao, Tiehan Cui
机构
*
University of Chinese Academy of Sciences(中国科学院大学)
;
Hangzhou Institute for Advanced Study(杭州高等研究院)
;
Shenzhen Institutes of Advanced Technology(深圳先进技术研究所)
;
Institute of Information Engineering(信息工程研究所)
;
Johns Hopkins University(约翰霍普金斯大学)
;
Henan University(河南大学)
MultiVis-Agent: A Multi-Agent Framework with Logic Rules for Reliable and Comprehensive Cross-Modal Data Visualization
MultiVis-Agent:一种带有逻辑规则的多智能体框架,用于可靠且全面的跨模态数据可视化
Jinwei Lu, Yuanfeng Song, Chen Zhang, Raymond Chi-Wing Wong
机构
*
The Hong Kong Polytechnic University(香港理工大学)
;
The Hong Kong University of Science and Technology(香港科学与技术大学)
;
The Hong Kong University of Science(香港科学大学)
A multimodal Transformer for InSAR-based ground deformation forecasting with cross-site generalization across Europe
基于InSAR的地面形变预测的多模态Transformer及欧洲跨站点泛化
Wendong Yao, Binhua Huang, Soumyabrata Dev
机构
*
The ADAPT SFI Research Centre, Dublin, Ireland(ADAPT SFI研究机构,都柏林,爱尔兰)
;
School of Computer Science, University College Dublin, Belfield, Dublin, Ireland(计算机科学学院,都柏林大学学院,贝尔菲德,都柏林,爱尔兰)
Affective Multimodal Agents with Proactive Knowledge Grounding for Emotionally Aligned Marketing Dialogue
具有主动知识 grounding 的情感多模态代理用于情感对齐的营销对话
Lin Yu, Xiaofei Han, Yifei Kang, Chiung-Yi Tseng, Danyang Zhang, Ziqian Bi, Zhimo Han
机构
*
Hunan Police Academy, Department of Criminal Investigation(湖南警察学院犯罪侦查系)
;
Business College, California State University(加州州立大学长滩分校商学院)
;
Northwestern University(西北大学)
;
AI Agent Lab, Vokram Group(Vokram集团AI代理实验室)
;
Beijing University of Technology(北京理工大学)
;
Zheng Zhou University of Light Industry(郑州轻工业大学)
Voice-Interactive Surgical Agent for Multimodal Patient Data Control
多模态患者数据控制的语音交互手术代理
Hyeryun Park, Byung Mo Gu, Jun Hee Lee, Byeong Hyeon Choi, Sekeun Kim, Hyun Koo Kim, Kyungsang Kim
机构
*
Image Guided Precision Cancer Surgery Institute, College of Medicine, Korea University(影像引导精准癌症手术研究所,韩国大学医学院)
;
Department of Radiology, Massachusetts General Hospital(放射科,麻省总医院)
;
Department of Thoracic and Cardiovascular Surgery, Korea University Guro Hospital, College of Medicine, Korea University(胸外科和心血管外科,韩国大学Guro医院,韩国大学医学院)
;
Department of Biomedical Sciences, College of Medicine, Korea University(生物医学科学系,韩国大学医学院)
DeepAgent: A Dual Stream Multi Agent Fusion for Robust Multimodal Deepfake Detection
DeepAgent: 一种双流多智能体融合用于鲁棒多模态深度伪造检测
Sayeem Been Zaman, Wasimul Karim, Arefin Ittesafun Abian, Reem E. Mohamed, Md Rafiqul Islam, Asif Karim, Sami Azam
机构
*
Applied Artificial Intelligence and Intelligent Systems (AAIINS) Laboratory(应用人工智能与智能系统实验室)
;
Department of Computer Science and Engineering(计算机科学与工程系)
;
University of Scholars(学者大学)
;
Faculty of Science and Information Technology(科学与信息技术学院)
;
Faculty of Science and Technology(科学与技术学院)
Multimodal Oncology Agent for IDH1 Mutation Prediction in Low-Grade Glioma
多模态肿瘤代理用于低级别胶质瘤IDH1突变预测
Hafsa Akebli, Adam Shephard, Vincenzo Della Mea, Nasir Rajpoot
机构
*
Department of Mathematics, Computer Science and Physics, University of Udine(乌迪大学数学、计算机科学与物理系)
;
Tissue Image Analytics Centre, Department of Computer Science, University of Warwick(沃里克大学计算机科学系组织图像分析中心)
;
Histofy Ltd(Histofy有限公司)