DeepEyeNet: Generating Medical Report for Retinal Images
机构 * University of Amsterdam(阿姆斯特丹大学)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV、cs.AI
Comments The paper is accepted by the Conference on Information and Knowledge Management (CIKM), 2025
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
机构 * University of Amsterdam(阿姆斯特丹大学)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV、cs.AI
Comments The paper is accepted by the Conference on Information and Knowledge Management (CIKM), 2025
专题命中 多模态生成 :cross-modal(abstract);分类 cs.CV、cs.AI
机构 * School of Computer Science(计算机科学学院) ; School of Science(科学学院) ; Faculty of Information Technology(信息技术学院)
专题命中 多模态生成 :cross-modal(abstract);分类 cs.CL、cs.MM
机构 * The Alan Turing Institute(艾伦·图灵研究所) ; Heriot-Watt University(赫瑞-沃德大学)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
机构 * Mila, University of Montreal(蒙特利尔大学Mila) ; McGill University(麦吉尔大学) ; University of Pennsylvania(宾夕法尼亚大学) ; University of Toronto(多伦多大学) ; University of California, Los Angeles(加州大学洛杉矶分校) ; Southwestern University of Finance and Economics(西南财经大学)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.CL
Comments Accepted as a main conference paper at EMNLP 2025
机构 * Lab for AI in Medical Imaging, Technical University of Munich, Munich, Germany(人工智能医学影像实验室,慕尼黑技术大学,慕尼黑,德国) ; Munich Center for Machine Learning, Munich, Germany(慕尼黑机器学习中心,慕尼黑,德国)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV、cs.AI
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
机构 * Chengdu Techman Software Co., Ltd.(成都技漫软件有限公司) ; Sichuan University(四川大学)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
机构 * School of Computer Science and Engineering, South China University of Technology(华南理工大学计算机科学与工程学院) ; South China University of Technology(华南理工大学) ; Guangdong Engineering Center for Large Model and GenAI Technology(广东省大模型与生成式人工智能技术工程中心) ; Guangdong Provincial Key Lab of Computational Intelligence and Cyberspace Information(广东省计算智能与网络信息重点实验室) ; Centre for Smart Health, Hong Kong Polytechnic University(香港理工大学智能健康研究中心) ; CAS-Hong Kong Joint Laboratory for Multimodal Medical Molecular Imaging(中国科学院-香港联合多模态医学分子成像联合实验室) ; School of Electronic and Information Engineering, South China University of Technology(华南理工大学电子与信息学院) ; Pazhou Lab, Guangzhou, Guangdong, China(广州琶洲实验室) ; School of Computing and Information Systems, Singapore Management University(新加坡国立大学计算机与信息系统学院)
专题命中 多模态生成 :multimodal(abstract);分类 cs.AI、cs.MM
机构 * ONE Lab, HUST(华中科技大学 ONE 实验室) ; ONE Lab, HUST University of Maryland(华中科技大学 与 马里兰大学 ONE 实验室) ; University of Washington(华盛顿大学) ; Zhejiang University(浙江大学)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV、cs.CL
Comments Technical Report
机构 * Peking University(北京大学) ; The Hong Kong University of Science and Technology(香港科技大学) ; Beijing University of Posts and Telecommunications(北京邮电大学)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV、cs.MM
Journal ref ICCV 2025
机构 * School of Computer Science and Engineering, University of Electronic Science and Technology of China(计算机科学与工程学院,电子科技大学)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV、cs.AI
机构 * Paris-Saclay University(巴黎-萨克雷大学) ; ONERA - The French Aerospace Lab(法国航空航天实验室)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV、cs.AI
机构 * Michigan State University(密歇根州立大学) ; Seoul National University(首尔国立大学) ; Rutgers University(罗格斯大学) ; Brookhaven National Laboratory(布鲁赫斯国家实验室)
专题命中 多模态生成 :audio-visual(abstract);分类 cs.AI、eess.AS
Comments Accepted at the ACM MM 2025 - The 1st CogMAEC Workshop (Oral)
机构 * Boston University(波士顿大学) ; Georgetown University(乔治城大学)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
机构 * Research Institute, National Cancer Center Korea(韩国国家癌症中心研究所) ; Department of Radiology, National Cancer Center Korea(韩国国家癌症中心放射科)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
机构 * ByteDance(字节跳动)
专题命中 多模态生成 :omni-modal(abstract);分类 cs.CL、cs.AI
机构 * KAIST(韩国科学技术院)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
Comments 20 pages
机构 * The Hong Kong Polytechnic University(香港理工大学)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
Comments 10 pages, 3 figures, and published to ICCV2025
专题命中 多模态生成 :cross-modal(abstract);分类 cs.CV、cs.AI
机构 * Computer Science, University of Massachusetts Boston(马萨诸塞大学波士顿分校计算机科学系) ; National University of Singapore(新加坡国立大学)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV、cs.AI
Comments WiCV @ ICCV 2025
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
Comments ICCV 2025
机构 * MIT(麻省理工学院) ; MIT-IBM Watson AI Labs(麻省理工-IBM沃森人工智能实验室) ; IBM Research(IBM研究院)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
机构 * Department of Computer and Information Technology, Purdue University(普渡大学计算机与信息科技系) ; School of Software, Nanchang University(南昌大学软件学院) ; Amazon Prime Video(亚马逊Prime视频) ; Department of Epidemiology and Biostatistics, School of Public Health(公共卫生学院流行病学与生物统计学系) ; Department of Computer Science, College of Nanotechnology, Science, and Engineering(纳米技术、科学与工程学院计算机科学系) ; University at Albany, SUNY(阿尔巴尼大学)
专题命中 多模态生成 :multimodal(abstract);分类 cs.AI、cs.MM
机构 * Harvard College(哈佛学院)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.AI
机构 * Università degli Studi di Catania(卡塔尼亚大学) ; Università degli Studi di Messina(梅斯纳大学) ; University College London(伦敦大学学院)
专题命中 多模态生成 :cross-modal(abstract);分类 cs.CV、cs.AI
机构 * Department of Computer Science and Engineering, Department of Chemical and Biological Engineering and Division of Life Science, Hong Kong University of Science and Technology(计算机科学与工程系、化学与生物工程系及生命科学分校,香港科学与技术大学)
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV、cs.CL
Comments Accepted by IEEE TMI