Dual-Priv Pruning : Efficient Differential Private Fine-Tuning in Multimodal Large Language Models
专题命中 VLM训练与架构 :multimodal large language model(title,abstract);分类 cs.AI
AI 大模型
视觉语言模型、视觉推理、视觉问答、图文理解和视觉 grounding。
专题命中 VLM训练与架构 :multimodal large language model(title,abstract);分类 cs.AI
机构 * The University of Tokyo(东京大学) ; The University of Tokyo Hospital(东京大学医院)
专题命中 VLM训练与架构 :VLM(title,abstract);分类 cs.CV
Comments The 4th Workshop on Computer Vision in the Wild
机构 * Zhejiang University(浙江大学) ; ByteDance(字节跳动) ; National University of Singapore(新加坡国立大学) ; Angelalign Inc., China(中国Angelalign公司)
专题命中 VLM训练与架构 :MLLM(title);multimodal large language model(abstract);分类 cs.CV
机构 * The Hong Kong University of Science and Technology(香港科技大学) ; Dartmouth College(达特茅斯学院)
专题命中 VLM训练与架构 :VLM(title);vision-language model(abstract);分类 cs.CV
Comments 16 pages
机构 * Alibaba Group(阿里巴巴集团) ; Zhejiang University(浙江大学) ; M-A-P ; The Chinese University of Hong Kong(香港中文大学)
专题命中 VLM训练与架构 :multimodal large language model(title,abstract);分类 cs.CV
Comments [NAACL 2025] The first four authors contribute equally, 23 pages, repo at https://github.com/Kizna1ver/DREAM
机构 * National University of Singapore(新加坡国立大学) ; Nanyang Technological University(南洋理工大学) ; University of Oxford(牛津大学) ; State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,BIGAI) ; Shanghai Jiao Tong University(上海交通大学) ; Sun Yat-sen University(中山大学) ; The Chinese University of Hong Kong(香港中文大学)
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
Comments 29 pages, 5 figures
机构 * University of Macau(澳门大学) ; Shanghai AI Lab(上海人工智能实验室) ; Institute of Collaborative Innovation project webpage(协同创新项目研究所)
专题命中 VLM训练与架构 :vision-language model(title);VLM(abstract);分类 cs.CV
Comments Here is the project webpage: https://leowangtong.github.io/ALOR/
专题命中 VLM训练与架构 :vision language model(title,abstract);分类 cs.LG
机构 * KFUPM(科威特理工学院)
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
机构 * Shanghai Jiao Tong University(上海交通大学) ; EPIC Lab, SJTU(EPIC实验室,SJTu) ; Shanghai AI Laboratory(上海人工智能实验室) ; Sun Yat-sen University(中山大学)
专题命中 VLM训练与架构 :multimodal large language model(title,abstract);分类 cs.CV
Comments ACL 2025 Findings
机构 * Clemson University(克莱姆森大学)
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
Comments Accepted at the 31st ACM SIGKDD Conference on Knowledge Discovery and Data Mining (KDD 2025)
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
Comments Accepted to ACL2025 (main)
专题命中 VLM训练与架构 :LLaVA(title,abstract);分类 cs.CV
Comments Accepted by ICML 2025
专题命中 VLM训练与架构 :VLM(title);vision-language model(abstract);分类 cs.CV
Comments 10 pages
专题命中 VLM训练与架构 :MLLM(title);multimodal large language model(abstract);分类 cs.CV
机构 * Stanford University(斯坦福大学) ; Together AI ; University of California, Berkeley(加州大学伯克利分校) ; Cedars-Sinai Medical Center(西德斯-西奈医学中心) ; University of California, San Francisco(加州大学旧金山分校)
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
机构 * School of Computer Science, Peking University(北京大学计算机科学学院) ; Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) ; Beijing Academy of Artificial Intelligence(北京人工智能研究院)
专题命中 VLM训练与架构 :MLLM(title,abstract);分类 cs.LG
Comments ICLR 2025
机构 * School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) ; State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
机构 * Muroran Institute of Technology(茂兰技术学院)
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
机构 * NTT, Inc.(NTT公司) ; Kyoto University(京都大学) ; Yokohama National University(横滨国立大学)
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
Comments Code is available at https://github.com/kzkadc/uninfo
机构 * National University of Singapore(新加坡国立大学) ; Nanyang Technological University(南洋理工大学)
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
Comments In Progress
机构 * School of Computing, National University of Singapore(计算学院,新加坡国立大学)
专题命中 VLM训练与架构 :LLaVA(title,abstract);分类 cs.CV
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
Comments 16 pages
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
机构 * Cohere for AI Community(Cohere for AI社区) ; Cisco Meraki ; Indiana University Bloomington(印第安纳大学布卢明顿分校) ; Bangladesh University of Engineering and Technology(孟加拉工程与技术大学)
专题命中 VLM训练与架构 :LLaVA(title,abstract);分类 cs.CV
Comments Accepted at ReGenAI CVPR2025 Workshop as Oral
机构 * Mohamed bin Zayed University of AI(穆罕默德·本·扎耶德人工智能大学) ; Aalto University(艾尔沃斯大学)
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
Comments Accepted at ACL 2024-BIONLP Workshop. Code: https://github.com/mbzuai-oryx/XrayGPT
机构 * TIB – Leibniz Information Centre for Science and Technology(蒂宾根-莱比锡信息科学与技术研究中心) ; Hochschule Hannover – Data(汉诺威高等学院-数据) ; H Institute for Applied Data Science(汉诺威应用数据科学研究所) ; L3S Research Center – Leibniz University Hannover(L3S研究中心-汉诺威莱比锡大学)
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV
Comments 12 pages (excluding references), 8 tables, 1 equation
机构 * Australian Institute for Machine Learning, The University of Adelaide(澳大利亚机器学习研究所,阿德莱德大学) ; Microsoft Research(微软研究院) ; The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) ; Mohamed bin Zayed University of AI(穆罕默德·本·扎耶德人工智能大学)
专题命中 VLM训练与架构 :LLaVA(title,abstract);分类 cs.CV
Comments Accepted by CVPR 2025
机构 * Centre for Innovation & Precision Eye Health(创新与精准眼科健康中心) ; Yong Loo Lin School of Medicine(尤洛林医学院) ; National University of Singapore(新加坡国立大学) ; Department of Ophthalmology(眼科部门) ; Joint Shantou International Eye Center(汕尾国际眼科中心) ; Shantou University(汕尾大学) ; Chinese University of Hong Kong(香港中文大学) ; Department of Radiology(放射科部门) ; University of Pennsylvania(宾夕法尼亚大学) ; School of Biomedical Engineering(生物医学工程学院) ; College of Computer Science and Technology(计算机科学与技术学院) ; Center of Advanced Medical Computing and Analysis(先进医学计算与分析中心) ; National Key Laboratory of Fundamental Science on Synthetic Vision and the College of Computer Science(合成视觉基础科学国家实验室和计算机科学学院) ; Big Vision Medical Technology Ltd.(大视觉医疗科技有限公司) ; Singapore Eye Research Institute(新加坡眼科研究院) ; Singapore National Eye Centre(新加坡国家眼科中心) ; Ophthalmology & Visual Sciences Academic Clinical Program (EYE ACP)(眼科与视觉科学学术临床计划) ; The Chinese University of Hong Kong(香港中文大学) ; Shenzhen Longgang E.N.T Hospital(深圳龙岗耳鼻喉医院) ; Dongguan Songshan Lake Central Hospital(东莞松山湖中心医院) ; Department of Computer Science(计算机科学部门) ; University of Exeter(埃克塞特大学)
专题命中 VLM训练与架构 :vision-language model(title,abstract);分类 cs.CV