Approximate Domain Unlearning for Vision-Language Models
Kodai Kawamura, Yuta Goto, Rintaro Yanagi, Hirokatsu Kataoka, Go Irie
机构
*
Tokyo University of Science(东京科学大学)
;
National University of Singapore(新加坡国立大学)
;
National Institute of Advanced Industrial Science and Technology (AIST)(国家先进工业科学与技术研究院)
;
University of Oxford(牛津大学)
机构
*
Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
Nanjing University of Aeronautics and Astronautics(南京航空航天大学)
;
Northwest A&F University(西北农林科技大学)
;
Nanyang Technological University(南洋理工大学)
;
Jinan University(济南大学)
专题命中
VLM训练与架构
:VLM(title,abstract);visual language model(abstract);分类 cs.CV、cs.AI
机构
*
Harvard University(哈佛大学)
;
City University of Hong Kong(香港城市大学)
;
Amazon(亚马逊)
;
Fudan University(复旦大学)
;
MoE Key Lab of Artificial Intelligence, AI Institute, Shanghai Jiao Tong University(人工智能关键实验室,上海交通大学)
Fine-tuning Vision Language Models with Graph-based Knowledge for Explainable Medical Image Analysis
Chenjun Li, Laurin Lux, Alexander H. Berger, Martin J. Menten, Mert R. Sabuncu, Johannes C. Paetzold
机构
*
School of Electrical and Computer Engineering, Cornell University(电气与计算机工程学院,康奈尔大学)
;
School of Computation, Information and Technology, Technical University of Munich(计算、信息与技术学院,慕尼黑技术大学)
;
Cornell Tech(康奈尔科技)
;
Weill Cornell Medicine(韦尔·康奈尔医学)
专题命中
VLM训练与架构
:vision language model(title);vision-language model(abstract);VLM(abstract);分类 cs.CV、cs.AI
Aligning Large Vision-Language Models by Deep Reinforcement Learning and Direct Preference Optimization
Thanh Thi Nguyen, Campbell Wilson, Janis Dalins
机构
*
AiLECS Lab, Monash University Melbourne, Australia(墨尔本大学AiLECS实验室,澳大利亚)
;
AiLECS Lab, Monash University, Australia ICMEC Australia, Sydney, Australia(墨尔本大学AiLECS实验室,澳大利亚 ICMEC澳大利亚,悉尼,澳大利亚)
专题命中
VLM训练与架构
:vision-language model(title,abstract);multimodal large language model(abstract);分类 cs.AI、cs.LG
CommentsAccepted for publication in the Proceedings of the 8th International Conference on Algorithms, Computing and Artificial Intelligence (ACAI 2025)
机构
*
College of Computer Science and Software Engineering, Shenzhen University(深圳大学计算机科学与软件工程学院)
;
School of Artificial Intelligence, Shenzhen University(深圳大学人工智能学院)
;
Guangdong Provincial Key Laboratory of Intelligent Information Processing(广东省智能信息处理重点实验室)
;
The Hong Kong University of Science and Technology(香港科学与技术大学)
;
Renmin University of China(中国人民大学)
;
National Yang Ming Chiao Tung University
;
Taipei Veterans General Hospital(台北荣民总医院)
;
School of Biomedical Engineering, Shenzhen University(深圳大学生物医学工程学院)
专题命中
VLM训练与架构
:multimodal large language model(title,abstract);MLLM(abstract);分类 cs.CV、cs.AI
CHIRP: A Fine-Grained Benchmark for Open-Ended Response Evaluation in Vision-Language Models
Alexis Roger, Prateek Humane, Daniel Z. Kaplan, Kshitij Gupta, Qi Sun, George Adamopoulos, Jonathan Siu Chi Lim, Quentin Anthony, Edwin Fennell, Irina Rish
机构
*
Mila - Quebec AI Institute(魁北克人工智能研究所)
;
Université de Montréal(蒙特利尔大学)
;
Tokyo Institute of Technology(东京技术大学)
;
McGill University(麦吉尔大学)
;
EleutherAI
;
University College London(伦敦大学学院)
机构
*
School of Computer Science, South China Normal University(华南师范大学计算机科学学院)
;
School of Information Technology in Education, South China Normal University(华南师范大学教育信息技术学院)
专题命中
VLM训练与架构
:multimodal large language model(title,abstract);MLLM(abstract);分类 cs.AI、cs.LG
Accelerating Multimodal Large Language Models via Dynamic Visual-Token Exit and the Empirical Findings
Qiong Wu, Wenhao Lin, Yiyi Zhou, Weihao Ye, Zhanpeng Zen, Xiaoshuai Sun, Rongrong Ji
机构
*
Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University(中国教育部多媒体可信感知与高效计算重点实验室,厦门大学)
;
Institute of Artificial Intelligence, Xiamen University(厦门大学人工智能研究院)
专题命中
VLM训练与架构
:multimodal large language model(title);LLaVA(abstract);InternVL(abstract);分类 cs.CV、cs.LG
机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))
;
Zhejiang University(浙江大学)
;
Fudan University(复旦大学)
;
Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))
;
Terminus Technologies Co., Ltd.
;
Pengcheng Laboratory(鹏城实验室)
Response Wide Shut? Surprising Observations in Basic Vision Language Model Capabilities
Shivam Chandhok, Wan-Cyuan Fan, Vered Shwartz, Vineeth N Balasubramanian, Leonid Sigal
机构
*
University of British Columbia(不列颠哥伦比亚大学)
;
Vector Institute for AI(人工智能矢量研究所)
;
IIT Hyderabad(海得拉巴印度理工学院)
;
CIFAR AI Chair(卡尔加里人工智能主席)
;
Microsoft Research India(微软印度研究院)
专题命中
VLM训练与架构
:vision language model(title);vision-language model(abstract);VLM(abstract);分类 cs.AI、cs.LG
LangMamba: A Language-driven Mamba Framework for Low-dose CT Denoising with Vision-language Models
Zhihao Chen, Tao Chen, Chenhui Wang, Qi Gao, Huidong Xie, Chuang Niu, Ge Wang, Hongming Shan
机构
*
Institute of Science and Technology for Brain-inspired Intelligence, Fudan University(脑启发智能科学与技术研究院,复旦大学)
;
Department of Biomedical Engineering, Yale University(生物医学工程系,耶鲁大学)
;
Biomedical Imaging Center, Center for Biotechnology and Interdisciplinary Studies, Department of Biomedical Engineering, Rensselaer Polytechnic Institute(生物医学成像中心,生物技术与跨学科研究所在生物医学工程系,罗切斯特理工学院)
;
Institute of Science and Technology for Brain-inspired Intelligence, MOE Frontiers Center for Brain Science and Key Laboratory of Computational Neuroscience and Brain-Inspired Intelligence (Ministry of Education), Fudan University(脑启发智能科学与技术研究院,教育部脑科学前沿中心和计算神经科学与脑启发智能重点实验室,复旦大学)
;
Shanghai Center for Brain Science and Brain-inspired Technology(上海脑科学与脑启发技术中心)