机构
*
Fudan University(复旦大学)
;
Shanghai Innovation Institute(上海创新研究院)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
Zhejiang University(浙江大学)
;
The Chinese University of Hong Kong(香港中文大学)
专题命中
VLM训练与架构
:multimodal large language model(title);分类 cs.CV
Heterogeneous Vision-Language Ensemble with Disagreement-Aware Reranking for Text-Based Person Anomaly Retrieval
用于基于文本的行人异常检索的、带分歧感知重排序的异构视觉语言集成方法
Huu-An Vu, Cam Tu Tran Thi, Thanh Toan Le Ngo, Hoang Vo, Do Trung Hieu, Hieu Dinh Trung Pham, Khang Minh Le, Huy Minh Nhat Nguyen
机构
*
Hanoi University of Science and Technology(河内科技大学)
;
University of Information Technology, VNU-HCM(胡志明市国家大学信息技术大学)
;
Vietnam National University, Ho Chi Minh City(胡志明市国家大学)
;
VinUniversity
;
Vietnamese-German University(越南德国大学)
机构
*
The University of Sydney(悉尼大学)
;
Tongji University(同济大学)
;
University of Surrey(萨里大学)
;
Nankai University(南开大学)
;
Cornell University(康奈尔大学)
;
City University of Hong Kong(香港城市大学)
LFM: Leveraging Foundation Models for Source-Free Universal Domain Adaptation
LFM:利用基础模型进行无源通用域适应
Jing Li, Pan Liu, Meng Zhao, Wanli Xue, Yanhong Yang, Xu Cheng, Fan Shi, Jianhua Zhang, Qinghua Hu, Shengyong Chen
机构
*
School of Computer Science and Engineering, Tianjin University of Technology(天津理工大学计算机科学与工程学院)
;
Engineering Research Center of Learning-Based Intelligent System, Ministry of Education of the People’s Republic of China, Tianjin University of Technology(中华人民共和国教育部基于学习的智能系统工程研究中心,天津理工大学)
;
School of Artificial Intelligence, Tianjin University(天津大学人工智能学院)
;
Engineering Research Center of City Intelligence and Digital Governance, Ministry of Education of the People’s Republic of China, Tianjin University(中华人民共和国教育部城市智能与数字治理工程研究中心,天津大学)
CritiqueDriveVLM: From Verifier-Guided Reinforcement Learning to Latent Thought Distillation for Autonomous Driving
CritiqueDriveVLM:从验证器引导的强化学习到自动驾驶的潜在思想蒸馏
Zhaohong Liu, Hao Ye, Xianlin Zhang, Mengshi Qi
机构
*
State Key Laboratory of Networking and Switching Technology(网络与交换技术国家重点实验室)
;
School of Digital Media & Design Arts(数字媒体与设计艺术学院)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
ADAPT: Attention Dynamics Alignment with Preference Tuning for Faithful MLLMs
ADAPT: 通过偏好调优实现注意力动态对齐以增强多模态大模型的忠实性
Zhiyuan Yao, Zheren Fu, Zhixiao Zheng, Jiajun Li, Yi Tu, Zhendong Mao
机构
*
University of Science and Technology of China(中国科学技术大学)
;
Huawei Technologies Ltd.(华为技术有限公司)
;
State Key Laboratory of Communication Content Cognition, People’s Daily Online(人民网传播内容认知国家重点实验室)
专题命中
VLM训练与架构
:grounding(abstract);multimodal large language model(abstract);分类 cs.CV、cs.AI
Tool-IQA: Augmenting Image Quality Assessment with Simple Tools
Tool-IQA: 利用简单工具增强图像质量评估
Guanyi Qin, Junjie Zhang, Chunming He, Yibing Fu, Jie Liang, Tianhe Wu, Lei Zhang
机构
*
National University of Singapore(新加坡国立大学)
;
OPPO Research Institute(OPPO研究院)
;
Nanyang Technical University(南洋理工大学)
;
Duke University(杜克大学)
;
City University of Hong Kong(香港城市大学)
;
The Hong Kong Polytechnic University(香港理工大学)