DroneFINE: Domain-Aware Parameter-Efficient Fine-Tuning of Vision-Language Detectors for Drone Images
DroneFINE: 面向无人机图像的视觉-语言检测器的域感知参数高效微调
Ke Wu, Yanan Zhang, Yingjie Gao, Wenhao Li, Chenyu Zhou, XinZhu Ma, Jiaxin Chen, Di Huang
机构
*
National College for Excellent Engineers, Beihang University, Beijing, China(北京航空航天大学优秀工程师学院)
;
School of Computer Science and Engineering, Beihang University, Beijing, China(北京航空航天大学计算机科学与工程学院)
;
School of Computer Science and Information Engineering, Hefei University of Technology, Hefei, China(合肥工业大学计算机科学与信息工程学院)
;
State Key Laboratory of Virtual Reality Technology and Systems, Beihang University, Beijing, China(虚拟现实技术与系统国家重点实验室)
;
Innovation Center for Intelligent System Cognition and Decision-Making, Beijing, China(智能系统认知与决策创新中心)
;
Information Science Academy of China Electronics Technology Group Corporation, Beijing, China(中国电子科技集团有限公司信息科学研究院)
HDRAgent: An Agentic Framework for Multi-Exposure HDR Imaging
HDRAgent: 一种用于多曝光HDR成像的智能体框架
Weiyu Zhou, Tao Hu, Yijian Wang, Xiaogang Xu, Ruixing Wang, Qingsen Yan
机构
*
School of Computer Science, Northwestern Polytechnical University(西北工业大学计算机学院)
;
Shenzhen Research Institute, Northwestern Polytechnical University(西北工业大学深圳研究院)
;
Zhejiang University(浙江大学)
;
Camera Group, DJI(大疆相机部门)
专题命中
VLM训练与架构
:MLLM(abstract,abstract_cn);multimodal large language model(abstract);分类 cs.CV
机构
*
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
;
School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络空间安全学院)
;
JD.COM(京东)
Lost in Visual Translation: A VLM-Assisted Perceptual-Semantic Coherence Framework for EEG-to-Image Reconstruction
迷失在视觉翻译中:用于脑电到图像重建的基于视觉语言模型的感知语义连贯框架
Sukriti Tiwari, BHVSP Subrahmanyam, Nidhi Goyal, Sai Amrit Patnaik
机构
*
Mahindra University(马欣德拉大学)
;
MU-VT Interdisciplinary Advanced Research Centre for Transformative Technologies, Mahindra University(马欣德拉大学MU-VT变革性技术跨学科高级研究中心)
机构
*
Fudan University(复旦大学)
;
Shanghai Innovation Institute(上海创新研究院)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
Zhejiang University(浙江大学)
;
The Chinese University of Hong Kong(香港中文大学)
专题命中
VLM训练与架构
:multimodal large language model(title);分类 cs.CV
Heterogeneous Vision-Language Ensemble with Disagreement-Aware Reranking for Text-Based Person Anomaly Retrieval
用于基于文本的行人异常检索的、带分歧感知重排序的异构视觉语言集成方法
Huu-An Vu, Cam Tu Tran Thi, Thanh Toan Le Ngo, Hoang Vo, Do Trung Hieu, Hieu Dinh Trung Pham, Khang Minh Le, Huy Minh Nhat Nguyen
机构
*
Hanoi University of Science and Technology(河内科技大学)
;
University of Information Technology, VNU-HCM(胡志明市国家大学信息技术大学)
;
Vietnam National University, Ho Chi Minh City(胡志明市国家大学)
;
VinUniversity
;
Vietnamese-German University(越南德国大学)
机构
*
The University of Sydney(悉尼大学)
;
Tongji University(同济大学)
;
University of Surrey(萨里大学)
;
Nankai University(南开大学)
;
Cornell University(康奈尔大学)
;
City University of Hong Kong(香港城市大学)
LFM: Leveraging Foundation Models for Source-Free Universal Domain Adaptation
LFM:利用基础模型进行无源通用域适应
Jing Li, Pan Liu, Meng Zhao, Wanli Xue, Yanhong Yang, Xu Cheng, Fan Shi, Jianhua Zhang, Qinghua Hu, Shengyong Chen
机构
*
School of Computer Science and Engineering, Tianjin University of Technology(天津理工大学计算机科学与工程学院)
;
Engineering Research Center of Learning-Based Intelligent System, Ministry of Education of the People’s Republic of China, Tianjin University of Technology(中华人民共和国教育部基于学习的智能系统工程研究中心,天津理工大学)
;
School of Artificial Intelligence, Tianjin University(天津大学人工智能学院)
;
Engineering Research Center of City Intelligence and Digital Governance, Ministry of Education of the People’s Republic of China, Tianjin University(中华人民共和国教育部城市智能与数字治理工程研究中心,天津大学)