Beyond Cross-Modal Alignment: Measuring and Leveraging Modality Gap in Vision-Language Models
超越跨模态对齐:测量和利用模态差距在视觉-语言模型中
Hanqi Yan, Xiangxiang Cui, Lu Yin, Jindong Gu, Paul Pu Liang, Yulan He, Yifei Wang
机构
*
King’s College London(伦敦国王学院)
;
University of Surrey(萨里大学)
;
University of Oxford(牛津大学)
;
MIT CSAIL(麻省理工学院CSAIL实验室)
;
The Alan Turing Institute(阿兰·图灵研究院)
Zhimu Zhou, Yanpeng Zhao, Qiuyu Liao, Bo Zhao, Xiaojian Ma
机构
*
Shanghai Jiao Tong University(上海交通大学)
;
Renmin University of China(中国人民大学)
;
State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,BIGAI)
机构
*
Department of Electrical Engineering, Indian Institute of Technology Delhi, New Delhi, India(印度理工学院德里分校电子工程系)
;
Indian Institute of Science, Bengaluru, India(印度科学研究所,班加罗尔,印度)
Tube Diffusion Policy: Reactive Visual-Tactile Policy Learning for Contact-rich Manipulation
管扩散策略:面向富接触操作的反应式视觉-触觉策略学习
Teng Xue, Alberto Rigo, Bingjian Huang, Jiayi Shen, Zhengtong Xu, Nick Colonnese, Amirhossein H. Memar
机构
*
Meta Reality Labs Research(Meta现实实验室)
;
Idiap Research Institute(Idiap研究机构)
;
École Polytechnique Fédérale de Lausanne(瑞士联邦理工学院)
;
University of Toronto(多伦多大学)
;
Purdue University(普渡大学)
Statistical Test for Diffusion-Based Anomaly Localization via Selective Inference
基于选择性推断的扩散模型异常定位统计检验
Teruyuki Katsuoka, Tomohiro Shiraishi, Daiki Miwa, Vo Nguyen Le Duy, Ichiro Takeuchi
机构
*
Nagoya University(名古屋大学)
;
University of Information Technology(信息技术大学)
;
Vietnam National University, Ho Chi Minh City(越南国家大学,胡志明市)
;
RIKEN(理化学研究所)
Guiding Vector Field Generation via Score-based Diffusion Model
通过基于分数的扩散模型引导向量场生成
Zirui Chen, Shiliang Guo, Shiyu Zhao
机构
*
College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)
;
WINDY Lab, Department of Artificial Intelligence, Westlake University(西湖大学人工智能系WINDY实验室)
DiffuSAM: Diffusion-Based Prompt-Free SAM2 for Few-Shot and Source-Free Medical Image Segmentation
DiffuSAM: 基于扩散的无提示SAM2用于少样本和源无关医学图像分割
Tal Grossman, Noa Cahan, Lev Ayzenberg, Hayit Greenspan
机构
*
School of Electrical Engineering, Tel Aviv University, Israel(特拉维夫大学电气工程学院)
;
School of Biomedical Engineering, Tel Aviv University, Israel(特拉维夫大学生物医学工程学院)
B-FIRE: Binning-Free Diffusion Implicit Neural Representation for Hyper-Accelerated Motion-Resolved MRI
B-FIRE:无分组扩散隐式神经表示用于超加速运动分辨MRI
Di Xu, Hengjie Liu, Yang Yang, Mary Feng, Jin Ning, Xin Miao, Jessica E. Scholey, Alexandra E. Hotca-cho, William C. Chen, Michael Ohliger, Martina Descovich, Huiming Dong, Wensha Yang, Ke Sheng
机构
*
Radiation Oncology, University of California, San Francisco, California(加州大学旧金山分校放射肿瘤学系)
;
Radiology and Biomedical Imaging, University of California, San Francisco, California(加州大学旧金山分校放射学与生物医学成像系)
;
Siemens Medical Solutions USA, Inc., Cleveland, Ohio(西门子医疗解决方案美国公司,克利夫兰,俄亥俄)
;
Radiology at Children’s Hospital Los Angeles, Keck School of Medicine, University of Southern California, Los Angeles, California(洛杉矶儿童医院放射学,美国南加州大学凯克医学院,洛杉矶,加利福尼亚)
CommentsThis is the preprint version of the paper. The final version has been accepted for publication in the Proceedings of the 20th IEEE International Conference on Automatic Face and Gesture Recognition (IEEE FG 2026)
CommentsThis is the preprint (submitted version) of the paper. The final version has been accepted for publication in the Proceedings of the 28th International Conference on Pattern Recognition (ICPR 2026)
BIR-Adapter: A parameter-efficient diffusion adapter for blind image restoration
BIR-Adapter:一种参数高效的扩散适配器用于盲图像恢复
Cem Eteke, Alexander Griessel, Wolfgang Kellerer, Eckehard Steinbach
机构
*
Chair of Media Technology, Munich Institute of Robotics and Machine Intelligence(媒体技术教授会,慕尼黑机器人与机器智能研究所)
;
School of Computation, Information and Technology, Technical University of Munich(计算、信息与技术学院,慕尼黑技术大学)
Dual-domain Multi-path Self-supervised Diffusion Model for Accelerated MRI Reconstruction
双域多路径自监督扩散模型用于加速MRI重建
Yuxuan Zhang, Jinkui Hao, Bo Zhou
机构
*
Department of Radiology, Northwestern University(放射科,西北大学)
;
Department of Biomedical Engineering, Huazhong University of Science and Technology(生物医学工程系,华中科技大学)
Diffusion-Guided Feature Selection via Nishimori Temperature: Noise-Based Spectral Embedding
基于尼希莫里温度的扩散引导特征选择:基于噪声的谱嵌入
Vasiliy S. Usatyuk, Denis A. Sapozhnikov, Sergey I. Egorov
机构
*
Department of Computer Science(计算机科学系)
;
South-West State University(西南州大学)
;
T8 LLC Moscow, Russia(T8 LLC莫斯科俄罗斯)
;
South-West State University Kursk, Russia(西南州大学库尔斯克俄罗斯)