arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

多模态大模型

跨文本、图像、视频、音频等模态的大模型与学习方法。

共收录 3460 信号源:cs.CV, cs.CL, cs.AI, cs.MM, eess.AS

1. 跨模态检索 3460 篇

2003.03369 2022-04-26 cs.CV 57%

A Survey on Deep Hashing Methods

Xiao Luo, Haixin Wang, Daqing Wu, Chong Chen, Minghua Deng, Jianqiang Huang, Xian-Sheng Hua

专题命中 跨模态检索 :multi-modal(abstract);分类 cs.CV

Comments Accepted by ACM Transactions on Knowledge Discovery from Data (TKDD)

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.12777 2022-04-20 cs.CV 57%

Cross Modal Retrieval with Querybank Normalisation

Simion-Vlad Bogolin, Ioana Croitoru, Hailin Jin, Yang Liu, Samuel Albanie

专题命中 跨模态检索 :cross-modal(abstract);分类 cs.CV

Comments Accepted at CVPR 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.05665 2022-04-13 eess.IV cs.CV physics.med-ph 57%

How to Register a Live onto a Liver ? Partial Matching in the Space of Varifolds

Pierre-Louis Antonsanti, Thomas Benseghir, Vincent Jugnon, Mario Ghosn, Perrine Chassat, Irène Kaltenmark, Joan Glaunès

专题命中 跨模态检索 :multi-modal(abstract);分类 cs.CV

Comments 30 pages, 11 figures, Special Issue: Information Processing in Medical Imaging (IPMI) 2021, Accepted for publication at the Journal of Machine Learning for Biomedical Imaging (MELBA) https://www.melba-journal.org

Journal ref Journal of Machine Learning for Biomedical Imaging (MELBA) 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.01264 2022-04-05 cs.CV 57%

Probabilistic Implicit Scene Completion

Dongsu Zhang, Changwoon Choi, Inbum Park, Young Min Kim

专题命中 跨模态检索 :multi-modal(abstract);分类 cs.CV

Comments Accepted to ICLR 2022 as spotlight, code available at https://github.com/96lives/gca

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.16248 2022-03-31 cs.CV 57%

InstaFormer: Instance-Aware Image-to-Image Translation with Transformer

Soohyun Kim, Jongbeom Baek, Jihye Park, Gyeongnyeon Kim, Seungryong Kim

专题命中 跨模态检索 :multi-modal(abstract);分类 cs.CV

Comments Accepted to CVPR 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.16071 2022-03-31 cs.CV 57%

Learning Program Representations for Food Images and Cooking Recipes

Dim P. Papadopoulos, Enrique Mora, Nadiia Chepurko, Kuan Wei Huang, Ferda Ofli, Antonio Torralba

专题命中 跨模态检索 :cross-modal(abstract);分类 cs.CV

Comments CVPR 2022 oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.15595 2022-03-30 cs.IR cs.AI 57%

Cross-Media Scientific Research Achievements Retrieval Based on Deep Language Model

Benzhi Wang, Meiyu Liang, Feifei Kou, Mingying Xu

专题命中 跨模态检索 :cross-modal(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.14804 2022-03-29 cs.CV 57%

Partially Does It: Towards Scene-Level FG-SBIR with Partial Input

Pinaki Nath Chowdhury, Ayan Kumar Bhunia, Viswanatha Reddy Gajjala, Aneeshan Sain, Tao Xiang, Yi-Zhe Song

专题命中 跨模态检索 :cross-modal(abstract);分类 cs.CV

Comments Accepted in CVPR 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.14691 2022-03-29 cs.CV 57%

Sketch3T: Test-Time Training for Zero-Shot SBIR

Aneeshan Sain, Ayan Kumar Bhunia, Vaishnav Potlapalli, Pinaki Nath Chowdhury, Tao Xiang, Yi-Zhe Song

专题命中 跨模态检索 :cross-modal(abstract);分类 cs.CV

Comments 10 pages, 5 figures. Accepted in CVPR 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.13006 2022-03-25 cs.CV 57%

Compound Domain Generalization via Meta-Knowledge Encoding

Chaoqi Chen, Jiongcheng Li, Xiaoguang Han, Xiaoqing Liu, Yizhou Yu

专题命中 跨模态检索 :multi-modal(abstract);分类 cs.CV

Comments Accepted by CVPR 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.00678 2022-03-18 cs.IR cs.LG cs.MM 57%

Latent Structure Mining with Contrastive Modality Fusion for Multimedia Recommendation

Jinghao Zhang, Yanqiao Zhu, Qiang Liu, Mengqi Zhang, Shu Wu, Liang Wang

专题命中 跨模态检索 :multimodal(abstract);分类 cs.MM

Comments 14 pages; in submission to IEEE TKDE

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.08688 2022-03-17 cs.CV 57%

Learning video retrieval models with relevance-aware online mining

Alex Falcon, Giuseppe Serra, Oswald Lanz

专题命中 跨模态检索 :cross-modal(abstract);分类 cs.CV

Comments Accepted at 21st International Conference on Image Analysis and Processing (ICIAP 2021)

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.05208 2022-03-15 cs.CV 57%

Supervision Exists Everywhere: A Data Efficient Contrastive Language-Image Pre-training Paradigm

Yangguang Li, Feng Liang, Lichen Zhao, Yufeng Cui, Wanli Ouyang, Jing Shao, Fengwei Yu, Junjie Yan

专题命中 跨模态检索 :image-text(abstract);分类 cs.CV

Comments 17 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2102.04252 2022-03-15 cs.CY cs.AI cs.LG 57%

HINT: Hierarchical Interaction Network for Trial Outcome Prediction Leveraging Web Data

Tianfan Fu, Kexin Huang, Cao Xiao, Lucas M. Glass, Jimeng Sun

专题命中 跨模态检索 :multi-modal(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.03727 2022-03-09 cs.CV 57%

Barlow constrained optimization for Visual Question Answering

Abhishek Jha, Badri N. Patro, Luc Van Gool, Tinne Tuytelaars

专题命中 跨模态检索 :multimodal(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.01532 2022-03-04 cs.CV 57%

Exploring Patch-wise Semantic Relation for Contrastive Learning in Image-to-Image Translation Tasks

Chanyong Jung, Gihyun Kwon, Jong Chul Ye

专题命中 跨模态检索 :multi-modal(abstract);分类 cs.CV

Comments CVPR 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2102.13622 2022-02-22 cs.CL cs.LG 57%

A Meta-embedding-based Ensemble Approach for ICD Coding Prediction

Pavithra Rajendran, Alexandros Zenonos, Josh Spear, Rebecca Pope

专题命中 跨模态检索 :multimodal(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.11313 2022-01-28 cs.CL cs.IR 57%

Learning Deep Semantic Model for Code Search using CodeSearchNet Corpus

Chen Wu, Ming Yan

专题命中 跨模态检索 :multi-modal(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
1910.10699 2022-01-26 cs.LG cs.CV stat.ML 57%

Contrastive Representation Distillation

Yonglong Tian, Dilip Krishnan, Phillip Isola

专题命中 跨模态检索 :cross-modal(abstract);分类 cs.CV

Comments ICLR 2020. Project Page: http://hobbitlong.github.io/CRD/, Code: http://github.com/HobbitLong/RepDistiller. Typo fixed in the newest version

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.04680 2022-01-19 cs.CV 57%

SimIPU: Simple 2D Image and 3D Point Cloud Unsupervised Pre-Training for Spatial-Aware Visual Representations

Zhenyu Li, Zehui Chen, Ang Li, Liangji Fang, Qinhong Jiang, Xianming Liu, Junjun Jiang, Bolei Zhou, Hang Zhao

专题命中 跨模态检索 :multi-modal(abstract);分类 cs.CV

Comments Accepted to 36th AAAI Conference on Artificial Intelligence (AAAI 2022)

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.08454 2022-01-19 cs.CV 57%

Margin Preserving Self-paced Contrastive Learning Towards Domain Adaptation for Medical Image Segmentation

Zhizhe Liu, Zhenfeng Zhu, Shuai Zheng, Yang Liu, Jiayu Zhou, Yao Zhao

专题命中 跨模态检索 :cross-modal(abstract);分类 cs.CV

Comments This manuscript has been accepted by by IEEE JBHI and the code is available in https://github.com/TFboys-lzz/MPSCL

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.04309 2022-01-13 cs.CV cs.LG 57%

Robust Contrastive Learning against Noisy Views

Ching-Yao Chuang, R Devon Hjelm, Xin Wang, Vibhav Vineet, Neel Joshi, Antonio Torralba, Stefanie Jegelka, Yale Song

专题命中 跨模态检索 :multimodal(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.01266 2022-01-05 eess.IV cs.CV cs.LG 57%

Swin UNETR: Swin Transformers for Semantic Segmentation of Brain Tumors in MRI Images

Ali Hatamizadeh, Vishwesh Nath, Yucheng Tang, Dong Yang, Holger Roth, Daguang Xu

专题命中 跨模态检索 :multi-modal(abstract);分类 cs.CV

Comments 13 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.11294 2022-01-05 cs.IR cs.LG cs.MM 57%

Extending CLIP for Category-to-image Retrieval in E-commerce

Mariya Hendriksen, Maurits Bleeker, Svitlana Vakulenko, Nanne van Noord, Ernst Kuiper, Maarten de Rijke

专题命中 跨模态检索 :multimodal(abstract);分类 cs.MM

Comments 15 pages, accepted as a full paper at ECIR 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.15089 2021-12-20 cs.CV 57%

Analogous to Evolutionary Algorithm: Designing a Unified Sequence Model

Jiangning Zhang, Chao Xu, Jian Li, Wenzhou Chen, Yabiao Wang, Ying Tai, Shuo Chen, Chengjie Wang, Feiyue Huang, Yong Liu

专题命中 跨模态检索 :multi-modal(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.04397 2021-11-09 cs.CV cs.RO 57%

GROWL: Group Detection With Link Prediction

Viktor Schmuck, Oya Celiktutan

专题命中 跨模态检索 :multimodal(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.03015 2021-10-27 cs.CV 57%

RTIC: Residual Learning for Text and Image Composition using Graph Convolutional Network

Minchul Shin, Yoonjae Cho, Byungsoo Ko, Geonmo Gu

专题命中 跨模态检索 :image-text(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.09169 2021-10-13 cs.CV 57%

LaLaLoc: Latent Layout Localisation in Dynamic, Unvisited Environments

Henry Howard-Jenkins, Jose-Raul Ruiz-Sarmiento, Victor Adrian Prisacariu

专题命中 跨模态检索 :cross-modal(abstract);分类 cs.CV

Comments As presented at the International Conference on Computer Vision (ICCV) 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.04002 2021-10-11 cs.IR cs.AI 57%

Multiplex Behavioral Relation Learning for Recommendation via Memory Augmented Transformer Network

Lianghao Xia, Chao Huang, Yong Xu, Peng Dai, Bo Zhang, Liefeng Bo

专题命中 跨模态检索 :multi-modal(abstract);分类 cs.AI

Comments Published as a full paper at SIGIR 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.07391 2021-09-29 cs.CV 57%

Survey of Visual-Semantic Embedding Methods for Zero-Shot Image Retrieval

Kazuya Ueki

专题命中 跨模态检索 :image-text(abstract);分类 cs.CV

Comments Accepted by 20th IEEE International Conference on Machine Learning and Applications (ICMLA2021)

详情

展开后加载摘要…

URL PDF HTML 收藏