arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视觉大模型 / VLM

视觉语言模型、视觉推理、视觉问答、图文理解和视觉 grounding。

共收录 7360 信号源:cs.CV, cs.AI, cs.LG

1. 视觉定位与Grounding 7360 篇

2201.00454 2022-01-04 cs.CV 79%

Memory-Guided Semantic Learning Network for Temporal Sentence Grounding

Daizong Liu, Xiaoye Qu, Xing Di, Yu Cheng, Zichuan Xu, Pan Zhou

专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.CV

Comments Accepted by AAAI2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.13031 2021-12-28 cs.CV cs.RO 79%

Grounding Linguistic Commands to Navigable Regions

Nivedita Rufus, Kanishk Jain, Unni Krishnan R Nair, Vineet Gandhi, K Madhava Krishna

专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.CV

Journal ref 2021 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), 2021, pp. 8593-8600

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.10138 2021-12-21 cs.AI 79%

Classical Planning as QBF without Grounding (extended version)

Irfansha Shaik, Jaco van de Pol

专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.04872 2021-12-16 cs.CV cs.MM 79%

Negative Sample Matters: A Renaissance of Metric Learning for Temporal Grounding

Zhenzhi Wang, Limin Wang, Tao Wu, Tianhao Li, Gangshan Wu

专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.CV

Comments AAAI 2022 Camera Ready Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.11475 2021-12-07 cs.CV 79%

Self-supervised Learning for Semi-supervised Temporal Language Grounding

Fan Luo, Shaoxiang Chen, Jingjing Chen, Zuxuan Wu, Yu-Gang Jiang

专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.00475 2021-12-02 cs.CV cs.CL 79%

Weakly-Supervised Video Object Grounding via Causal Intervention

Wei Wang, Junyu Gao, Changsheng Xu

专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.05717 2021-12-02 cs.CV cs.CL 79%

Relation-aware Video Reading Comprehension for Temporal Language Grounding

Jialin Gao, Xin Sun, Mengmeng Xu, Xi Zhou, Bernard Ghanem

专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.CV

Comments Accepted by EMNLP-21

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.07180 2021-11-16 cs.CL cs.LG 79%

Explainable Semantic Space by Grounding Language to Vision with Cross-Modal Contrastive Learning

Yizhen Zhang, Minkyu Choi, Kuan Han, Zhongming Liu

专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.LG

Comments 10 pages, 7 figures, 1 appendix, to be published in Neurips 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.04321 2021-11-09 cs.CV cs.CL 79%

Towards Debiasing Temporal Sentence Grounding in Video

Hao Zhang, Aixin Sun, Wei Jing, Joey Tianyi Zhou

专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.CV

Comments 13 pages, 6 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.03438 2021-11-08 cs.RO cs.CL cs.CV 79%

LanguageRefer: Spatial-Language Model for 3D Visual Grounding

Junha Roh, Karthik Desingh, Ali Farhadi, Dieter Fox

专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.CV

Comments 11 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.05624 2021-11-01 cs.CV 79%

End-to-end Multi-modal Video Temporal Grounding

Yi-Wen Chen, Yi-Hsuan Tsai, Ming-Hsuan Yang

专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.CV

Comments Accepted in NeurIPS 2021. Project page at https://github.com/wenz116/DRFT

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.10540 2021-09-23 cs.CL cs.AI 79%

Awakening Latent Grounding from Pretrained Language Models for Semantic Parsing

Qian Liu, Dejian Yang, Jiahui Zhang, Jiaqi Guo, Bin Zhou, Jian-Guang Lou

专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.AI

Comments Accepted by ACL 2021 Findings. The first three authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.11450 2021-09-23 cs.CV 79%

SAT: 2D Semantics Assisted Training for 3D Visual Grounding

Zhengyuan Yang, Songyang Zhang, Liwei Wang, Jiebo Luo

专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.CV

Comments ICCV 2021 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2101.09028 2021-09-23 cs.CV 79%

A Closer Look at Temporal Sentence Grounding in Videos: Dataset and Metric

Yitian Yuan, Xiaohan Lan, Xin Wang, Long Chen, Zhi Wang, Wenwu Zhu

专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.08634 2021-09-20 cs.CL cs.AI 79%

Grounding Natural Language Instructions: Can Large Language Models Capture Spatial Information?

Julia Rozanova, Deborah Ferreira, Krishna Dubba, Weiwei Cheng, Dell Zhang, Andre Freitas

专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.AI

Comments *Equal contribution

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.08478 2021-09-20 cs.CL cs.CV cs.MM 79%

Multimodal Incremental Transformer with Visual Grounding for Visual Dialogue Generation

Feilong Chen, Fandong Meng, Xiuyi Chen, Peng Li, Jie Zhou

专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.CV

Comments ACL Fingdings 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.06400 2021-09-15 cs.CV cs.CL 79%

Progressively Guide to Attend: An Iterative Alignment Framework for Temporal Sentence Grounding

Daizong Liu, Xiaoye Qu, Pan Zhou

专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.CV

Comments Accepted as a long paper in the main conference of EMNLP 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.04988 2021-09-13 cs.CV 79%

Panoptic Narrative Grounding

C. González, N. Ayobi, I. Hernández, J. Hernández, J. Pont-Tuset, P. Arbeláez

专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.CV

Comments 10 pages, 6 figures, to appear at ICCV 2021 (Oral presentation)

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.10576 2021-08-25 cs.CV 79%

Support-Set Based Cross-Supervision for Video Grounding

Xinpeng Ding, Nannan Wang, Shiwei Zhang, De Cheng, Xiaomeng Li, Ziyuan Huang, Mingqian Tang, Xinbo Gao

专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.CV

Comments Accepted by ICCV 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.10132 2021-08-17 cs.CV cs.CL 79%

VLG-Net: Video-Language Graph Matching Network for Video Grounding

Mattia Soldan, Mengmeng Xu, Sisi Qu, Jesper Tegner, Bernard Ghanem

专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.CV

Comments 14 pages, 7 figures, In proceeding of the ICCV21 workshop: AI for Creative Video Editing and Understanding 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.05675 2021-08-13 cs.CV 79%

Learning Visual Affordance Grounding from Demonstration Videos

Hongchen Luo, Wei Zhai, Jing Zhang, Yang Cao, Dacheng Tao

专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.01128 2021-07-30 cs.CV 79%

InstanceRefer: Cooperative Holistic Understanding for Visual Grounding on Point Clouds through Instance Multi-level Contextual Referring

Zhihao Yuan, Xu Yan, Yinghong Liao, Ruimao Zhang, Sheng Wang, Zhen Li, Shuguang Cui

专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.CV

Comments To appear in ICCV 2021. Codes are released in https://github.com/CurryYuan/InstanceRefer

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.11013 2021-07-08 cs.CV cs.CL 79%

Interventional Video Grounding with Dual Contrastive Learning

Guoshun Nan, Rui Qiao, Yao Xiao, Jun Liu, Sicong Leng, Hao Zhang, Wei Lu

专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.CV

Comments Accepted in CVPR 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.16136 2021-07-01 cs.CV 79%

Weakly Supervised Temporal Adjacent Network for Language Grounding

Yuechen Wang, Jiajun Deng, Wengang Zhou, Houqiang Li

专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.CV

Comments Accepted by IEEE Transactions on Multimedia, 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.04053 2021-06-09 cs.CV cs.MM 79%

Discriminative Triad Matching and Reconstruction for Weakly Referring Expression Grounding

Mingjie Sun, Jimin Xiao, Eng Gee Lim, Si Liu, John Y. Goulermas

专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.CV

Comments TPAMI

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.09829 2021-04-21 cs.CV 79%

Detector-Free Weakly Supervised Grounding by Separation

Assaf Arbelle, Sivan Doveh, Amit Alfassy, Joseph Shtok, Guy Lev, Eli Schwartz, Hilde Kuehne, Hila Barak Levi, Prasanna Sattigeri, Rameswar Panda, Chun-Fu Chen, Alex Bronstein, Kate Saenko, Shimon Ullman, Raja Giryes, Rogerio Feris, Leonid Karlinsky

专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.07679 2021-04-15 cs.CL cs.CV 79%

OCID-Ref: A 3D Robotic Dataset with Embodied Language for Clutter Scene Grounding

Ke-Jyun Wang, Yun-Hsuan Liu, Hung-Ting Su, Jen-Wei Wang, Yu-Siang Wang, Winston H. Hsu, Wen-Chin Chen

专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.CV

Comments NAACL 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.06008 2021-04-14 cs.CV cs.CL 79%

Disentangled Motif-aware Graph Learning for Phrase Grounding

Zongshen Mu, Siliang Tang, Jie Tan, Qiang Yu, Yueting Zhuang

专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.CV

Comments 10 pages, 6 figures, AAAI 2021 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.04386 2021-04-12 cs.CV 79%

Look Before You Leap: Learning Landmark Features for One-Stage Visual Grounding

Binbin Huang, Dongze Lian, Weixin Luo, Shenghua Gao

专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.CV

Comments Code is available at https://github.com/svip-lab/LBYLNet

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.02866 2021-04-08 cs.CV 79%

Deep Transformers for Fast Small Intestine Grounding in Capsule Endoscope Video

Xinkai Zhao, Chaowei Fang, Feng Gao, De-Jun Fan, Xutao Lin, Guanbin Li

专题命中 视觉定位与Grounding :grounding(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏