arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 3363 信号源:cs.CL, cs.AI, cs.LG

1. 视觉空间推理 3363 篇

2305.03602 2024-04-17 cs.CV cs.CL 57%

A Dual Semantic-Aware Recurrent Global-Adaptive Network For Vision-and-Language Navigation

Liuyi Wang, Zongtao He, Jiagui Tang, Ronghao Dang, Naijia Wang, Chengju Liu, Qijun Chen

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.CL

Comments Accepted by IJCAI 2023

Journal ref International Joint Conferences on Artificial Intelligence Organization 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.08855 2024-04-16 cs.RO cs.LG 57%

WROOM: An Autonomous Driving Approach for Off-Road Navigation

Dvij Kalaria, Shreya Sharma, Sarthak Bhagat, Haoru Xue, John M. Dolan

专题命中 视觉空间推理 :planning(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.04173 2024-04-08 cs.AR cs.LG 57%

H3DFact: Heterogeneous 3D Integrated CIM for Factorization with Holographic Perceptual Representations

Zishen Wan, Che-Kai Liu, Mohamed Ibrahim, Hanchen Yang, Samuel Spetalnick, Tushar Krishna, Arijit Raychowdhury

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.LG

Comments 2024 Design Automation and Test in Europe (DATE); The first two authors have equal contributions

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.02176 2024-04-04 cs.RO cs.AI 57%

Versatile Navigation under Partial Observability via Value-guided Diffusion Policy

Gengyu Zhang, Hao Tang, Yan Yan

专题命中 视觉空间推理 :planning(abstract);分类 cs.AI

Comments 13 pages, 7 figures, CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.19336 2024-03-29 cs.CV cs.AI 57%

IVLMap: Instance-Aware Visual Language Grounding for Consumer Robot Navigation

Jiacui Huang, Hongtao Zhang, Mingbo Zhao, Zhou Wu

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.09412 2024-03-29 cs.CV cs.AI cs.RO 57%

OpenGraph: Open-Vocabulary Hierarchical 3D Graph Representation in Large-Scale Outdoor Environments

Yinan Deng, Jiahui Wang, Jingyu Zhao, Xinyu Tian, Guangyan Chen, Yi Yang, Yufeng Yue

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.16081 2024-03-27 cs.CV cs.AI 57%

ViT-Lens: Towards Omni-modal Representations

Weixian Lei, Yixiao Ge, Kun Yi, Jianfeng Zhang, Difei Gao, Dylan Sun, Yuying Ge, Ying Shan, Mike Zheng Shou

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI

Comments This work is a follow-up of arXiv:2308.10185. Accepted to CVPR2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.10670 2024-03-26 cs.CL cs.RO 57%

OpenFMNav: Towards Open-Set Zero-Shot Object Navigation via Vision-Language Foundation Models

Yuxuan Kuang, Hai Lin, Meng Jiang

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.CL

Comments NAACL 2024 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.13666 2024-03-21 cs.CL 57%

Grounding Spatial Relations in Text-Only Language Models

Gorka Azkune, Ander Salaberria, Eneko Agirre

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.CL

Comments Accepted in Neural Networks

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08833 2024-03-15 cs.CV cs.AI 57%

TINA: Think, Interaction, and Action Framework for Zero-Shot Vision Language Navigation

Dingbang Li, Wenzhou Chen, Xin Lin

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.00389 2024-03-04 cs.AI 57%

Multimodality Representation Learning: A Survey on Evolution, Pretraining and Its Applications

Muhammad Arslan Manzoor, Sarah Albarri, Ziting Xian, Zaiqiao Meng, Preslav Nakov, Shangsong Liang

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.11574 2024-02-20 cs.CV cs.CL 57%

Visual In-Context Learning for Large Vision-Language Models

Yucheng Zhou, Xiang Li, Qianning Wang, Jianbing Shen

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.CL

Comments 13 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.09052 2024-02-15 cs.AI 57%

L3GO: Language Agents with Chain-of-3D-Thoughts for Generating Unconventional Objects

Yutaro Yamada, Khyathi Chandu, Yuchen Lin, Jack Hessel, Ilker Yildirim, Yejin Choi

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.09047 2024-02-15 cs.AI 57%

FGeo-TP: A Language Model-Enhanced Solver for Geometry Problems

Yiming He, Jia Zou, Xiaokai Zhang, Na Zhu, Tuo Leng

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.08284 2024-02-14 cs.AI 57%

A Logical Approach to Criminal Case Investigation

Takanori Ugai, Yusuke Koyanagi, Fumihito Nishino

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI

Comments 11 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.17914 2024-02-01 cs.RO cs.AI 57%

Attention Graph for Multi-Robot Social Navigation with Deep Reinforcement Learning

Erwan Escudie, Laetitia Matignon, Jacques Saraydaryan

专题命中 视觉空间推理 :planning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.14606 2023-12-25 cs.CV cs.LG 57%

Explainable Multi-Camera 3D Object Detection with Transformer-Based Saliency Maps

Till Beemelmanns, Wassim Zahr, Lutz Eckstein

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.11241 2023-12-25 cs.CV cs.LG cs.RO 57%

AutoNeRF: Training Implicit Scene Representations with Autonomous Agents

Pierre Marza, Laetitia Matignon, Olivier Simonin, Dhruv Batra, Christian Wolf, Devendra Singh Chaplot

专题命中 视觉空间推理 :planning(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.03275 2023-12-07 cs.RO cs.AI 57%

VLFM: Vision-Language Frontier Maps for Zero-Shot Semantic Navigation

Naoki Yokoyama, Sehoon Ha, Dhruv Batra, Jiuguang Wang, Bernadette Bucher

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.07562 2023-11-14 cs.CV cs.AI 57%

GPT-4V in Wonderland: Large Multimodal Models for Zero-Shot Smartphone GUI Navigation

An Yan, Zhengyuan Yang, Wanrong Zhu, Kevin Lin, Linjie Li, Jianfeng Wang, Jianwei Yang, Yiwu Zhong, Julian McAuley, Jianfeng Gao, Zicheng Liu, Lijuan Wang

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.01446 2023-11-03 cs.RO cs.CV cs.LG 57%

Adv3D: Generating Safety-Critical 3D Objects through Closed-Loop Simulation

Jay Sarva, Jingkang Wang, James Tu, Yuwen Xiong, Sivabalan Manivasagam, Raquel Urtasun

专题命中 视觉空间推理 :planning(abstract);分类 cs.LG

Comments CoRL 2023. Project page: https://waabi.ai/adv3d/

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.02260 2023-10-30 cs.CV cs.CL 57%

Learning to reason over visual objects

Shanka Subhra Mondal, Taylor Webb, Jonathan D. Cohen

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.CL

Comments ICLR 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.14478 2023-10-24 cs.CL 57%

GeoLM: Empowering Language Models for Geospatially Grounded Language Understanding

Zekun Li, Wenxuan Zhou, Yao-Yi Chiang, Muhao Chen

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.CL

Comments Accepted to EMNLP23 main

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.09755 2023-10-19 cs.CV cs.AI 57%

Beyond Segmentation: Road Network Generation with Multi-Modal LLMs

Sumedh Rasal, Sanjay Kumar Boddhu

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.07896 2023-10-13 cs.RO cs.CV cs.LG 57%

NoMaD: Goal Masked Diffusion Policies for Navigation and Exploration

Ajay Sridhar, Dhruv Shah, Catherine Glossop, Sergey Levine

专题命中 视觉空间推理 :planning(abstract);分类 cs.LG

Comments Project page https://general-navigation-models.github.io/nomad/

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.11319 2023-09-19 cs.RO cs.AI 57%

"Tidy Up the Table": Grounding Common-sense Objective for Tabletop Object Rearrangement

Yiqing Xu, David Hsu

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI

Comments RSSLRL2023 Workshop, Under review for conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.16493 2023-09-01 cs.AI cs.RO 57%

Expanding Frozen Vision-Language Models without Retraining: Towards Improved Robot Perception

Riley Tavassoli, Mani Amani, Reza Akhavian

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI

Comments Preprint submitted to Information Fusion

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.04589 2023-08-22 cs.CV cs.AI 57%

Temporal DINO: A Self-supervised Video Strategy to Enhance Action Prediction

Izzeddin Teeti, Rongali Sai Bhargav, Vivek Singh, Andrew Bradley, Biplab Banerjee, Fabio Cuzzolin

专题命中 视觉空间推理 :planning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.16487 2023-08-22 cs.CV cs.AI 57%

EgoHumans: An Egocentric 3D Multi-Human Benchmark

Rawal Khirodkar, Aayush Bansal, Lingni Ma, Richard Newcombe, Minh Vo, Kris Kitani

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI

Comments Accepted to ICCV 2023 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.02823 2023-08-08 cs.CV cs.AI 57%

A Symbolic Character-Aware Model for Solving Geometry Problems

Maizhen Ning, Qiu-Feng Wang, Kaizhu Huang, Xiaowei Huang

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI

Comments ACM MM 2023 Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏