arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 3363 信号源:cs.CL, cs.AI, cs.LG

1. 视觉空间推理 3363 篇

2211.06407 2023-07-14 cs.RO cs.AI cs.LG 62%

Control Transformer: Robot Navigation in Unknown Environments through PRM-Guided Return-Conditioned Sequence Modeling

Daniel Lawson, Ahmed H. Qureshi

专题命中 视觉空间推理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.13166 2023-07-07 cs.AI cs.CV cs.LG cs.RO 62%

ESC: Exploration with Soft Commonsense Constraints for Zero-shot Object Navigation

Kaiwen Zhou, Kaizhi Zheng, Connor Pryor, Yilin Shen, Hongxia Jin, Lise Getoor, Xin Eric Wang

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.14650 2023-06-29 cs.AI cs.CV cs.LG cs.SC 62%

PhD Thesis: Exploring the role of (self-)attention in cognitive and computer vision architecture

Mohit Vaishnav

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI、cs.LG

Comments PhD Thesis, 152 pages, 32 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.06799 2023-06-13 cs.RO cs.AI cs.LG 62%

On the Efficacy of 3D Point Cloud Reinforcement Learning

Zhan Ling, Yunchao Yao, Xuanlin Li, Hao Su

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.14548 2023-04-10 cs.CV cs.AI cs.LG cs.RO 62%

Viewpoint Equivariance for Multi-View 3D Object Detection

Dian Chen, Jie Li, Vitor Guizilini, Rares Ambrus, Adrien Gaidon

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI、cs.LG

Comments 11 pages, 4 figures; accepted to CVPR 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.14451 2023-03-01 cs.LG cs.AI 62%

Hierarchical Reinforcement Learning in Complex 3D Environments

Bernardo Avila Pires, Feryal Behbahani, Hubert Soyer, Kyriacos Nikiforou, Thomas Keck, Satinder Singh

专题命中 视觉空间推理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.14024 2022-12-08 cs.CV cs.AI cs.LG cs.RO 62%

Safety-Enhanced Autonomous Driving Using Interpretable Sensor Fusion Transformer

Hao Shao, Letian Wang, RuoBing Chen, Hongsheng Li, Yu Liu

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI、cs.LG

Comments Accepted at CoRL 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.11153 2022-11-22 cs.LG cs.CL cs.CV 62%

Unifying Vision-Language Representation Space with Single-tower Transformer

Jiho Jang, Chaerin Kong, Donghyeon Jeon, Seonhoon Kim, Nojun Kwak

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.CL、cs.LG

Comments AAAI 2023, 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
1712.05474 2022-08-29 cs.CV cs.AI cs.LG 62%

AI2-THOR: An Interactive 3D Environment for Visual AI

Eric Kolve, Roozbeh Mottaghi, Winson Han, Eli VanderBilt, Luca Weihs, Alvaro Herrasti, Matt Deitke, Kiana Ehsani, Daniel Gordon, Yuke Zhu, Aniruddha Kembhavi, Abhinav Gupta, Ali Farhadi

专题命中 视觉空间推理 :planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.12675 2022-06-28 cs.CV cs.AI cs.LG 62%

Learning to Infer 3D Shape Programs with Differentiable Renderer

Yichao Liang

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI、cs.LG

Comments Technical report written in 2020; 10 pages, 5 figures. arXiv admin note: substantial text overlap with arXiv:1901.02875 by other authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.03970 2022-06-13 cs.CV cs.AI cs.LG cs.RO 62%

Narrowing the Coordinate-frame Gap in Behavior Prediction Models: Distillation for Efficient and Accurate Scene-centric Motion Forecasting

DiJia Su, Bertrand Douillard, Rami Al-Rfou, Cheolho Park, Benjamin Sapp

专题命中 视觉空间推理 :planning(abstract);分类 cs.AI、cs.LG

Comments Accepted at ICRA 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.05713 2022-06-03 cs.RO cs.AI cs.CV cs.LG 62%

Towards real-world navigation with deep differentiable planners

Shu Ishida, João F. Henriques

专题命中 视觉空间推理 :planning(abstract);分类 cs.AI、cs.LG

Comments Published in CVPR 2022 (Conference on Computer Vision and Pattern Recognition)

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.08656 2022-05-06 cs.CL cs.AI 62%

DREAM: Improving Situational QA by First Elaborating the Situation

Yuling Gu, Bhavana Dalvi Mishra, Peter Clark

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments to be published in NAACL 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2103.16561 2022-05-05 cs.CV cs.AI cs.CL 62%

Diagnosing Vision-and-Language Navigation: What Really Matters

Wanrong Zhu, Yuankai Qi, Pradyumna Narayana, Kazoo Sone, Sugato Basu, Xin Eric Wang, Qi Wu, Miguel Eckstein, William Yang Wang

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments NAACL 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.06481 2022-04-29 cs.LG cs.AI 62%

A Survey on Machine Learning Approaches for Modelling Intuitive Physics

Jiafei Duan, Arijit Dasgupta, Jason Fischer, Cheston Tan

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI、cs.LG

Comments Paper accepted at IJCAI 2022 (Survey Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.13152 2022-03-30 cs.CV cs.AI cs.GR cs.LG cs.RO 62%

Scene Representation Transformer: Geometry-Free Novel View Synthesis Through Set-Latent Scene Representations

Mehdi S. M. Sajjadi, Henning Meyer, Etienne Pot, Urs Bergmann, Klaus Greff, Noha Radwan, Suhani Vora, Mario Lucic, Daniel Duckworth, Alexey Dosovitskiy, Jakob Uszkoreit, Thomas Funkhouser, Andrea Tagliasacchi

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI、cs.LG

Comments Accepted to CVPR 2022, Project website: https://srt-paper.github.io/

Journal ref CVPR 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.09277 2022-03-29 cs.CV cs.AI cs.LG 62%

(2.5+1)D Spatio-Temporal Scene Graphs for Video Question Answering

Anoop Cherian, Chiori Hori, Tim K. Marks, Jonathan Le Roux

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI、cs.LG

Comments Accepted at AAAI 2022 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.07050 2022-02-15 cs.AI cs.LG 62%

Combining Fast and Slow Thinking for Human-like and Efficient Navigation in Constrained Environments

Marianna B. Ganapini, Murray Campbell, Francesco Fabiano, Lior Horesh, Jon Lenchner, Andrea Loreggia, Nicholas Mattei, Taher Rahgooy, Francesca Rossi, Biplav Srivastava, Brent Venable

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI、cs.LG

Comments arXiv admin note: substantial text overlap with arXiv:2110.01834

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.01334 2022-02-04 cs.LG cs.AI 62%

Adaptive Discrete Communication Bottlenecks with Dynamic Vector Quantization

Dianbo Liu, Alex Lamb, Xu Ji, Pascal Notsawo, Mike Mozer, Yoshua Bengio, Kenji Kawaguchi

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2101.01169 2022-01-20 cs.CV cs.AI cs.LG 62%

Transformers in Vision: A Survey

Salman Khan, Muzammal Naseer, Munawar Hayat, Syed Waqas Zamir, Fahad Shahbaz Khan, Mubarak Shah

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI、cs.LG

Comments 30 pages (Accepted in ACM Computing Surveys December 2021)

详情

展开后加载摘要…

URL PDF HTML 收藏
2101.07385 2021-12-21 cond-mat.mtrl-sci cs.AI cs.LG cs.MA physics.comp-ph 62%

Autonomous synthesis of metastable materials

Sebastian Ament, Maximilian Amsler, Duncan R. Sutherland, Ming-Chiang Chang, Dan Guevarra, Aine B. Connolly, John M. Gregoire, Michael O. Thompson, Carla P. Gomes, R. Bruce van Dover

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI、cs.LG

Journal ref Autonomous materials synthesis via hierarchical active learning of nonequilibrium phase diagrams, Science Advances, Vol 7, Issue 5, 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.14039 2021-12-09 cs.LG cs.AI cs.NE 62%

Towards mental time travel: a hierarchical memory for reinforcement learning agents

Andrew Kyle Lampinen, Stephanie C. Y. Chan, Andrea Banino, Felix Hill

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI、cs.LG

Comments NeurIPS 2021; 10 pages main text; 29 pages total

Journal ref Advances in Neural Information Processing Systems, 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.08960 2021-11-18 cs.CV cs.AI cs.LG 62%

Compositional Transformers for Scene Generation

Drew A. Hudson, C. Lawrence Zitnick

专题命中 视觉空间推理 :planning(abstract);分类 cs.AI、cs.LG

Comments Published as a conference paper at NeurIPS 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
1812.08434 2021-10-07 cs.LG cs.AI stat.ML 62%

Graph Neural Networks: A Review of Methods and Applications

Jie Zhou, Ganqu Cui, Shengding Hu, Zhengyan Zhang, Cheng Yang, Zhiyuan Liu, Lifeng Wang, Changcheng Li, Maosong Sun

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI、cs.LG

Comments Published at AI Open 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.08634 2021-09-20 cs.CL cs.AI 62%

Grounding Natural Language Instructions: Can Large Language Models Capture Spatial Information?

Julia Rozanova, Deborah Ferreira, Krishna Dubba, Weiwei Cheng, Dell Zhang, Andre Freitas

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments *Equal contribution

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.09240 2021-07-21 cs.LG cs.CL cs.CV 62%

Generative Video Transformer: Can Objects be the Words?

Yi-Fu Wu, Jaesik Yoon, Sungjin Ahn

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.CL、cs.LG

Comments Published in ICML 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.04132 2021-07-12 cs.CL cs.AI 62%

A Systematic Survey of Text Worlds as Embodied Natural Language Environments

Peter A Jansen

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.03427 2021-06-08 cs.AI cs.CL 62%

Hierarchical Task Learning from Language Instructions with Unified Transformers and Self-Monitoring

Yichi Zhang, Joyce Chai

专题命中 视觉空间推理 :planning(abstract);分类 cs.CL、cs.AI

Comments Accepted by ACL 2021 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.11213 2021-04-23 cs.CV cs.AI cs.LG cs.RO 62%

ManipulaTHOR: A Framework for Visual Object Manipulation

Kiana Ehsani, Winson Han, Alvaro Herrasti, Eli VanderBilt, Luca Weihs, Eric Kolve, Aniruddha Kembhavi, Roozbeh Mottaghi

专题命中 视觉空间推理 :planning(abstract);分类 cs.AI、cs.LG

Comments CVPR 2021 -- (Oral presentation)

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.09224 2021-04-20 cs.CV cs.AI cs.LG cs.RO 62%

Multi-Modal Fusion Transformer for End-to-End Autonomous Driving

Aditya Prakash, Kashyap Chitta, Andreas Geiger

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.AI、cs.LG

Comments CVPR 2021

详情

展开后加载摘要…

URL PDF HTML 收藏