arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-03-09 至 2026-03-09 共收录 77 信号源:cs.CL, cs.AI, cs.LG

1. 数学推理 3 篇

2505.02387 2026-03-09 cs.CL cs.AI cs.LG 85%

RM-R1: Reward Modeling as Reasoning

RM-R1: 作为推理的奖励建模

Xiusi Chen, Gaotang Li, Ziqi Wang, Bowen Jin, Cheng Qian, Yu Wang, Hongru Wang, Yu Zhang, Denghui Zhang, Tong Zhang, Hanghang Tong, Heng Ji

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of California, San Diego(加州大学圣地亚哥分校) Texas A&M University(德克萨斯A&M大学) Stevens Institute of Technology(史蒂文斯理工学院)

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 RM-R1通过将奖励建模作为推理任务,提升模型的可解释性和性能,实验证明其在多个基准测试中表现优于现有模型。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06333 2026-03-09 cs.AI cs.CL cs.LG 67%

SAHOO: Safeguarded Alignment for High-Order Optimization Objectives in Recursive Self-Improvement

SAHOO:递归自我改进中高阶优化目标的安全保障

Subramanyam Sahoo, Aman Chadha, Vinija Jain, Divya Chaudhary

机构 * MARS 4.0 Fellowship, Cambridge AI Safety Hub(CAISH), University of Cambridge(剑桥大学) AWS Generative AI Innovation Center, Amazon Web Services, USA(亚马逊网络服务) Google, USA(谷歌) Stanford University(斯坦福大学) Northeastern University, Seattle, WA, USA(东北大学)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 SAHOO通过三种保障措施实现递归自我改进中高阶优化目标的安全保障,显著提升代码生成和推理质量,同时保持约束和事实性。

Comments Published at ICLR 2026 Workshop on AI with Recursive Self-Improvement. 20 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10177 2026-03-09 cs.LG cs.AI cs.CL cs.CY 67%

Towards Autonomous Mathematics Research

迈向自主数学研究

Tony Feng, Trieu H. Trinh, Garrett Bingham, Dawsen Hwang, Yuri Chervonyi, Junehyuk Jung, Joonkyung Lee, Carlo Pagano, Sang-hyun Kim, Federico Pasqualotto, Sergei Gukov, Jonathan N. Lee, Junsu Kim, Kaiying Hou, Golnaz Ghiasi, Yi Tay, YaGuang Li, Chenkai Kuang, Yuan Liu, Hanzhao Lin, Evan Zheran Liu, Nigamaa Nayakanti, Xiaomeng Yang, Heng-Tze Cheng, Demis Hassabis, Koray Kavukcuoglu, Quoc V. Le, Thang Luong

机构 * UC Berkeley(伯克利大学) Brown University(布朗大学) Yonsei University(延世大学) Concordia University(Concordia 大学) Korea Institute for Advanced Study(韩国高级研究院) UC San Diego(圣地亚哥大学) Caltech(加州理工学院)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 Aletheia是一个能够自主生成、验证和修订数学解决方案的代理,展示了AI在数学研究中的应用,包括生成研究论文和解决开放问题。

Comments 42 pages, updated with summary of FirstProof results. Accompanied blog post https://deepmind.google/blog/accelerating-mathematical-and-scientific-discovery-with-gemini-deep-think/

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 代码与定理证明 1 篇

2512.05962 2026-03-09 cs.LG cs.AI 81%

Whatever Remains Must Be True: Filtering Drives Reasoning in LLMs, Shaping Diversity

Whatever Remains Must Be True: 过滤驱动LLM推理,塑造多样性

Germán Kruszewski, Pierre Erbacher, Jos Rozen, Marc Dymetman

机构 * NAVER Labs Europe(NAVER欧洲实验室)

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.AI、cs.LG

AI总结 本文通过过滤错误答案获得目标分布,利用α-散度族控制精度与多样性权衡,提升LLM在推理任务中的覆盖与精度表现。

Comments Published as an ICLR 2026 conference paper

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 逻辑推理 6 篇

2603.06222 2026-03-09 cs.CL 85%

SPOT: Span-level Pause-of-Thought for Efficient and Interpretable Latent Reasoning in Large Language Models

SPOT:基于跨度的思考暂停,用于大语言模型中高效且可解释的潜在推理

Yunlong Chu, Minglai Shao, Yuhang Liu, Bing Hao, Yumeng Lin, Jialu Wang, Ruijie Wang

机构 * School of New Media and Communication, Tianjin University(新媒体与传播学院,天津大学) School of Computer Science and Engineering, Beihang University(计算机科学与工程学院,北航大学)

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL

AI总结 SPOT通过压缩显式推理步骤为紧凑的潜在暂停token,提升大语言模型的推理效率和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06428 2026-03-09 cs.CL cs.AI 81%

Abductive Reasoning with Syllogistic Forms in Large Language Models

基于三段论形式的大型语言模型演绎推理

Hirohiko Abe, Risako Ando, Takanobu Morishita Kentaro Ozeki, Koji Mineshima, Mitsuhiro Okada

机构 * Keio University(Keio大学) The University of Tokyo(东京大学)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文研究大型语言模型在演绎推理中的准确性,通过转换三段论数据集探讨其偏见及改进方向,强调上下文推理的重要性。

Comments Published in Proceedings of the 3rd International Conference on Human and Artificial Rationalities (HAR 2024), LNCS 15504, pp. 3-17

Journal ref Lecture Notes in Computer Science, vol. 15504, pp. 3-17, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05728 2026-03-09 cs.LO cs.AI cs.SE 79%

LTLGuard: Formalizing LTL Specifications with Compact Language Models and Lightweight Symbolic Reasoning

LTLGuard:利用紧凑语言模型和轻量符号推理形式化LTL规范

Medina Andresel, Cristinel Mateis, Dejan Nickovic, Spyridon Kounoupidis, Panagiotis Katsaros, Stavros Tripakis

机构 * AIT Austrian Institute of Technology(奥地利技术研究所) Aristotle University of Thessaloniki(希腊塞萨洛尼基亚里士多德大学) Northeatern University(东北大学)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 LTLGuard通过结合紧凑语言模型与轻量符号推理,有效生成无冲突的LTL规范,提升形式化验证的效率和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00276 2026-03-09 cs.AI 70%

Localizing and Correcting Errors for LLM-based Planners

基于 LLM 的规划器的定位与错误修正

Aditya Kumar, William W. Cohen

机构 * Language Technologies Institute, Carnegie Mellon University, Pittsburgh, US(语言技术研究所,卡内基梅隆大学,匹兹堡,美国) Machine Learning Department, Carnegie Mellon University, Pittsburgh, USA(机器学习系,卡内基梅隆大学,匹兹堡,美国)

专题命中 逻辑推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 本研究提出 L-ICL 方法,通过局部上下文学习修正 LLM 规划器的错误,显著提升规划任务的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06290 2026-03-09 cs.AI cs.CL 62%

The EpisTwin: A Knowledge Graph-Grounded Neuro-Symbolic Architecture for Personal AI

EpisTwin:一种基于知识图谱的神经符号架构用于个人AI

Giovanni Servedio, Potito Aghilar, Alessio Mattiace, Gianni Carmosino, Francesco Musicco, Gabriele Conte, Vito Walter Anelli, Tommaso Di Noia, Francesco Maria Donini

机构 * Politecnico di Bari(巴里理工大学) Università degli Studi della Tuscia(图斯卡大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 EpisTwin通过构建个人知识图谱,结合多模态语言模型和代理协调器,实现对用户数据的语义理解和复杂推理,提升个人AI的可信度和整体认知能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06403 2026-03-09 cs.LG 57%

Adapter-Augmented Bandits for Online Multi-Constrained Multi-Modal Inference Scheduling

适配器增强的带状机用于在线多约束多模态推断调度

Xianzhi Zhang, Yue Xu, Yinlin Zhu, Di Wu, Yipeng Zhou, Miao Hu, Guocong Quan

机构 * School of Computer Science and Engineering, Sun Yat-sen University, Guangzhou, 510006, China.(中山大学计算机科学与工程学院) School of Computing, Macquarie University, NSW 2109, Australia(麦考瑞大学计算机学院)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.LG

AI总结 M-CMAB通过多适配器增强框架,实现多模态任务调度中的多约束优化,提升推断效率和预算利用效率。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 规划推理 14 篇

2603.05818 2026-03-09 cs.CL 87%

RouteGoT: Node-Adaptive Routing for Cost-Efficient Graph of Thoughts Reasoning

RouteGoT: 用于图状思维推理的节点自适应路由

Yuhang Liu, Ruijie Wang, Yunlong Chu, Bing Hao, Yumeng Lin, Shengzhong Liu, Minglai Shao

机构 * School of New Media and Communication, Tianjin University(新媒体与传播学院,天津大学) School of Computer Science and Engineering, Beihang University(计算机科学与工程学院,北航) Shanghai Jiao Tong University(上海交通大学)

专题命中 规划推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);planning(abstract)

AI总结 RouteGoT通过节点自适应路由框架提升图状思维推理的效率与准确性,实现性能与成本的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.24142 2026-03-09 cs.CL cs.AI 86%

CoME: Empowering Channel-of-Mobile-Experts with Informative Hybrid-Capabilities Reasoning

CoME:赋能移动专家的 informative hybrid-capabilities 推理

Yuxuan Liu, Weikai Xu, Kun Huang, Changyu Chen, Jiankun Zhao, Pengzhi Gao, Wei Liu, Jian Luan, Shuo Shang, Bo Du, Ji-Rong Wen, Rui Yan

机构 * ruc(中国人民大学人工智能学院) xiaomi(小米公司) ntu(南洋理工大学) whu(武汉大学)

专题命中 规划推理 :reasoning(title,abstract);CoT(abstract);planning(abstract);分类 cs.CL、cs.AI

AI总结 CoME 通过四种专家架构和渐进训练策略,实现移动代理混合能力推理的解耦增强与平衡优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03704 2026-03-09 cs.RO cs.AI 83%

Large-Language-Model-Guided State Estimation for Partially Observable Task and Motion Planning

基于大语言模型的态估计用于部分可观测任务和运动规划

Yoonwoo Kim, Raghav Arora, Roberto Martín-Martín, Peter Stone, Ben Abbatematteo, Yoonchang Sung

机构 * The University of Texas at Austin(德克萨斯大学) Nanyang Technological University(南洋理工大学)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract);分类 cs.AI

AI总结 本文提出CoCo-TAMP框架,利用大语言模型的常识推理能力,通过分层态估计提升部分可观测任务和运动规划的效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06338 2026-03-09 eess.IV cs.AI cs.LG cs.SY eess.SY physics.med-ph 81%

AI End-to-End Radiation Treatment Planning Under One Second

AI端到端放射治疗计划在1秒内完成

Simon Arberet, Riqiang Gao, Martin Kraus, Florin C. Ghesu, Wilko Verbakel, Mamadou Diallo, Anthony Magliari, Venkatesan Karuppusamy, Sushil Beriwal, REQUITE Consortium, Ali Kamen, Dorin Comaniciu

机构 * Digital Technology and Innovation(数字技术与创新) Siemens Healthineers(西门子医疗) Varian Medical Affairs(Varian医疗事务)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种端到端深度学习框架AIRT,可在1秒内生成高质量的放射治疗计划,实现了超快速且标准化的治疗计划制定。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06064 2026-03-09 cs.AI 79%

Agentic LLM Planning via Step-Wise PDDL Simulation: An Empirical Characterisation

通过分步PDDL模拟实现代理LLM规划:一项实证分析

Kai Göbel, Pierrick Lorang, Patrik Zips, Tobias Glück

机构 * AIT Austrian Institute of Technology GmbH(奥地利技术研究院)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 本文通过PyPDDLEngine实验证明代理LLM在任务规划中相比传统方法具有小幅优势,但效果受环境反馈类型影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00814 2026-03-09 cs.RO cs.LG cs.SY eess.SY 79%

Real-Time Learning of Predictive Dynamic Obstacle Models for Robotic Motion Planning

实时学习预测性动态障碍物模型用于机器人运动规划

Stella Kombo, Masih Haseli, Skylar X. Wei, Joel W. Burdick

机构 * Division of Engineering and Applied Science, California Institute of Technology(工程与应用科学分校,加州理工学院) Applied Intuition(应用直觉)

专题命中 规划推理 :planning(title,abstract);分类 cs.LG

AI总结 本文提出一种实时学习动态障碍物预测模型的方法,通过改进的Hankel-DMD实现去噪和多步预测,适用于机器人运动规划。

Comments 10 pages, 6 figures, submitted to IEEE International Conference on Robotics and Automation (ICRA) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06190 2026-03-09 cs.RO 78%

DreamToNav: Generalizable Navigation for Robots via Generative Video Planning

DreamToNav: 通过生成式视频规划实现通用机器人导航

Valerii Serpiva, Jeffrin Sam, Chidera Simon, Hajira Amjad, Iana Zhura, Artem Lykov, Dzmitry Tsetserukou

机构 * Intelligent Space Robotics Laboratory, Skolkovo Institute of Science and Technology(智能空间机器人实验室,斯克尔科夫科学与技术研究所)

专题命中 规划推理 :planning(title,abstract)

AI总结 DreamToNav通过生成式视频规划实现通用机器人导航,利用自然语言提示生成精确运动路径,实现目标导向的自主导航。

Comments Submitted to conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06084 2026-03-09 cs.RO 78%

Multimodal Behavior Tree Generation: A Small Vision-Language Model for Robot Task Planning

多模态行为树生成:一种小型视觉-语言模型用于机器人任务规划

Cristiano Battistini, Riccardo Andrea Izzo, Gianluca Bardaro, Matteo Matteucci

机构 * Department of Electronics, Information, and Bioengineering, Politecnico di Milano(电子信息与生物工程系,米兰理工学院)

专题命中 规划推理 :planning(title,abstract)

AI总结 本文提出一种小型视觉-语言模型,通过生成行为树提升机器人任务规划效率,实验证明其在性能和资源消耗上均优于现有闭源模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05831 2026-03-09 cs.DC 78%

Knowledge-driven Reasoning for Mobile Agentic AI: Concepts, Approaches, and Directions

基于知识的移动代理AI推理:概念、方法与方向

Guangyuan Liu, Changyuan Zhao, Yinqiu Liu, Dusit Niyato, Biplab Sikdar

专题命中 规划推理 :reasoning(title,abstract)

AI总结 基于知识的移动代理AI推理通过提取可重用决策结构,同步并注入设备端推理以降低延迟、能耗和误差积累,提出DIKW分类法区分不同知识表示形式,并验证了知识暴露的非单调性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05697 2026-03-09 cs.CV 78%

MultiHaystack: Benchmarking Multimodal Retrieval and Reasoning over 40K Images, Videos, and Documents

MultiHaystack:用于40,000张图像、视频和文档的多模态检索和推理的基准测试

Dannong Xu, Zhongyu Yang, Jun Chen, Yingfang Yuan, Ming Hu, Lei Sun, Luc Van Gool, Danda Pani Paudel, Chun-Mei Feng

机构 * INSAIT Lanzhou University(兰州大学) King Abdullah University of Science and Technology(国王阿卜杜勒-阿齐兹科学与技术大学) Heriot-Watt University(赫瑞-沃德大学) Monash University(莫纳什大学) University College Dublin(都柏林大学学院)

专题命中 规划推理 :reasoning(title,abstract)

AI总结 MultiHaystack是首个评估大规模异构多模态检索与推理的基准测试,揭示了MLLMs在异构语料库中检索证据时的性能瓶颈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05270 2026-03-09 cs.RO cs.AI cs.HC cs.MA cs.SY eess.SY 74%

XR-DT: Extended Reality-Enhanced Digital Twin for Safe Motion Planning via Human-Aware Model Predictive Path Integral Control

XR-DT:增强现实增强型数字孪生用于通过人感知模型预测路径积分控制的安全运动规划

Tianyi Wang, Jiseop Byeon, Ahmad Yehia, Yiming Xu, Jihyung Park, Tianyi Zeng, Sikai Chen, Ziran Wang, Junfeng Jiao, Christian Claudel

机构 * Department of Civil, Architectural, and Environmental Engineering, The University of Texas at Austin(德克萨斯大学奥斯汀分校土木、建筑与环境工程系) School of Architecture, The University of Texas at Austin(德克萨斯大学奥斯汀分校建筑学院) School of Civil and Construction Engineering, Purdue University(普渡大学土木与建设工程学院) Department of Civil and Environmental Engineering, University of Wisconsin-Madison(威斯康星大学麦迪逊分校土木与环境工程系)

专题命中 规划推理 :planning(title);分类 cs.AI

AI总结 XR-DT通过结合增强现实与数字孪生技术,提出HA-MPPI控制模型,实现基于人类行为预测的安全高效人机交互。

Comments 8 pages, 6 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17938 2026-03-09 cs.CL cs.LG 73%

SPINE: Token-Selective Test-Time Reinforcement Learning with Entropy-Band Regularization

SPINE:基于熵带正则化的令牌选择性测试时间强化学习

Jianghao Wu, Yasmeen George, Jin Ye, Yicheng Wu, Daniel F. Schmidt, Jianfei Cai

机构 * Monash University(墨尔本大学) Imperial College London(伦敦帝国理工学院)

专题命中 规划推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.LG

AI总结 SPINE通过令牌选择性和熵带正则化提升测试时间推理稳定性与效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14063 2026-03-09 cs.RO 67%

Language Conditioning Improves Accuracy of Aircraft Goal Prediction in Non-Towered Airspace

语言引导提升非塔台空域飞机目标预测的准确性

Sundhar Vinodh Sangeetha, Chih-Yuan Chiu, Sarah H. Q. Li, Shreyas Kousik

机构 * Georgia Institute of Technology(佐治亚理工学院) School of Aerospace Engineering(航空航天工程学院) School of Electrical and Computer Engineering(电气与计算机工程学院) School of Mechanical Engineering(机械工程学院)

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 本文提出利用语言信息提升非塔台空域飞机目标预测准确性的多模态框架,通过整合自然语言理解和空间推理,有效提高自主决策能力。

Comments The last two authors advised equally. Accepted to the 2026 IEEE International Conference on Robotics and Automation. 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23405 2026-03-09 cs.LG 57%

Planner Aware Path Learning in Diffusion Language Models Training

扩散语言模型训练中的规划感知路径学习

Fred Zhangzhi Peng, Zachary Bezemek, Jarrid Rector-Brooks, Shuibai Zhang, Anru R. Zhang, Michael Bronstein, Alexander Tong, Avishek Joey Bose

机构 * Duke University(杜克大学) Mila Université de Montréal(蒙特利尔大学) California Institute of Technology(加州理工学院) University of Wisconsin–Madison(威斯康星大学麦迪逊分校) University of Oxford(牛津大学) AITHYRA Imperial College London(伦敦帝国学院)

专题命中 规划推理 :planning(abstract);分类 cs.LG

AI总结 本文提出PAPL,一种通过规划感知路径学习提升扩散语言模型训练与推理一致性的方法,实现跨领域性能提升。

Comments Camera ready version for ICLR2026

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 视觉空间推理 6 篇

2603.06024 2026-03-09 cs.CL cs.CV 79%

ViewFusion: Structured Spatial Thinking Chains for Multi-View Reasoning

ViewFusion:多视角推理的结构化空间思维链

Xingjian Tao, Yiwei Wang, Yujun Cai, Yifan Song, Jing Tang

专题命中 视觉空间推理 :reasoning(title,abstract);分类 cs.CL

AI总结 ViewFusion通过两阶段框架提升多视角推理准确率,通过空间预对齐与问题驱动推理结合,有效提升复杂场景下的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05591 2026-03-09 cs.CV 71%

Thinking with Spatial Code for Physical-World Video Reasoning

基于空间代码的物理世界视频推理

Jieneng Chen, Wenxin Ma, Ruisheng Yuan, Yunzhi Zhang, Jiajun Wu, Alan Yuille

专题命中 视觉空间推理 :reasoning(title)

AI总结 基于空间代码的物理世界视频推理方法,通过空间编码器生成3D表示并提升大语言模型的推理能力。

Comments Code at https://github.com/Beckschen/spatialcode

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06073 2026-03-09 cs.RO cs.AI 70%

Lifelong Embodied Navigation Learning

持续性具身导航学习

Xudong Wang, Jiahua Dong, Baichen Liu, Qi Lyu, Lianqing Liu, Zhi Han

机构 * State Key Laboratory of Robotics and Intelligent Systems(机器人与智能系统国家重点实验室) Shenyang Institute of Automation(沈阳自动化研究所) Chinese Academy of Sciences(中国科学院) University of Chinese Academy of Sciences(中国科学院大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 视觉空间推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.AI

AI总结 Uni-Walker通过分解导航知识为共享和特定组件,解决持续性具身导航学习中的灾难性遗忘问题,提升导航代理的持续学习能力。

Comments 24 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06090 2026-03-09 cs.CV cs.CL 57%

DeepSight: Bridging Depth Maps and Language with a Depth-Driven Multimodal Model

DeepSight: 通过深度驱动的多模态模型连接深度图与语言

Hao Yang, Hongbo Zhang, Yanyan Zhao, Bing Qin

机构 * Harbin Institute of Technology(哈尔滨工业大学)

专题命中 视觉空间推理 :reasoning(abstract);分类 cs.CL

AI总结 DeepSight通过深度驱动的多模态模型提升三维场景理解,利用深度图像特性增强空间推理能力,并通过新数据集和模型改进实现了深度感知和任务性能的显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13386 2026-03-09 cs.RO cs.LG 57%

VEGA: Electric Vehicle Navigation Agent via Physics-Informed Neural Operator and Proximal Policy Optimization

VEGA:基于物理信息神经算子和近端策略优化的电动汽车导航代理

Hansol Lim, Minhyeok Im, Jonathan Boyack, Jee Won Lee, Jongseong Brad Choi

机构 * Department of Mechanical Engineering, State University of New York(机械工程系,纽约州立大学) Department of Computer Science, State University of New York(计算机科学系,纽约州立大学)

专题命中 视觉空间推理 :planning(abstract);分类 cs.LG

AI总结 VEGA通过结合物理信息神经算子和近端策略优化,为电动汽车提供高效的能耗感知导航方案,实现快速路径规划和充电站点选择。

Comments This work has been submitted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16538 2026-03-09 cs.CV 50%

OnlineSI: Taming Large Language Model for Online 3D Understanding and Grounding

OnlineSI: 通过大规模语言模型实现在线3D理解和定位

Zixian Liu, Zhaoxi Chen, Liang Pan, Ziwei Liu

机构 * Tsinghua University(清华大学) Nanyang Technological University(南洋理工大学) Shanghai AI Lab(上海人工智能实验室)

专题命中 视觉空间推理 :reasoning(abstract)

AI总结 OnlineSI通过整合3D点云与语义信息,提升大规模语言模型在动态环境中的空间理解和物体识别能力。

Comments Project Page: https://onlinesi.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏