arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-03-24 至 2026-03-24 共收录 32 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 32 篇

2603.20664 2026-03-24 cs.RO 83%

E-SocialNav: Efficient Socially Compliant Navigation with Language Models

E-SocialNav: 基于语言模型的高效社交合规导航

Ling Xiao, Daeun Song, Xuesu Xiao, Toshihiko Yamasaki

机构 * Hokkaido University(北海道大学) George Mason University(乔治·马歇尔大学) The University of Tokyo(东京大学)

专题命中 具身导航 :navigation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出E-SocialNav,通过两阶段训练流程实现高效社交合规导航,验证了GPT-4o和Claude在机器人导航中的社交合规性,并在文本语义和动作准确性上优于零样本基线。

Comments Accepted by 2026 IEEE International Conference on Acoustics, Speech, and Signal Processing, to appear. Preprint version

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20804 2026-03-24 cs.CV cs.RO 81%

Does Peer Observation Help? Vision-Sharing Collaboration for Vision-Language Navigation

同伴观察有助于吗?面向视觉语言导航的视觉共享协作

Qunchao Jin, Yiliao Song, Qi Wu

机构 * Australian Institute for Machine Learning(澳大利亚机器学习研究所) Adelaide University(阿德莱德大学) Responsible AI Research Centre(负责任人工智能研究中心)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 本文提出Co-VLN框架,研究同伴观察对视觉语言导航的影响,通过共享感知记忆扩展接收场,验证了在R2R基准下两种方法中性能的显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08935 2026-03-24 cs.RO cs.CV 81%

Expand Your SCOPE: Semantic Cognition over Potential-Based Exploration for Embodied Visual Navigation

拓展你的SCOPE:基于潜在探索的语义认知用于具身视觉导航

Ningnan Wang, Weihuang Chen, Liming Chen, Haoxuan Ji, Zhongyu Guo, Xuchong Zhang, Hongbin Sun

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 本文提出SCOPE框架,通过利用前沿信息驱动潜在探索,提升具身视觉导航中的决策质量与目标相关性,实验表明其在准确性和泛化能力上优于现有方法。

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20353 2026-03-24 cs.CV cs.RO eess.IV eess.SP 81%

Scene Representation using 360° Saliency Graph and its Application in Vision-based Indoor Navigation

基于360°显著性图的场景表示及其在基于视觉的室内导航中的应用

Preeti Meena, Himanshu Kumar, Sandeep Yadav

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 本文提出一种360°显著性图表示方法,用于提升场景表示效率和室内导航性能,通过编码视觉、上下文、语义和几何信息,提高场景定位和导航准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08157 2026-03-24 cs.RO cs.AI cs.MA 81%

Risk-Bounded Multi-Agent Visual Navigation via Iterative Risk Allocation

基于迭代风险分配的有界多智能体视觉导航

Viraj Parimi, Brian C. Williams

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 本文提出风险有界多智能体路径规划框架,通过动态分配风险预算提升多智能体在高风险环境中的导航效率与安全性。

Comments Published at ICAPS '26

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22182 2026-03-24 cs.RO 79%

Cross-Modal Reinforcement Learning for Navigation with Degraded Depth Measurements

跨模态强化学习用于退化深度测量的导航

Omkar Sawant, Luca Zanatta, Grzegorz Malczyk, Kostas Alexis

机构 * Department of Engineering Cybernetics, Norwegian University of Science and Technology (NTNU)(工程 cybernetics 部,挪威科学技术大学(NTNU))

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出利用深度和灰度图像互补信息的跨模态学习框架,通过跨模态一致性学习共享潜在表示,实现深度退化下的鲁棒导航。

Comments Accepted to the 24th European Control Conference (ECC) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10154 2026-03-24 cs.RO 79%

CompassNav: Steering From Path Imitation To Decision Understanding In Navigation

CompassNav: 从路径模仿到决策理解的导航导航

LinFeng Li, Jian Zhao, Yuan Xie, Xin Tan, Xuelong Li

机构 * East China Normal University(东华师范大学) The Institute of Artificial Intelligence (TeleAI), China Telecom(人工智能研究所(TeleAI),中国电信) Northwestern Polytechnical University(西北工业大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出CompassNav方法,通过引入Compass-Data-22k数据集和gap-aware奖励函数,使导航代理能理解而非单纯模仿路径,实现更高效的导航性能。

Journal ref Proceedings of the 14th International Conference on Learning Representations (ICLR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21269 2026-03-24 cs.RO 79%

DyGeoVLN: Infusing Dynamic Geometry Foundation Model into Vision-Language Navigation

DyGeoVLN: 将动态几何基础模型注入视觉-语言导航

Xiangchen Liu, Hanghan Zheng, Jeil Jeong, Minsung Yoon, Lin Zhao, Zhide Zhong, Haoang Li, Sung-Eui Yoon

机构 * KAIST(韩国科学技术院) HKUST(GZ)(香港科技大学(广州)) JD Explore Academy(JD探索学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出DyGeoVLN框架,通过跨分支特征融合将动态几何基础模型注入视觉-语言导航,实现显式3D空间表示和视觉-语义推理,并引入新的无姿态自适应分辨率令牌剪枝策略以提升效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21142 2026-03-24 cs.RO 79%

Dynamic Control Barrier Function Regulation with Vision-Language Models for Safe, Adaptive, and Realtime Visual Navigation

动态控制屏障函数调节与视觉-语言模型用于安全、适应性和实时视觉导航

Jeffrey Chen, Rohan Chandra

机构 * Department of Computer Science, University of Virginia(弗吉尼亚大学计算机科学系)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出AlphaAdj框架,利用视觉-语言模型动态调整控制屏障函数参数,以实现在动态环境中安全、高效和实时的导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17340 2026-03-24 cs.RO cs.SY eess.SY 79%

AERO-MPPI: Anchor-Guided Ensemble Trajectory Optimization for Agile Mapless Drone Navigation

AERO-MPPI:基于锚点的轨迹优化用于无地图无人机敏捷导航

Xin Chen, Rui Huang, Longbin Tang, Lin Zhao

机构 * Department of Electrical and Computer Engineering, National University of Singapore(新加坡国立大学电子与计算机工程系)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出AERO-MPPI框架,通过GPU加速统一感知与规划,利用多分辨率LiDAR点云提取锚点,构建多项式轨迹引导,提升无人机在复杂环境中的敏捷导航能力。

Comments Accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01192 2026-03-24 cs.RO 79%

Unified Generation-Refinement Planning: Bridging Guided Flow Matching and Sampling-Based MPC for Social Navigation

统一的生成-细化规划:连接引导流匹配与基于模型的预测控制以实现社交导航

Kazuki Mizuta, Karen Leung

机构 * University of Washington(华盛顿大学) NVIDIA(英伟达)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出一种结合奖励引导条件流匹配与模型预测路径积分的统一生成-细化框架,以提升社交导航中安全、任务性能和计算时间的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20366 2026-03-24 cs.IR cs.AI 79%

WebNavigator: Global Web Navigation via Interaction Graph Retrieval

WebNavigator: 通过交互图检索实现全局网络导航

Xuanwang Zhang, Yuteng Han, Jinnan Qi, Mulong Xie, Zhen Wu, Xinyu Dai

机构 * National Key Laboratory for Novel Software Technology(新型软件技术国家重点实验室) School of Artificial Intelligence(人工智能学院) Fellou AI

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI

AI总结 WebNavigator通过交互图检索和路径规划解决自主网络导航中的拓扑盲区问题,实现优于企业级代理的性能。

Comments 24 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20351 2026-03-24 cs.CR cs.AI 79%

MANA: Towards Efficient Mobile Ad Detection via Multimodal Agentic UI Navigation

MANA:通过多模态代理UI导航实现高效的移动广告检测

Yizhe Zhao, Yongjian Fu, Zihao Feng, Hao Pan, Yongheng Deng, Yaoxue Zhang, Ju Ren

机构 * Department of Computer Science and Technology(计算机科学与技术系) University of Southern California(南加州大学) Shanghai Jiao Tong University(上海交通大学) State Key Laboratory of Internet Architecture(互联网架构国家重点实验室)

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI

AI总结 本文提出MANA框架,通过整合多种信号实现高效移动广告检测,提升准确率和效率,有效识别隐蔽恶意广告。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22170 2026-03-24 cs.MA 78%

Human-Inspired Pavlovian and Instrumental Learning for Autonomous Agent Navigation

受人类启发的经典条件反射与工具性学习用于自主体导航

Jingfeng Shan, Francesco Guidi, Mehrdad Saeidi, Enrico Testi, Elia Favarelli, Andrea Giorgetti, Davide Dardari, Alberto Zanella, Giorgio Li Pira, Francesca Starita, Anna Guerra

专题命中 具身导航 :navigation(title,abstract)

AI总结 本文提出一种融合经典条件反射、工具性MF和工具性MB组件的混合强化学习架构,通过地理参考环境特征塑造内在价值信号,提升自主体在不确定环境中的导航安全性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18754 2026-03-24 astro-ph.SR astro-ph.IM 78%

Variable Red Giants Exploration with MASTER Robotic Net: Main Algorithms and Study of Three Mira-type Targets

使用MASTER机器人网络探索变星红巨星:主要算法及三个Mira型目标的研究

Alexander N. Tarasenkov, Vladimir M. Lipunov, Artem S. Kuznetsov, Gleb A. Antipov, Pavel V. Balanutsa, Nataly V. Tyurina, Yakov Yu. Kechin

专题命中 具身导航 :robotic(title,abstract)

AI总结 本文探讨MASTER机器人望远镜网络研究变红巨星的能力,报告了三个与长周期变红巨星相关的光学暂现源的发现及历史光变曲线,通过光谱验证确认了其中一颗碳星的平均亮度增长但恒定脉动周期,推测可能存在长周期二次星。

Comments 27 pages, 5 figures. Accepted for publication in Astrophysics and Space Science

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20679 2026-03-24 cs.RO 77%

Enhancing Vision-Based Policies with Omni-View and Cross-Modality Knowledge Distillation for Mobile Robots

通过多视角与跨模态知识蒸馏增强基于视觉的策略用于移动机器人

Kai Li, Shiyu Zhao

机构 * College of Computer Science and Technology at Zhejiang University(浙江大学计算机科学与技术学院) School of Engineering at Westlake University(西湖大学工程学院)

专题命中 具身导航 :robotics(abstract);manipulation(abstract);navigation(abstract);分类 cs.RO

AI总结 本文提出通过多视角和跨模态知识蒸馏提升移动机器人基于视觉的策略,解决场景迁移性差、计算资源有限和传感器成本高等问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21523 2026-03-24 cs.RO cs.AI 73%

SafePilot: A Framework for Assuring LLM-enabled Cyber-Physical Systems

SafePilot: 一种确保基于大语言模型的嵌入式物理系统框架

Weizhe Xu, Mengyu Liu, Fanxin Kong

机构 * University of Notre Dame(诺克斯维尔大学) Washington State University(华盛顿州立大学)

专题命中 具身导航 :robotics(abstract);navigation(abstract);分类 cs.RO、cs.AI

AI总结 本文提出SafePilot框架,通过层级神经符号方法确保基于大语言模型的嵌入式物理系统安全性,通过任务复杂度评估和分治策略,结合形式化验证提升任务规划可靠性。

Comments 12 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10744 2026-03-24 cs.AI cs.CV 73%

Explore with Long-term Memory: A Benchmark and Multimodal LLM-based Reinforcement Learning Framework for Embodied Exploration

探索与长期记忆:一个基准和基于多模态LLM的强化学习框架用于具身探索

Sen Wang, Bangwei Liu, Zhenkun Gao, Lizhuang Ma, Xuhong Wang, Yuan Xie, Xin Tan

机构 * East China Normal University(东华大学) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 具身导航 :embodied agent(abstract);navigation(abstract);分类 cs.AI、cs.CV

AI总结 本文提出LMEE框架,通过多模态LLM强化学习促进终身学习,构建LMEE-Bench基准评估具身探索过程与结果,采用MemoryExplorer方法提升记忆检索与主动探索能力。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10878 2026-03-24 cs.RO 70%

RL-Augmented MPC for Non-Gaited Legged and Hybrid Locomotion

强化学习增强的MPC用于非步态腿部和混合运动

Andrea Patrizi, Carlo Rizzardo, Arturo Laurenzi, Francesco Ruscelli, Luca Rossini, Nikos G. Tsagarakis

机构 * Humanoids and Human-Centred Mechatronics (HHCM) lab, Istituto Italiano di Tecnologia (IIT)(人机协同机电一体化实验室,意大利技术研究院)

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出一种结合强化学习和模型预测控制的分层架构,通过模拟中学习无环步态实现接触时间的卸载,验证了在不同机器人平台上的有效性及非平坦地形的扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13733 2026-03-24 cs.RO cs.AI cs.LG 69%

Implicit Maximum Likelihood Estimation for Real-time Generative Model Predictive Control

隐式最大似然估计用于实时生成模型预测控制

Grayson Lee, Minh Bui, Shuzi Zhou, Yankai Li, Mo Chen, Ke Li

机构 * School of Computing Science, Simon Fraser University(计算科学系,西蒙弗雷泽大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI、cs.LG;robotics(comments)

AI总结 本文提出隐式最大似然估计(IMLE)作为生成模型的替代方法,实现快速推理和强模式覆盖,适用于实时MPC任务。

Comments Accepted to IEEE International Conference on Robotics and Automation (ICRA) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21987 2026-03-24 cs.CV cs.AI 62%

LRC-WeatherNet: LiDAR, RADAR, and Camera Fusion Network for Real-time Weather-type Classification in Autonomous Driving

LRC-WeatherNet:用于自动驾驶中实时天气类型分类的激光雷达、雷达和摄像头融合网络

Nour Alhuda Albashir, Lars Pernickel, Danial Hamoud, Idriss Gouigah, Eren Erdal Aksoy

机构 * Halmstad University, School of Information Technology, Center for Applied Intelligent Systems Research(哈姆斯塔德大学,信息科技学院,应用智能系统研究中心)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.CV

AI总结 本文提出LRC-WeatherNet,通过融合激光雷达、雷达和摄像头数据,实现在恶劣天气下的实时天气分类,优于单一传感器基线,且在MSU-4S数据集上表现优异。

Comments Accepted for publication at IEEE Intelligent Vehicles Symposium - IVS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21565 2026-03-24 cs.CV cs.AI 62%

Rethinking SAR ATR: A Target-Aware Frequency-Spatial Enhancement Framework with Noise-Resilient Knowledge Guidance

重新思考SAR ATR:一种具有噪声鲁棒知识引导的靶向频率-空间增强框架

Yansong Lin, Zihan Cheng, Jielei Wang, Guoming Lua, Zongyong Cui

机构 * the Institute of Intelligent Computing, University of Electronic Science and Technology of China (UESTC)(智能计算研究院,电子科技大学) Ubiquitous Intelligence and Trusted Services Key Laboratory of Sichuan Province(四川省 ubiquitous 智能与可信服务重点实验室) the School of Information and Communication Engineering, University of Electronic Science and Technology of China (UESTC)(信息与通信工程学院,电子科技大学)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.CV

AI总结 本文提出FSCE框架,通过频率-空间浅特征自适应增强模块和教师-学生学习范式提升SAR目标识别的鲁棒性,实验表明DSAFNet-L在多个数据集上表现优异,DSAFNet-M在保持精度的同时降低模型复杂度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21774 2026-03-24 cs.RO 61%

Memory-Efficient Boundary Map for Large-Scale Occupancy Grid Mapping

高效内存边界图用于大规模占用网格映射

Benxu Tang, Yunfan Ren, Yixi Cai, Fanze Kong, Wenyi Liu, Fangcheng Zhu, Longji Yin, Liuyu Shi, Fu Zhang

机构 * Mechatronics and Robotic Systems (MaRS) Laboratory, Department of Mechanical Engineering, The University of Hong Kong, Hong Kong SAR, China(机械电子与机器人系统实验室,机械工程系,香港大学,香港特别行政区,中国) Department of Robotics, Perception, and Learning, KTH Royal Institute of Technology, Stockholm, Sweden(机器人、感知与学习系,皇家理工学院,斯德哥尔摩,瑞典)

专题命中 具身导航 :robotic(abstract);分类 cs.RO;robotics(journal_ref)

AI总结 本文提出一种高效内存边界图方法,通过仅维护映射体积的边界来减少内存消耗,并设计了新的数据结构支持高效查询。

Journal ref Benxu Tang, et al. The International Journal of Robotics Research, published online 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21943 2026-03-24 cs.CV 57%

GeoFlow: Real-Time Fine-Grained Cross-View Geolocalization via Iterative Flow Prediction

GeoFlow:通过迭代流预测实现实时细粒度跨视角地理定位

Ayesh Abu Lehyeh, Xiaohan Zhang, Ahmad Arrabi, Waqas Sultani, Chen Chen, Safwan Wshah

机构 * Vermont Artificial Intelligence Lab, Department of Computer Science, University of Vermont(佛蒙特人工智能实验室,计算机科学系,佛蒙特大学) Intelligent Machines Lab, Information Technology University(智能机器实验室,信息科技大学) Institute of Artificial Intelligence, University of Central Florida(人工智能研究所,佛罗里达中央大学)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 本文提出GeoFlow,通过迭代流预测实现实时细粒度跨视角地理定位,解决了高精度与实时性的平衡问题,实验显示其在KITTI和VIGOR数据集上达到实时29FPS且保持高精度。

Comments Accepted at the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20066 2026-03-24 cs.CV 57%

PAUL: Uncertainty-Guided Partition and Augmentation for Robust Cross-View Geo-Localization under Noisy Correspondence

PAUL:基于不确定性的分区与增强以实现在噪声对应下的鲁棒跨视图地理定位

Zheng Li, Xueyi Zhang, Yanming Guo, Yuxiang Xie, Ding Zhaoyun, Siqi Cai, Haizhou Li, Mingrui Lao

机构 * National University of Defense Technology(国防科技大学) Shenzhen Loop Area Institute(深圳河套学院) School of Artificial Intelligence, The Chinese University of Hong Kong, Shenzhen(香港中文大学深圳人工智能学院) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学深圳研究院)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 本文提出PAUL框架,通过不确定性感知的共增强和证据共训练,解决跨视图地理定位中的噪声对应问题,提升鲁棒性。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02064 2026-03-24 q-bio.NC cs.AI 57%

REMI: Reconstructing Episodic Memory During Internally Driven Path Planning

REMI:在内部驱动路径规划中重建情景记忆

Zhaoze Wang, Genela Morris, Dori Derdikman, Pratik Chaudhari, Vijay Balasubramanian

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 本文提出了一种MEC-HC连接理论,解释了网格细胞和位置细胞如何通过相互作用支持空间编码和内部驱动路径规划,如通过线索导航到记忆中的地点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15453 2026-03-24 eess.SY cs.RO cs.SY 57%

Barrier-Riccati Synthesis for Nonlinear Safe Control with Expanded Region of Attraction

非线性安全控制的屏障-里茨合成:扩展吸引区域

Hassan Almubarak, Maitham F. AL-Sunni, Justin T. Dubbin, Nader Sadegh, John M. Dolan, Evangelos A. Theodorou

机构 * Control & Instrumentation Engineering Department, King Fahd University of Petroleum and Minerals(国王法赫德石油和矿物大学控制与仪器工程系) Department of Electrical & Computer Engineering(电气与计算机工程系) Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所) Daniel Guggenheim School of Aerospace Engineering(丹尼尔·古根海姆航空航天工程学院) George W. Woodruff School of Mechanical Engineering(乔治·W·伍德鲁夫机械工程学院)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文提出一种基于里茨的非线性安全控制框架,结合屏障状态方法与状态依赖里茨方程方法,通过辅助状态嵌入安全约束,扩展吸引区域并保证渐近安全稳定。

Comments This work has been accepted for publication in the proceedings of the 2026 American Control Conference (ACC), New Orleans, Louisiana, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20443 2026-03-24 cs.RO 57%

TRGS-SLAM: IMU-Aided Gaussian Splatting SLAM for Blurry, Rolling Shutter, and Noisy Thermal Images

TRGS-SLAM:基于IMU的高斯点云SLAM用于模糊、滚动快门和噪声热图像

Spencer Carmichael, Katherine A. Skinner

机构 * University of Michigan(密歇根大学)

专题命中 具身导航 :robotics(abstract);分类 cs.RO

AI总结 本文提出TRGS-SLAM,一种基于3DGS的热惯性SLAM系统,能处理热图像中的模糊、滚动快门和噪声问题,通过改进的3DGS渲染方法和创新技术实现高精度跟踪。

Comments Project page: https://umautobots.github.io/trgs_slam

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20336 2026-03-24 cs.IR cs.AI cs.DB 57%

GEM: A Native Graph-based Index for Multi-Vector Retrieval

GEM:一种基于图的多向量检索索引

Yao Tian, Zhoujin Tian, Xi Zhao, Ruiyuan Zhang, Xiaofang Zhou

机构 * The Hong Kong University of \ Hong Kong Generative AI Research \& Development Center Hong Kong China The Hong Kong University of Science Hong Kong Generative AI Research \& Development Center

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 GEM提出一种针对多向量表示的原生索引框架,通过构建向量集的接近图,保留细粒度语义并实现高效导航,提升检索效率和准确性。

Comments This paper has been accepted by SIGMOD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22133 2026-03-24 cs.CY 50%

Navigational Thinking as an Emerging Paradigm of Computer Science in the Age of Generative AI

导航思维作为生成AI时代计算机科学的一种新兴范式

Ilya Levin

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出导航思维是生成AI时代知识生产的新模式,通过高维流形几何导航实现意义生成,挑战传统符号化认知方式。

Comments 21 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏