arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 307 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 307 篇

2605.22142 2026-07-29 cs.LG cs.AI 版本更新 62%

Short-Term-to-Long-Term Memory Transfer for Knowledge Graphs under Partial Observability

知识图谱下的短期到长期记忆转移:在部分可观测性下的短期到长期记忆转移

Taewoon Kim, Vincent François-Lavet, Michael Cochez

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.LG

AI总结 本文研究了在部分可观测性下知识图谱中的短期到长期记忆转移问题,提出了一种基于神经符号价值决策的方法,通过在长期插入前决定保留或丢弃观察到的三元组,从而提升记忆效率,并在RoomKG基准测试中优于符号和神经基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11029 2026-07-24 cs.RO cs.CV 版本更新 62%

Learning to Navigate Efficiently with Only 0.58M Trainable Parameters

仅用58万个可训练参数学习高效导航

Edward Beng Wai Tan, Siew-Kei Lam

机构 * College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 研究视觉导航中单个任务族所需规模及替代结构,提出分解式导航模型,仅用少量可训练参数,在导航任务中接近最先进模型性能,还能用于无目标探索,故障模式可解析纠正。

Comments 6 pages, 4 figures. Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12144 2026-07-24 cs.CV cs.RO eess.IV 版本更新 62%

O3N: Omnidirectional Open-Vocabulary Occupancy Prediction for Urban Autonomous Agents

O3N: 全向开放词汇占用预测

Mengfei Duan, Hao Shi, Fei Teng, Guoqiang Zhao, Yuheng Zhang, Zhiyong Li, Kailun Yang

机构 * Hunan University(湖南大学) Zhejiang University(浙江大学)

专题命中 具身导航 :embodied agent(abstract);分类 cs.RO、cs.CV

AI总结 O3N通过全向感知和开放词汇方法,实现三维空间的连续表示和长距离上下文建模,提升具身智能在开放世界中的感知与建模能力。

Comments The source code will be made publicly available at https://github.com/MengfeiD/O3N

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13830 2026-07-22 cs.RO cs.CV 版本更新 62%

Recursive ArUco Markers: A Scalable Fiducial Marker Design for Unmanned Aerial Vehicle Landing Pads

递归ArUco标记:一种用于无人机着陆垫的可扩展基准标记设计

Rafael Munoz-Salinas, Francisco Jose Romero-Ramirez, Sergio Garrido-Jurado

机构 * Universidad de Córdoba(科尔多瓦大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 研究针对无人机着陆依赖的视觉基准标记操作范围有限问题,提出递归ArUco标记设计,通过改进位采样策略实现任意深度递归、遮挡下稳健检测及多唯一标识符字典,使无人机机队可同时在指定位置着陆。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18537 2026-07-22 cs.RO cs.AI 版本更新 62%

SKETCH: Semantic Key-Point Conditioning for Long-Horizon Vessel Trajectory Prediction

SKETCH: 面向长时域船舶轨迹预测的语义关键点条件建模

Linyong Gan, Zimo Li, Wenxin Xu, Xingjian Li, Jianhua Z. Huang, Enmei Tu, Shuhang Chen

机构 * School of Data Science, The Chinese University of Hong Kong, Shenzhen, China(香港中文大学(深圳)数据科学学院) School of Science and Engineering, The Chinese University of Hong Kong, Shenzhen, China(香港中文大学(深圳)科学与工程学院) School of Artificial Intelligence, The Chinese University of Hong Kong, Shenzhen, China(香港中文大学(深圳)人工智能学院) COSCO SHIPPING Advanced Technology Institute, Shanghai, China(中远海运技术研究院)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 针对长时域轨迹预测中方向漂移问题,提出基于语义关键点(NKP)的条件轨迹建模框架,将预测分解为全局语义决策与局部运动建模,采用预训练-微调策略估计NKP先验,在真实AIS数据上显著提升长时域、方向精度和细粒度预测性能。

Comments Final Camera-Ready Version. Accepted by ICML 2026 (PMLR Vol. 306)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19186 2026-07-15 cs.RO cs.AI cs.FL 版本更新 62%

Real-Time Model Checking for Closed-Loop Robot Reactive Planning

闭环机器人反应式规划的实时模型检查

Christopher Chandler, Bernd Porr, Giulia Lafratta, Alice Miller

机构 * School of Computing Science University of Glasgow Glasgow Scotland UK(计算科学学院格拉斯哥大学格拉斯哥苏格兰英国) School of Biomedical Engineering University of Glasgow Glasgow Scotland UK(生物医学工程学院格拉斯哥大学格拉斯哥苏格兰英国) University of Glasgow(格拉斯哥大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 研究利用模型检查让自主机器人实现反应式多步规划与避障,特制算法基于生物知识实时原位生成规划,通过链式系统和临时快照减轻状态空间爆炸,实验证明方法有效且性能提升,为自动驾驶导航发展提供案例,适用于关键任务移动机器人。

Comments 41 pages excluding references, 21 figures, submitted to Formal Aspects of Computing

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21245 2026-07-15 cs.RO cs.LG 版本更新 62%

Diffusion Denoiser-Aided Gyrocompassing

扩散去噪器辅助的陀螺罗经法

Gershy Ben-Arie, Daniel Engelsman, Rotem Dror, Itzik Klein

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.LG

AI总结 针对低成本陀螺仪准确及时陀螺罗经法的挑战,提出扩散去噪器辅助的陀螺罗经法,集成扩散去噪框架与航向估计模型,处理原始传感器信号,实验证明相比其他方法显著提高了陀螺罗经精度,对自主平台导航意义重大。

Comments 8 pages, 8 figures

Journal ref Measurement, Measurement, Volume 287, 2026, Article 122370

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26795 2026-07-14 cs.CV cs.AI cs.MM 版本更新 62%

NaviCache: Test-Time Self-Calibration Caching for Video Generation

NaviCache: 视频生成的测试时自校准缓存

Zheqi Lv, Zhibo Zhu, Jinke Wang, Qi Tian, Shengyu Zhang, Zhengyu Chen, Chengxi Zang, Zhou Zhao, Fei Wu

机构 * Zhejiang University(浙江大学) Cornell University(康奈尔大学) Tencent Hunyuan(腾讯文生视频)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.CV

AI总结 针对视频扩散模型计算成本高的问题,提出NaviCache方法,将特征演化重构思为惯性导航系统问题,通过双状态估计架构自适应跟踪特征变化比和潜在漂移,实现有界误差的计算跳过,在多个模型上取得优异性能。

Comments Published at ICML 2026: Proceedings of the 43rd International Conference on Machine Learning, Seoul, South Korea. PMLR 306, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01577 2026-07-09 cs.LG cs.AI 版本更新 62%

Exploration of Fast-Slow Latent Recurrence for Train-Short, Test-Long Generalization

倾听时思考:用于长时间序列建模的快慢复发

Shota Takashiro, Masanori Koyama, Takeru Miyato, Yusuke Iwasawa, Yutaka Matsuo, Kohei Hayashi

机构 * The University of Tokyo(东京大学) University of Tübingen(图宾根大学)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.LG

AI总结 本文提出快慢复发机制,通过结合快速递归潜在更新与慢速观测更新,提升长周期序列建模的稳定性与泛化能力,优于LSTM等基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09072 2026-07-07 cs.RO cs.CV 版本更新 62%

SMF-VO: Direct Ego-Motion Estimation via Sparse Motion Fields

SMF-VO:通过稀疏运动场进行直接自我运动估计

Sangheon Yang, Yeongin Yoon, Hong Mo Jung, Jongwoo Lim

机构 * Department of Artificial Intelligence, Hanyang University(翰英大学人工智能系) Department of Mechanical Engineering, Seoul National University(首尔国立大学机械工程系) Robot Vision Lab, Seoul National University(首尔国立大学机器人视觉实验室)

专题命中 具身导航 :robotics(abstract);分类 cs.RO、cs.CV

AI总结 研究针对传统视觉里程计和视觉惯性里程计方法局限,提出SMF-VO框架,直接从稀疏光流估计瞬时线速度和角速度,采用广义3D射线运动场公式,在基准数据集上效率高、精度有竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23960 2026-07-07 cs.RO cs.AI 版本更新 62%

MAD-PINN: A Decentralized Physics-Informed Machine Learning Framework for Safe and Optimal Multi-Agent Control

MAD-PINN:一种用于安全和最优多智能体控制的分散式物理信息机器学习框架

Manan Tayal, Aditya Singh, Shishir Kolathaya, Somil Bansal

机构 * Center for Cyber-Physical Systems, Indian Institute of Science(印度科学研究院中心 for 联合体系统) Department of Electrical and Systems Engineering, University of Pennsylvania(宾夕法尼亚大学电气与系统工程系) Department of Aeronautics and Astronautics, Stanford University(斯坦福大学航空与航天工程系)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 针对大规模多智能体系统安全与性能协同优化难题,提出MAD-PINN框架。利用基于上图的公式化方法,通过物理信息神经网络近似求解,采用分散训练与执行策略,实验表明其性能优越且具可扩展性。

Comments 9 Pages, 4 Figures, 4 Tables. First two authors have contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16250 2026-07-01 cs.CV cs.AI 版本更新 62%

Visual Prompt Discovery via Semantic Exploration

通过语义探索发现视觉提示

Jaechang Kim, Yotaro Shimose, Zhao Wang, Kuang-Da Wang, Jungseul Ok, Shingo Takamatsu

机构 * Sony Group Corporation(索尼集团公司) Pohang University of Science and Technology(浦项科技大学) National Yang Ming Chiao Tung University(国立阳明交通大学)

专题命中 具身导航 :manipulation(abstract);分类 cs.AI、cs.CV

AI总结 提出SEVEX算法,通过抽象思想空间和语义反馈自动探索任务级视觉提示,提升LVLM图像感知能力。

Comments Accepted to ECCV 2026, project page: https://jaechang.dev/projects/SEVEX/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17455 2026-06-29 cs.CV cs.RO 版本更新 62%

VLM-Guided Visual Place Recognition for Planet-Scale Geo-Localization

VLM引导的视觉地点识别用于行星级地理定位

Sania Waheed, Na Min An, Michael Milford, Sarvapali D. Ramchurn, Shoaib Ehsan

机构 * Univ. of Southampton, UK(英国南安普顿大学) KAIST, South Korea(韩国科学技术院) QUT, Australia(昆士兰科技大学) Univ. of Essex, UK(英国埃塞克斯大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 提出VLM与检索式VPR结合的混合框架,利用VLM生成先验约束搜索空间,再通过检索和重排序实现行星级地理定位,在街道和城市级别分别提升4.51%和13.52%。

Journal ref Proceedings of the Australasian Conference on Robotics and Automation (ACRA 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07412 2026-06-25 cs.LG cs.AI 版本更新 62%

Tracking Large-scale Shared Bikes with Inertial Motion Learning in GNSS Blocked Environments

通过惯性运动学习在GNSS阻塞环境中跟踪大规模共享自行车

Feng Liu, Kejia Li, Zhiwei Yang, Chunwei Yang, Qun Li, Guobin Wu, Qiang Ni, Ruipeng Gao

机构 * School of Software Engineering, Beijing Jiaotong University(北京交通大学软件学院) DiDi, Beijing(滴滴(北京))

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种结合自行车机械约束与混合专家模型的惯性跟踪框架,通过多专家模块捕捉共享表示并改进多任务学习性能,实现不确定性感知的轨迹估计,并通过动态校准提升跟踪精度。

Comments This paper has been accepted by IEEE Transactions on Intelligent Transportation Systems (T-ITS) on June 23, 2026. Journal article. 15 pages, 18 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03120 2026-06-17 cs.CV cs.RO 版本更新 62%

SCC-Loc: A Unified Semantic Cascade Consensus Framework for UAV Thermal Geo-Localization

SCC-Loc: 无人机热红外地理定位的统一语义级联共识框架

Xiaoran Zhang, Yu Liu, Jinyu Liang, Kangqiushi Li, Zhiwei Huang, Huaxin Xiao

机构 * College of Systems Engineering, National University of Defense Technology(系统工程学院,国防科技大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 提出SCC-Loc框架,通过共享DINOv2骨干网络、语义引导视口对齐、级联空间自适应纹理结构滤波和共识驱动可靠性感知位置选择,解决热红外-可见光模态差异导致的特征模糊问题,实现零样本高精度绝对位置估计,平均定位误差9.37米。

Comments 17 pages, 5 figures. Submitted to IEEE J-STARS

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17997 2026-06-16 cs.LG cs.RO 版本更新 62%

Whole-Brain Connectomic Graph Model Enables Whole-Body Locomotion Control in Fruit Fly

全脑连接组图模型实现果蝇全身运动控制

Zehao Jin, Yaoye Zhu, Chen Zhang, Yanan Sui

机构 * Tsinghua University(清华大学)

专题命中 具身导航 :embodied agent(abstract);分类 cs.RO、cs.LG

AI总结 提出Fly-connectomic Graph Model,将果蝇全脑连接组作为图结构控制器,通过深度强化学习驱动仿真果蝇运动,在多种任务中表现稳定且样本效率优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16509 2026-06-16 cs.LG cs.AI 版本更新 62%

Adaptive $k$NN graph model

自适应 $k$NN 图模型

Jiaye Li, Hang Xu, Shichao Zhang

机构 * The State Key Laboratory of Blockchain and Data Security(区块链与数据安全国家重点实验室) Zhejiang University(浙江大学) The School of Computer Science and Engineering(计算机科学与工程学院) Central South University(中南大学) School of Computer Science and Engineering(计算机科学与工程学院) Guangxi Normal University(广西师范大学)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.LG

AI总结 提出一种基于分层可导航小世界图与预计算投票机制的自适应图模型,将邻居选择与加权的计算负担转移到训练阶段,在保持分类精度的同时实现实时推理速度。

Comments 31 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20906 2026-06-09 cs.CV cs.RO 版本更新 62%

Distant Object Localisation from Noisy Image Segmentation Sequences

基于噪声图像分割序列的远距离目标定位

Julius Pesonen, Arno Solin, Eija Honkavaara

机构 * Research Council of Finland(芬兰研究理事会) RCF Flagship Forest–Human–Machine Interplay—Building Resilience, Redefining Value Networks and Enabling Meaningful Experiences (UNITE)(RCF旗舰森林-人类-机器交互——构建韧性,重新定义价值网络和赋能有意义体验(UNITE))

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 针对远距离目标定位问题,提出多视图三角测量和粒子滤波两种方法,后者还能提供形状和不确定性估计,结合无人机图像分割与GNSS姿态估计实现可靠野火监测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05458 2026-07-23 cs.RO 版本更新 61%

Counterfactual Reasoning and Environment Design for Active Preference Learning

主动偏好学习的反事实推理与环境设计

Yi-Shiuan Tung, Bradley Hayes, Alessandro Roncone

专题命中 具身导航 :navigation(abstract);分类 cs.RO;robot learning(comments)

AI总结 研究机器人主动偏好学习中现有方法的不足,提出CRED方法,通过联合优化环境设计和轨迹选择,利用反事实推理生成轨迹,经实验验证该方法能改善奖励学习并在不同环境有效泛化。

Comments RSS 2025 Workshop on Human-in-the-Loop Robot Learning: Teaching, Correcting, and Adapting

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08926 2026-07-22 cs.RO 版本更新 61%

Fly, Track, Land: Infrastructure-less Magnetic Localization for Heterogeneous UAV-UGV Teaming

飞行、跟踪、着陆:一种无基础设施的磁感应定位用于异构无人机-地面车辆协同

Valerio Brunacci, Davide Plozza, Alessio De Angelis, Michele Magno, Tommaso Polonelli

机构 * Department of Engineering, University of Perugia(工程系,佩鲁吉亚大学) Multi-Robot Systems Group, Faculty of Electrical Engineering, Czech Technical University in Prague(多机器人系统组,电气工程系,布拉格捷克技术大学) D-ITET Department, ETH Zürich(D-ITET部门,苏黎世联邦理工学院)

专题命中 具身导航 :navigation(abstract);分类 cs.RO;robotics(comments)

AI总结 该研究提出一种无基础设施的磁感应定位系统,使无人机在移动地面车辆上实现厘米级精度的自主悬停、跟踪和着陆。

Comments Revised version submitted to Robotics and Autonomous Systems (Elsevier). Supplementary video available

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12122 2026-08-17 cs.RO 版本更新 57%

OctoSplat: Hybrid OctoMap-Gaussian Splatting for Active Semantic Mapping and Phenotyping with Horticultural Robots

利用高斯点云进行园艺环境的主动语义映射

Jose Cuaran, Naveen K. Uppalapati, Girish Chowdhary

机构 * the Siebel School of Computing and Data Science(塞比尔计算与数据科学学院) the Department of Agricultural and Biological Engineering(农业与生物工程系) National Center for Supercomputing Applications at University of Illinois, Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校国家超级计算中心)

专题命中 具身导航 :robotics(abstract);分类 cs.RO

AI总结 本文提出利用移动机械臂和高斯点云进行园艺环境主动3D重建,提升重建精度与效率,实现水果计数和体积估算。

Comments 23 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06811 2026-08-12 cs.RO 版本更新 57%

A 26-Gram Tailless Butterfly-Inspired Flapping-Wing Robot with Onboard Attitude Control

一种26克受蝴蝶启发的机器人实现自主无尾飞行

Weibin Gu, Chenrui Feng, Lian Liu, Chen Yang, Xingchi Jiao, Yuhe Ding, Xiaofei Shi, Chao Gao, Alessandro Rizzo, Guyue Zhou

机构 * Institute for AI Industry Research (AIR)(人工智能产业研究院) Department of Electronics and Telecommunications(电子电信系) School of Vehicle and Mobility(车辆与移动系统学院) Xinchen Qihang Inc.(新晨启航有限公司)

专题命中 具身导航 :robotics(abstract);分类 cs.RO

AI总结 AirPulse 是一种26克受蝴蝶启发的无尾飞行机器人,通过低频拍打和分层控制实现自主飞行,为解码蝴蝶飞行动态和开发抗碰撞空中机器人提供新方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03495 2026-08-12 cs.RO 版本更新 57%

Navigating in Uncertain Environments with Heterogeneous Visibility

在不确定环境中利用异质可见性导航

Jongann Lee, Melkior Ornik

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文提出了一种基于异质可见性的导航算法,通过优化观察奖励与通行成本之和,有效降低导航成本并提升信息获取效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17005 2026-08-12 cs.RO cs.SY eess.SY 版本更新 57%

Autonomous Exploration-Based Precise Mapping for Mobile Robots through Stepwise and Consistent Motions

基于逐步一致运动的移动机器人自主探索精准建图

Muhua Zhang, Lei Ma, Ying Wu, Kai Shen, Yongkui Sun, Henry Leung

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文提出一种面向采用激光SLAM的室内移动机器人的自主探索框架,通过多RRT采样、逐步一致运动等策略提升建图精度与鲁棒性,经仿真与真实实验验证其优于基准2D算法。

Comments 8 pages, 11 figures. This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31119 2026-08-11 cs.LG 版本更新 57%

Visualizing High-Dimensional Graph Embeddings via Informed Multi-View Projections

通过信息多视图投影可视化高维图嵌入

Ya Ji, Xuefeng Li, Timo Brand, Jacob Miller, Peng Zhang, Stephen Kobourov, Yifan Hu

机构 * Khoury College of Computer Sciences, Northeastern University(东北大学库里计算机科学学院) School of Computation, Information and Technology, Technical University of Munich(慕尼黑工业大学计算、信息与技术学院)

专题命中 具身导航 :navigation(abstract);分类 cs.LG

AI总结 提出在高维空间中嵌入图,并通过可微分的边交叉代理搜索优化美学和可读性指标的二维视角,优于标准布局,并引入交互系统DataFly。

Comments 20 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00637 2026-08-11 cs.RO 版本更新 57%

Global-Local Attention Decomposition for Terrain Encoding in Humanoid Perceptive Locomotion

全局-局部注意力分解用于人形感知运动中的地形编码

Shengcheng Fu, Yang Zhang, Zhanxiang Cao, Liyun Yan, Yizhi Chen, Yunpeng Yin, Yue Gao

机构 * Tongji University(同济大学) Shanghai Innovation Institute(上海创新研究院) Shanghai Jiao Tong University(上海交通大学) Humanoid Robot (Shanghai) Co., Ltd.(人形机器人(上海)有限公司)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 提出全局-局部注意力分解(GLAD)方法,通过粗到细编码器分离全局地形感知和局部立足点选择,实现人形机器人在稀疏立足点和受限环境中的鲁棒运动。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28272 2026-08-11 cs.RO 版本更新 57%

Point of View: How Perspective Affects Perceived Robot Sociability

视角:透视如何影响感知的机器人社交性

Subham Agrawal, Aftab Akhtar, Nils Dengler, Maren Bennewitz

机构 * Humanoid Robots Lab, University of Bonn, Germany(波恩大学人形机器人实验室,德国)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文通过VR用户研究,比较全知视角与第一人称视角对机器人轨迹社交性的感知差异,发现全知视角下社交性高的轨迹在近距离第一人称体验中可能更令人不安,而头部点头等社交信号可提升感知社交性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23290 2026-08-11 cs.CV 版本更新 57%

LineGraph2Road: Structural Graph Reasoning on Line Graphs for Road Network Extraction

LineGraph2Road:基于线路图的结构图推理用于道路网络提取

Zhengyang Wei, Renzhi Jing, Yiyi He, Jenny Suckale

机构 * Stanford University(斯坦福大学) Georgia Institute of Technology(佐治亚理工学院)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 LineGraph2Road通过构建全局稀疏欧几里得图并应用图变换器,提升道路网络提取的连通性预测,解决长距离依赖和复杂拓扑问题,实现高精度道路提取。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13361 2026-08-11 cs.RO 版本更新 57%

CLEAR: A Semantic-Geometric Terrain Abstraction for Large-Scale Unstructured Environments

CLEAR: 一种用于大规模无结构环境的语义-几何地形抽象

Pranay Meshram, Charuvahan Adhivarahan, Ehsan Tarkesh Esfahani, Souma Chowdhury, Chen Wang, Karthik Dantu

机构 * Department of Computer Science and Engineering, University at Buffalo(计算机科学与工程系,布法罗大学) Department of Mechanical and Aerospace Engineering, University at Buffalo(机械与航空航天工程系,布法罗大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 CLEAR通过结合边界感知的空间分解与递归平面拟合,实现了大规模无结构环境中的高效地形抽象,提高了路径规划的速度和可靠性。

Comments Accepted in IEEE RA-L August, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06305 2026-08-10 cs.AI cs.CL cs.IR 版本更新 57%

Beyond Top-K: Replacing Black-Box Retrieval with Interpretable Agentic Operations

超越Top-K:用可解释智能体操作替代黑盒检索

Sagar Tamang, Ayush Vyas, Tabarakul Hazarika

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 该研究针对长文档检索的结构缺陷,提出无嵌入智能体检索框架READ,在政府财务报告数据集上显著优于密集检索,且性能提升源于操作界面,同时发现BM25与READ无统计差异。

Comments 20 pages, 5 figures, 14 tables. Code, benchmark, and full result trajectories: https://github.com/twospoon/READ

详情

展开后加载摘要…

URL PDF HTML 收藏