arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-03-20 至 2026-03-20 共收录 69 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 1 篇

2603.19029 2026-03-20 cs.RO 57%

ATG-MoE: Autoregressive trajectory generation with mixture-of-experts for assembly skill learning

ATG-MoE:基于混合专家的自主轨迹生成用于装配技能学习

Weihang Huang, Chaoran Zhang, Xiaoxin Deng, Hao Zhou, Zhaobo Xu, Shubo Cui, Long Zeng

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Faculty of Engineering, Imperial College London(伦敦帝国理工学院工程学院)

专题命中 机器人学习 :manipulation(abstract);分类 cs.RO

AI总结 本文提出ATG-MoE,通过混合专家架构实现多技能整合,解决传统方法在多阶段设计和多技能整合能力上的不足,实验显示其在模拟和实际应用中均表现优异。

Comments 32 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 23 篇

2509.26642 2026-03-20 cs.RO 90%

MLA: A Multisensory Language-Action Model for Multimodal Understanding and Forecasting in Robotic Manipulation

MLA:一种多感官语言-动作模型,用于机器人操作中的多模态理解和预测

Zhuoyang Liu, Jiaming Liu, Jiadong Xu, Nuowei Han, Chenyang Gu, Hao Chen, Kaichen Zhou, Renrui Zhang, Kai Chin Hsieh, Kun Wu, Zhengping Che, Jian Tang, Shanghang Zhang

机构 * State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(多媒体信息处理国家重点实验室,计算机科学学院,北京大学) Beijing Innovation Center of Humanoid Robotics (X-Humanoid)(北京类人机器人创新中心(X-Humanoid)) The Chinese University of Hong Kong (CUHK)(香港中文大学(CUHK))

专题命中 机器人操作 :robotic(title,abstract);manipulation(title,abstract);world model(abstract);分类 cs.RO

AI总结 本文提出MLA模型,通过多感官融合与未来目标预测,提升机器人在复杂接触任务中的操控能力,实验显示其在2D和3D任务中性能优于现有方法。

Comments Project page: https://robotic-mla.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18284 2026-03-20 cs.RO cs.AI cs.NI cs.SY eess.SY 88%

Offload or Overload: A Platform Measurement Study of Mobile Robotic Manipulation Workloads

卸载或超载:移动机器人操控工作负载的平台测量研究

Sara Pohland, Xenofon Foukas, Ganesh Ananthanarayanan, Andrey Kolobov, Sanjeev Mehrotra, Bozidar Radunovic, Ankit Verma

机构 * UC Berkeley(加州大学伯克利分校) Microsoft Corp(微软公司)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO、cs.AI

AI总结 本文首次研究了移动机器人操控工作负载在车载、边缘和云GPU平台上的表现,发现小车载GPU无法运行完整工作栈,而大车载GPU会更快耗尽电池,卸载虽缓解约束但引入网络延迟和带宽问题,最终量化了机器人舰队共享计算的机会与风险。

Comments 15 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11052 2026-03-20 cs.RO 88%

AdaptPNP: Integrating Prehensile and Non-Prehensile Skills for Adaptive Robotic Manipulation

AdaptPNP: 集成抓取与非抓取技能以实现适应性机器人操控

Jinxuan Zhu, Chenrui Tie, Xinyi Cao, Yuran Wang, Jingxiang Guo, Zixuan Chen, Haonan Chen, Junting Chen, Yangyu Xiao, Ruihai Wu, Lin Shao

机构 * School of Computing, National University of Singapore(新加坡国立大学计算机学院) RoboScience(机器人科学) East China Normal University(华东师范大学) Peking University(北京大学) Nanjing University(南京大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 本文提出AdaptPNP框架,通过视觉-语言模型整合抓取与非抓取技能,实现复杂机器人操控任务的规划与执行。

Journal ref ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18246 2026-03-20 cs.RO 83%

Rapid Adaptation of Particle Dynamics for Generalized Deformable Object Mobile Manipulation

粒子动力学快速适应用于广义变形物体移动操作

Bohan Wu, Roberto Martín-Martín, Li Fei-Fei

机构 * Stanford University(斯坦福大学) University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出RAPiD方法,通过学习视觉-运动策略和动态嵌入推理,实现变形物体移动操作的高成功率。

Comments 8 pages, ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02437 2026-03-20 cs.RO 83%

U-ARM : Ultra low-cost general teleoperation interface for robot manipulation

U-ARM:超低成本通用机器人操控接口

Yanwen Zou, Zhaoye Zhou, Chenyang Shi, Zewei Ye, Junda Huang, Yan Ding, Bo Zhao

机构 * School of AI, SJTU(1 人工智能学院,上海交通大学) EvoMind Tech(2 EvoMind科技) IAAR-Shanghai(3 上海IAAR)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 U-ARM提出一种低成本且快速适应的遥控框架,通过三种结构不同的3D打印领导者臂实现与多数商用机械臂的兼容,成本仅为50.5美元和56.8美元,提升了操控效率和任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11839 2026-03-20 cs.RO cs.CV 81%

TrajBooster: Boosting Humanoid Whole-Body Manipulation via Trajectory-Centric Learning

TrajBooster:通过轨迹中心学习提升双足人形机器人的整体操作

Jiacheng Liu, Pengxiang Ding, Qihang Zhou, Yuxuan Wu, Da Huang, Zimian Peng, Wei Xiao, Weinan Zhang, Lixin Yang, Cewu Lu, Donglin Wang

机构 * Zhejiang University(浙江大学) Westlake University(西湖大学) Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO、cs.CV

AI总结 TrajBooster通过利用轮式人形数据提升双足VLA性能,采用末端执行器轨迹作为通用接口,通过仿真重定向和预训练实现高效任务执行,减少对同构数据的依赖。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15888 2026-03-20 cs.AI cs.CV cs.RO 80%

AsgardBench -- Evaluating Visually Grounded Interactive Planning Under Minimal Feedback

AsgardBench -- 评估基于视觉的交互式规划在最小反馈下的表现

Andrea Tupini, Lars Liden, Reuben Tan, Yu Wang, Jianfeng Gao

机构 * Microsoft(微软)

专题命中 机器人操作 :embodied AI(abstract);manipulation(abstract);navigation(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 AsgardBench旨在评估基于视觉的高阶动作序列生成和交互式规划,重点在于执行过程中基于视觉观察而非导航或低级操作的计划适应。通过限制代理输入为图像、动作历史和轻量级成功/失败信号,该基准测试强调条件分支和计划修复。

Comments 19 figures, 6 tables, including appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08953 2026-03-20 cs.RO cs.SY eess.SY 79%

Direct Data-Driven Predictive Control for a Three-dimensional Cable-Driven Soft Robotic Arm

面向三维缆驱动软机器人臂的直接数据驱动预测控制

Cheng Ouyang, Moeen Ul Islam, Dong Chen, Kaixiang Zhang, Zhaojian Li, Xiaobo Tan

机构 * Department of Agricultural & Biological Engineering, Mississippi State University(农业与生物工程系,密苏里州立大学) Department of Mechanical Engineering, Michigan State University(机械工程系,密苏里州立大学) Department of Electrical and Computer Engineering, Michigan State University(电气与计算机工程系,密苏里州立大学)

专题命中 机器人操作 :robotic(title,abstract);分类 cs.RO

AI总结 本文提出一种有效的数据驱动预测控制框架,用于三维缆驱动软机器人臂,通过奇异值分解实现降维,提升控制精度和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19195 2026-03-20 cs.CV 79%

All-in-One Slider for Attribute Manipulation in Diffusion Models

用于扩散模型属性操控的全能滑块

Weixin Ye, Hongguang Zhu, Wei Wang, Yahui Liu, Mengyu Wang, Xuecheng Nie

机构 * Institute of Information Science, Beijing Jiaotong University(北京交通大学信息科学学院) Visual Intelligence + X International Cooperation Joint Laboratory of the Ministry of Education(教育部视觉智能+X国际合作联合实验室) City University of Macau(澳门城市大学) Kuaishou(快手) Meitu(美图)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.CV

AI总结 本文提出All-in-One滑块模块,通过分解文本嵌入空间实现高效的属性操控,支持多属性组合与零样本操控,提升扩散模型的属性操控精度和可扩展性。

Comments accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04867 2026-03-20 math.OC q-fin.TR 78%

Optimal execution with deterministically time varying liquidity: well posedness and price manipulation

确定性时间变化流动性下的最优执行:well posedness与价格操纵

Gianluca Palmari, Fabrizio Lillo, Zoltan Eisler

专题命中 机器人操作 :manipulation(title,abstract)

AI总结 本文研究了在Almgren-Chriss框架下,确定性时间变化流动性下的最优执行问题,探讨了Hadamard意义下的well posedness和价格操纵的避免条件,通过数值分析验证了结果。

Comments 33 pages, & figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14634 2026-03-20 cs.RO cs.CV 73%

Latent Representations for Visual Proprioception in Inexpensive Robots

视觉本体感觉中的低成本机器人潜在表示

Sahara Sheikholeslami, Ladislau Bölöni

机构 * University of Central Florida(中央佛罗里达大学)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 本文探讨了低成本机器人通过单个外部摄像头图像进行视觉本体感觉的可行性,比较了CNN、VAE、ViT和fiducial标记袋等潜在表示方法的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18535 2026-03-20 cs.HC 71%

Align-to-Scale: Mode Switching Technique for Unimanual 3D Object Manipulation with Gaze-Hand-Object Alignment in Extended Reality

对齐到尺度:用于增强现实中的单手3D物体操控的模式切换技术

Min-yung Kim, Jinwook Kim, Ken Pfeuffer, Sang Ho Yoon

专题命中 机器人操作 :manipulation(title)

AI总结 本文提出一种基于 gaze-hand-object 对齐的单手3D操控模式切换技术,通过空间对齐实现单手缩放,评估了多种单手缩放方法的可用性,并提出设计指南以支持未来的3D界面。

Comments 19 pages, 6 figures, Presented at ACM ETRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19231 2026-03-20 cs.CV 70%

MonoArt: Progressive Structural Reasoning for Monocular Articulated 3D Reconstruction

MonoArt:基于渐进结构推理的单目关节3D重建

Haitian Li, Haozhe Xie, Junxiang Xu, Beichen Wen, Fangzhou Hong, Ziwei Liu

机构 * S-Lab, Nanyang Technological University, 637335 Singapore(南洋理工大学S实验室)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.CV

AI总结 MonoArt通过渐进结构推理实现单目关节3D重建,无需外部运动模板或多阶段流程,提升重建精度和推理速度,并扩展至机器人操作和关节场景重建。

Comments Project page: https://lihaitian.com/MonoArt

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18912 2026-03-20 cs.CV 70%

GHOST: Fast Category-agnostic Hand-Object Interaction Reconstruction from RGB Videos using Gaussian Splatting

GHOST:基于RGB视频的快速无类别手-物体交互重建方法(使用高斯散射)

Ahmed Tawfik Aboukhadra, Marcel Rogge, Nadia Robertini, Abdalla Arafa, Jameel Malik, Ahmed Elhayek, Didier Stricker

机构 * RPTU(鲁尔大学图灵学院) DFKI-AV Kaiserslautern(德累斯顿-费尔德基辛人工智能研究所) UPM Saudi Arabia(西班牙国际大学沙特分校) NUST-SEECS Pakistan(奈瓦扎巴德大学信息与电子科学学院)

专题命中 机器人操作 :robotics(abstract);embodied AI(abstract);分类 cs.CV

AI总结 GHOST通过高斯散射技术实现快速且无类别的手-物体交互重建,解决了现有方法在物理一致性上的不足,实验表明其在3D重建和2D渲染质量上达到领先水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18495 2026-03-20 cs.AI 70%

Cross-Domain Demo-to-Code via Neurosymbolic Counterfactual Reasoning

跨领域演示到代码的神经符号反事实推理

Jooyoung Kim, Wonje Choi, Younguk Song, Honguk Woo

机构 * Department of Computer Science and Engineering, Sungkyunkwan University(Sungkyunkwan 大学计算机科学与工程系)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.AI

AI总结 本文提出NeSyCR框架,通过神经符号反事实推理解决跨领域机器人编程中的过程不匹配问题,提升任务成功率31.14%。

Comments Accepted at CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19233 2026-03-20 cs.RO 57%

Not All Features Are Created Equal: A Mechanistic Study of Vision-Language-Action Models

并非所有特征都具有同等价值:一种视觉-语言-动作模型的机制研究

Bryce Grant, Xijia Zhao, Peng Wang

机构 * Case Western Reserve University(凯斯西储大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 研究通过激活注入、稀疏自编码器和线性探针分析视觉-语言-动作模型,发现视觉路径主导动作生成,语言敏感性取决于任务结构而非模型设计,且专家路径编码运动程序,VLM路径编码目标语义,释放Action Atlas供探索。

Comments Accepted to Multimodal Intelligence Workshop @ ICLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11717 2026-03-20 cs.CV 57%

COTONET: A custom cotton detection algorithm based on YOLO11 for stage of growth cotton boll detection

COTONET:基于YOLO11的定制棉花检测算法用于棉花生长阶段的棉铃检测

Guillem González, Guillem Alenyà, Sergi Foix

专题命中 机器人操作 :robotics(abstract);分类 cs.CV

AI总结 本文提出COTONET算法,通过改进YOLO11模型,结合注意力机制提升棉花不同生长阶段棉铃检测的准确率,实现高精度的棉花采摘自动化。

Comments 15 pages, 11 figures. This paper will be submitted to Computers and Electronics in Agriculture, special issue

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08905 2026-03-20 cs.CR cs.AI 57%

iSeal: Encrypted Fingerprinting for Reliable LLM Ownership Verification

iSeal:用于可靠LLM所有权验证的加密指纹法

Zixun Xiong, Gaoyi Wu, Qingyang Yu, Mingyu Derek Ma, Lingfeng Yao, Miao Pan, Xiaojiang Du, Hao Wang

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 iSeal通过在模型和外部模块中注入独特特征,结合纠错机制和相似性验证策略,实现对模型窃贼全程控制下的可靠LLM所有权验证,有效抵御指纹反学习和响应操控等攻击。

Comments Accepted by AAAI 2026

Journal ref Proc. AAAI Conf. Artif. Intell. 40(42): 23984-23992, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18370 2026-03-20 cs.RO 57%

Contact Status Recognition and Slip Detection with a Bio-inspired Tactile Hand

具有生物启发触觉手的接触状态识别与滑动检测

Chengxiao He, Wenhui Yang, Hongliang Zhao, Jiacheng Lv, Yuzhe Shao, Longhui Qin

机构 * School of Mechanical Engineering, Southeast University Nanjing 211189, China School of Electronic Science \& Engineering, Southeast University Nanjing 211189, China

专题命中 机器人操作 :robotic(abstract);分类 cs.RO

AI总结 本文提出了一种基于多模态触觉反馈的生物启发触觉手,通过提取17种特征实现96.39%的识别准确率,验证了方法的泛化能力。

Comments 7 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09909 2026-03-20 cond-mat.mes-hall cond-mat.supr-con 50%

Double-dome Unconventional Superconductivity in Twisted Trilayer Graphene

双穹非传统超导性在扭曲三重层石墨烯中

Zekang Zhou, Jin Jiang, Paritosh Karnatak, Ziwei Wang, Glenn Wagner, Kenji Watanabe, Takashi Taniguchi, Christian Schönenberger, S. A. Parameswaran, Steven H. Simon, Mitali Banerjee

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究发现扭曲三重层石墨烯中存在双穹超导性,通过电子掺杂和磁场调控揭示了非传统超导机制及相图特征。

Journal ref Nature Physics volume 21, pages 1773-1779 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18424 2026-03-20 eess.SY cs.CE cs.SY 50%

Deceiving Flexibility: A Stealthy False Data Injection Model in Vehicle-to-Grid Coordination

欺骗灵活性:车辆到电网协调中的隐蔽虚假数据注入模型

Kaan T. Gun, Xiaozhe Wang, Danial Jafarigiv

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出一种针对eSSM基于V2G协调的隐蔽虚假数据注入攻击,通过操控部分电动车的SoC和功率测量数据,欺骗运营商对车队灵活性的感知,从而逃避异常检测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18187 2026-03-20 quant-ph 50%

Towards spintronics via tunneling through asymmetric barriers

通过不对称势垒隧道实现自旋电子学

Elvira Bilokon, Valeriia Bilokon, Stanislava Litvinova, Denys I. Bondar, Andrii Sotnikov

专题命中 机器人操作 :manipulation(abstract)

AI总结 该研究展示了一种简单设置中可产生方向自旋电流的方法,通过在封闭链中引入不对称势垒几何结构,即使初始配置对称,也能产生自旋分辨的环形电流。

Comments 5 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01217 2026-03-20 physics.optics 50%

Dynamically tuneable helicity in twisted electromagnetic resonators

可调谐的螺旋度在扭曲电磁谐振器中

E. C. I. Paterson, J. Bourhill, M. E. Tobar, M. Goryachev

专题命中 机器人操作 :manipulation(abstract)

AI总结 通过控制几何扭曲引入镜像不对称性,实现微波腔体谐振器中电磁辐射的螺旋度生成,研究了螺旋度的产生机制及频率调谐方法。

Comments 11 pages, 12 figures

Journal ref Phys. Rev. A, 113, 033506, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身导航 14 篇

2603.12696 2026-03-20 cs.RO cs.CV 81%

HaltNav: Reactive Visual Halting over Lightweight Topological Priors for Robust Vision-Language Navigation

HaltNav: 基于轻量拓扑先验的反应式视觉停止用于鲁棒视觉-语言导航

Zihui Yu, Pingcong Li, Bichi Zhang, Sören Schwertfeger

机构 * SIST, ShanghaiTech University(上海科技大学信息与通信科学核心平台,上海科技大学) Key Laboratory of Intelligent Perception and Human-Machine Collaboration(智能感知与人机协同重点实验室)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 本文提出HaltNav框架,结合轻量拓扑先验与局部探索能力,通过反应式视觉停止机制提升视觉-语言导航的鲁棒性,实验表明其在复杂环境下的表现优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18443 2026-03-20 cs.CV 79%

SR-Nav: Spatial Relationships Matter for Zero-shot Object Goal Navigation

SR-Nav:空间关系对于零样本物体目标导航至关重要

Leyuan Fang, Zan Mao, Zijing Wang, Yinlong Yan

机构 * School of Artificial Intelligence and Robotics, Hunan University(湖南大学人工智能与机器人学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.CV

AI总结 SR-Nav通过建模观察和经验的空间关系,提升感知与规划能力,在HM3D实验中实现最先进的成功率和导航效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18210 2026-03-20 cs.RO 79%

GoalVLM: VLM-driven Object Goal Navigation for Multi-Agent System

GoalVLM: 多智能体系统中基于视觉语言模型的目标导航

MoniJesu James, Amir Atef Habel, Aleksey Fedoseev, Dzmitry Tsetserokou

机构 * Intelligent Space Robotics Laboratory(智能空间机器人实验室) Center for Digital Engineering(数字工程中心) Skolkovo Institute of Science and Technology(斯克尔科夫科学与技术研究所)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出GoalVLM,一种基于视觉语言模型的多智能体零样本开放词汇目标导航框架,通过整合SAM3和SpaceOM实现语义优先级探索,无需重新训练即可完成复杂目标导航任务。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01122 2026-03-20 cs.RO 79%

Fast Confidence-Aware Human Prediction via Hardware-accelerated Bayesian Inference for Safe Robot Navigation

通过硬件加速的贝叶斯推理实现快速置信度感知的人类预测以实现安全的机器人导航

Michael Lu, Minh Bui, Xubo Lyu, Mo Chen

机构 * School of Computing Science, Simon Fraser University(西蒙弗雷泽大学计算科学学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出一种基于GPU加速的贝叶斯推理方法,实现高效安全的人类行为预测,支持更精细的轨迹预测,通过实验证明机器人在动态环境中与人类共存的潜力。

Comments Update the paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18589 2026-03-20 cs.RO 70%

Benchmarking Visual Feature Representations for LiDAR-Inertial-Visual Odometry Under Challenging Conditions

在恶劣条件下对激光雷达-惯性-视觉里程计的视觉特征表示进行基准测试

Eunseon Choi, Junwoo Hong, Daehan Lee, Sanghyun Park, Hyunyoung Jo, Sunyoung Kim, Changho Kang, Seongsam Kim, Yonghan Jung, Jungwook Park, Seul Koo, Soohee Han

机构 * Department of Covergence IT Engineering, Pohang University of Science and Technology(POSTECH)(convergence IT工程系,POSTECH大学) School of Mechanical Engineering, Kunsan National University(机械工程学院,库山国立大学) Department of Artificial Intelligence and Robotics, Sejong University(人工智能与机器人系,世宗大学) Disaster Scientific Investigation Division Disaster Investigation Technology Team, National Disaster Management Research Institute, Ministry of the Interior and Safety(灾害科学调查 division 灾害调查技术团队,国家灾害管理研究所,内政与安全部) Department of Electrical Engineering, POSTECH(电气工程系,POSTECH大学)

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出一种混合方法,结合直接光度法和基于描述符的特征匹配,提升在恶劣条件下的视觉里程计性能。

Comments 14 pages, Publised IEEE Access2026

Journal ref E. Choi et al., "Benchmarking Visual Feature Representations for LiDAR-Inertial-Visual Odometry Under Challenging Conditions," in IEEE Access, vol. 14, pp. 30186-30199, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19137 2026-03-20 cs.CV cs.RO 62%

GSMem: 3D Gaussian Splatting as Persistent Spatial Memory for Zero-Shot Embodied Exploration and Reasoning

GSMem: 3D高斯溅射作为持久空间记忆用于零样本具身探索与推理

Yiren Lu, Yi Du, Disheng Liu, Yunlai Zhou, Chen Wang, Yu Yin

机构 * Case Western Reserve University(凯斯西储大学) Spatial AI & Robotics (SAIR) Lab, University at Buffalo(布法罗大学空间人工智能与机器人实验室)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 本文提出GSMem框架,利用3D高斯溅射构建持久空间记忆,解决具身探索中空间知识遗忘问题,通过检索机制与混合探索策略提升视觉语言模型推理效果。

Comments Project page at https://vulab-ai.github.io/GSMem/

详情

展开后加载摘要…

URL PDF HTML 收藏