arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-04-02 至 2026-04-02 共收录 68 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 1 篇

2603.11558 2026-04-02 cs.RO cs.AI 87%

RoboClaw: An Agentic Framework for Scalable Long-Horizon Robotic Tasks

RoboClaw:一个用于可扩展长周期机器人任务的代理框架

Ruiying Li, Yunlang Zhou, YuYao Zhu, Kylin Chen, Jingyuan Wang, Sukai Wang, Kongtao Hu, Minhui Yu, Bowen Jiang, Zhan Su, Jiayao Ma, Xin He, Yongjian Shen, Yang Yang, Guanghui Ren, Maoqing Yao, Wenhao Wang, Yao Mu

机构 * AgiBot National University of Singapore(新加坡国立大学) Shanghai Jiao Tong University(上海交通大学) MoE Key Lab of Artificial Intelligence, AI Institute, SJTU(上海交通大学人工智能研究院教育部人工智能重点实验室)

专题命中 机器人学习 :robotic(title,abstract);robotics(abstract,comments);manipulation(abstract);分类 cs.RO、cs.AI

AI总结 RoboClaw通过统一数据收集、策略学习和任务执行,提高长周期机器人任务的稳定性和可扩展性,减少人工干预,提升多策略鲁棒性。

Comments Code available at: https://github.com/RoboClaw-Robotics/RoboClaw

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 20 篇

2604.01142 2026-04-02 cs.RO cs.LG 88%

Deep Reinforcement Learning for Robotic Manipulation under Distribution Shift with Bounded Extremum Seeking

在分布偏移下用于机械臂操作的深度强化学习与有界极值搜索

Shaifalee Saxena, Rafael Fierro, Alexander Scheinker

机构 * University of New Mexico(新墨西哥大学) Los Alamos National Lab(洛斯阿拉莫斯国家实验室)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO、cs.LG

AI总结 本文提出结合深度确定性策略梯度与有界极值搜索的混合控制器,提升机械臂在分布偏移下的鲁棒性,通过时间变化目标和摩擦不均等场景验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00971 2026-04-02 cs.RO 79%

An Integrated Soft Robotic System for Measuring Vital Signs in Search and Rescue Environments

一种集成式软机器人系统用于灾难救援环境中生命体征的测量

Jorge Francisco García-Samartín, Christyan Cruz Ulloa, Andrés Sánchez-Silva, Jaime del Cerro, Antonio Barrientos

专题命中 机器人操作 :robotic(title,abstract);分类 cs.RO

AI总结 本文设计了一种软夹具并集成到移动机器人系统中,用于测量灾后环境中受害者的脉搏和血压,通过不同信号处理算法实现了4 bpm的脉搏偏差和约5 mmHg的血压偏差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10394 2026-04-02 cs.RO cs.LG 76%

RoboNeuron: A Middle-Layer Infrastructure for Agent-Driven Orchestration in Embodied AI

RoboNeuron:面向具身AI的代理驱动编排中层基础设施

Weifan Guan, Qinghao Hu, Huasen Xi, Chenxiao Zhang, Aosheng Li, Jian Cheng

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) AiRiA MAICRO

专题命中 机器人操作 :embodied AI(title);分类 cs.RO、cs.LG

AI总结 本文提出RoboNeuron中层框架,解决视觉-语言-动作模型与机器人中间件间的接口不匹配问题,通过统一执行抽象实现模块化编排与后端切换。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00452 2026-04-02 cs.CV 74%

Out of Sight, Out of Track: Adversarial Attacks on Propagation-based Multi-Object Trackers via Query State Manipulation

视而不见,失之跟踪:通过查询状态操控对基于传播的多目标跟踪器进行对抗攻击

Halima Bouzidi, Haoyu Liu, Yonatan Gizachew Achamyeleh, Praneetsai Vasu Iddamsetty, Mohammad Abdullah Al Faruque

机构 * University of California, Irvine(加利福尼亚大学尔湾分校)

专题命中 机器人操作 :manipulation(title);分类 cs.CV

AI总结 本文提出FADE框架,通过操控查询状态攻击基于传播的多目标跟踪器,导致身份切换和跟踪终止。

Comments Accepted for presentation at CVPR 2026 (main track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08545 2026-04-02 cs.CL cs.AI cs.CV cs.MA 73%

Curriculum Guided Massive Multi Agent System Solving For Robust Long Horizon Tasks

课程引导的大规模多智能体系统解决稳健长周期任务

Indrajit Kar, Kalathur Chenchu Kishore Kumar

机构 * Wipro Innovation Networks(威普罗创新网络)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.AI、cs.CV

AI总结 本文提出一种分层多智能体架构,通过空间课程逐步扩展网格区域,使智能体先掌握中央任务再处理外围任务,提升长周期任务的稳定性和推理能力。

Comments 22 pages, 2 tables, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00744 2026-04-02 cs.RO 72%

How to Train your Tactile Model: Tactile Perception with Multi-fingered Robot Hands

如何训练你的触觉模型:多指机械手的触觉感知

Christopher J. Ford, Kaichen Shi, Laura Butcher, Nathan F. Lepora, Efi Psomopoulou

机构 * Bristol Robotics Laboratory, University of Bristol(布里斯托大学布里斯托机器人实验室)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO;robotics(comments)

AI总结 本文提出TacViT模型,基于视觉Transformer实现触觉感知,能有效泛化新传感器数据,减少数据收集和重训练需求,提升多指机械手的触觉感知能力。

Comments Accepted for publication at the International Conference on Robotics and Automation (ICRA) 2026, Vienna

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00738 2026-04-02 cs.RO 72%

SoftHand Model-W: A 3D-Printed, Anthropomorphic, Underactuated Robot Hand with Integrated Wrist and Carpal Tunnel

SoftHand Model-W: 一种3D打印的拟人化欠驱动机器人手,集成腕关节和腕管机制

Dhillon B. Merritt, Christopher J. Ford, Haoran Li, Malia Smith, Zhixing Chen, Efi Psomopoulou, Nathan F. Lepora

机构 * Bristol Robotics Laboratory, University of Bristol(布里斯托大学布里斯托机器人实验室)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO;robotics(comments)

AI总结 SoftHand Model-W通过集成腕关节和腕管机制,实现了五指主动屈伸及掌部主动屈伸和桡侧/尺侧偏移,展示了近端自由度在现实机器人应用中实现多样化、类人操作的关键作用。

Comments Accepted for publication at the International Conference of Robotics and Automation (ICRA) 2026, Vienna

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01224 2026-04-02 cs.RO 70%

Functional Force-Aware Retargeting from Virtual Human Demos to Soft Robot Policies

功能导向的软机器人策略的虚拟人演示重定向

Uksang Yoo, Mengjia Zhu, Evan Pezent, Jom Preechayasomboon, Jean Oh, Jeffrey Ichnowski, Amir Memar, Ben Abbatematteo, Homanga Bharadhwaj, Ashish Deshpande, Harsha Prahlad

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出SoftAct框架,通过显式考虑接触力来教软机器人手执行类人操作技能。采用虚拟现实技术捕获丰富的示范数据,结合两阶段力感知重定向算法,实现力平衡映射和实时接触优化,提升软机器人在复杂任务中的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02768 2026-04-02 cs.RO cs.SY eess.SY 70%

Geometric Visual Servo Via Optimal Transport

通过最优传输的几何视觉伺服

Ethan Canzini, Simon Pope, Ashutosh Tiwari

机构 * University of Sheffield(谢菲尔德大学) Airbus UK(空客英国)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出基于最优传输的几何控制律,结合PD控制与重力补偿,实现机器人机械臂的位姿和图像视觉伺服控制。

Comments 19 pages, 5 figures. Accepted to Control Engineering Practice

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00202 2026-04-02 cs.RO 70%

DreamControl-v2: Simpler and Scalable Autonomous Humanoid Skills via Trainable Guided Diffusion Priors

DreamControl-v2:通过可训练引导扩散先验实现更简单且可扩展的自主人形技能

Sudarshan Harithas, Sangkyung Kwak, Pushkal Katara, Srujan Deolasee, Dvij Kalaria, Srinath Sridhar, Sai Vemprala, Ashish Kapoor, Jonathan Chung-Kuan Huang

机构 * General Robotics, USA(美国通用机器人公司) Brown University, USA(美国布朗大学) University of California, Berkeley, USA(美国加州大学伯克利分校)

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);分类 cs.RO

AI总结 本文提出改进的DreamControl框架,通过在人形机器人运动空间中训练引导扩散模型,整合多样化的人类和机器人数据集,提升技能范围和自动化程度,验证了生成参考轨迹的扩展性对下游RL策略的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00496 2026-04-02 eess.SY cs.SY 69%

The QuadSoft: Design, Construction, and Experimental Validation of a Soft and Actuated Quadrotor

QuadSoft:一种软体和驱动四旋翼的设计、构造与实验验证

Rodolfo Verdin, Hugo Moreno, Mark W. Spong, Gerardo Flores

专题命中 机器人操作 :robotics(abstract,comments);robotic(abstract)

AI总结 本文提出QuadSoft,一种具有连续曲率腱驱动软体机械臂的全驱动四旋翼,通过半刚性中央框架与柔性臂的结合,实现飞行中可控结构重构。实验验证了其在户外稳定飞行、悬停、方向操控和降落的能力,展示了软体机械臂在保持高度的同时可产生水平位移。

Comments Accepted for publication in the IEEE International Conference on Robotics and Automation (ICRA 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00890 2026-04-02 cs.AI cs.CL cs.CV 62%

Beyond Symbolic Solving: Multi Chain-of-Thought Voting for Geometric Reasoning in Large Language Models

超越符号求解:用于大语言模型几何推理的多链式思维投票

Md. Abu Bakor Siddique, Shahrin Hossain, Sadman Ahmed Siam, Syed Rifat Raiyan, Hasan Mahmud, Md Kamrul Hasan

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI、cs.CV

AI总结 本文提出MARS-GPS方法,通过生成多个并行推理流程并结合Python代码执行,利用熵值进行排序并多阶段投票,提升大语言模型在几何推理中的性能,实验显示其在Geometry3K数据集上达到88.8%的准确率,比现有最佳水平提升11%。

Comments Under review, 4 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00267 2026-04-02 cs.CV 57%

ActErase: A Training-Free Paradigm for Precise Concept Erasure via Activation Redirection

ActErase: 一种无需训练的概念擦除范式通过激活重定向

Yi Sun, Xinhao Zhong, Hongyan Li, Yimin Zhou, Junhao Li, Bin Chen, Xuan Wang

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Peng Cheng Laboratory(鹏城实验室)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 本文提出无需训练的概念擦除方法ActErase,通过激活差异区域分析和动态替换输入激活,实现高效概念擦除,同时保持模型生成能力,且具有对抗攻击鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00281 2026-04-02 cs.AI 57%

Human-in-the-Loop Control of Objective Drift in LLM-Assisted Computer Science Education

人机协同控制LLM辅助计算机科学教育中的目标漂移

Mark Dranias, Adam Whitley

机构 * Asheville Institute for Memory and Longevity(阿什维尔记忆与长寿研究所) University of North Carolina Asheville(北卡罗来纳大学阿什维尔分校)

专题命中 机器人操作 :world model(abstract);分类 cs.AI

AI总结 本文提出一种人机协同的教学方法,通过分离规划与执行,训练学生在代码生成前指定接受标准和架构约束,以稳定AI辅助学习过程。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00009 2026-04-02 cs.CL cs.AI 57%

Eyla: Toward an Identity-Anchored LLM Architecture with Integrated Biological Priors -- Vision, Implementation Attempt, and Lessons from AI-Assisted Development

Eyla:迈向具有集成生物先验的LLM架构——视觉、实现尝试及AI辅助开发的教训

Arif Aditto

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 Eyla提出一种以身份为基础的LLM架构,整合生物启发子系统,通过AI辅助开发的失败分析,揭示了AI辅助软件工程中的系统性失效模式。

Comments 8 pages, 3 tables, 25 references. Preprint under review for workshop submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00629 2026-04-02 cond-mat.mtrl-sci 50%

Strain-tunable multipiezo effects in Janus monolayer Cr2SSe: Selective reversal of valley polarization and single-spin-channel anomalous valley Hall effect

应变可调的Janus单层Cr2SSe中的多铁电效应:谷极化选择反转和单自旋通道异常谷Hall效应

Quan Shen, Jianing Tan, Tao Yao, Wenhu Liao, Jiansheng Dong

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究通过第一性原理计算揭示Janus单层Cr2SSe中应变可调的多铁电效应,展示谷极化反转与单自旋通道异常谷Hall效应,为低功耗谷度自由度操控提供理论基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22721 2026-04-02 cs.DB cs.CL 50%

Replacing Multi-Step Assembly of Data Preparation Pipelines with One-Step LLM Pipeline Generation for Table QA

用单步LLM管道生成替代数据准备流水线的多步组装

Fengyu Li, Junhao Zhu, Kaishi Song, Lu Chen, Zhongming Yao, Tianyi Li, Christian S. Jensen

机构 * Zhejiang University(浙江大学) Northeastern University(东北大学) Aalborg University(奥尔堡大学)

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出Operation-R1框架,通过强化学习训练轻量LLM生成高质量表格问答数据准备流水线,实现单步推理,提升准确率并降低计算成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00323 2026-04-02 cs.CL cs.CY 50%

Large Language Models in the Abuse Detection Pipeline

大语言模型在滥用检测流水线中的应用

Suraj Kath, Sanket Badhe, Preet Shah, Ashwin Sampathkumar, Shivani Gupta

机构 * Google LLC(谷歌有限责任公司)

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文探讨大语言模型在滥用检测生命周期中的应用,分析其在标签生成、检测、审核及审计等阶段的作用,并讨论其面临的挑战与未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00312 2026-04-02 cs.HC 50%

Physically-intuitive Privacy and Security: A Design Paradigm for Building User Trust in Smart Sensing Environments

物理直观的隐私与安全:构建智能传感环境用户信任的设计范式

Youngwook Do, Yuxi Wu, Gregory D. Abowd, Sauvik Das

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出物理直观隐私与安全(PIPS)设计范式,通过物理操作、可感知保证和意图对齐的传感器控制提升用户信任,展示了三个案例研究以验证其有效性。

Comments 18 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21023 2026-04-02 physics.optics 50%

Valley-dependent emission patterns enabled by plasmonic nanoantennas

通过等离子体纳米天线实现谷依赖的发射模式

Tobias Bucher, Jingshi Yan, Jan Sperrhake, Zlata Fedorova, Mostafa Abasifard, Rajeshkumar Mupparapu, Haitao Chen, Emad Najafidehaghani, Khosro Zangeneh Kamali, Antony George, Mohsen Rahmani, Thomas Pertsch, Andrey Turchanin, Dragomir N. Neshev, Isabelle Staude

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究通过等离子体纳米天线调控单层过渡金属二硫化物中谷极化激子的发射模式,实现谷极化发光的精确控制,为谷电子学和量子信息器件提供新平台。

Comments 38 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身导航 18 篇

2603.19660 2026-04-02 cs.CV cs.SD 83%

Semantic Audio-Visual Navigation in Continuous Environments

语义音频视觉导航在连续环境中

Yichen Zeng, Hebaixu Wang, Meng Liu, Yu Zhou, Chen Gao, Kehan Chen, Gongping Huang

机构 * Wuhan University(武汉大学) Zhongguancun Academy(中关村学院) Shandong Jianzhu University(山东建筑大学) Nankai University(南开大学) Tsinghua University(清华大学) CASIA(中国科学院自动化研究所) UCAS(中国科学院大学)

专题命中 具身导航 :navigation(title,abstract);embodied agent(abstract);分类 cs.CV

AI总结 本文提出MAGNet模型,通过多模态Transformer实现语义目标推理,提升在连续空间中导航的鲁棒性与成功率。

Comments This paper has been accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24212 2026-04-02 cs.RO cs.CV 81%

RANGER: A Monocular Zero-Shot Semantic Navigation Framework through Visual Contextual Adaptation

RANGER:通过视觉上下文适应的单目零样本语义导航框架

Ming-Ming Yu, Yi Chen, Börje F. Karlsson, Wenjun Wu

机构 * Beihang University(北京航空航天大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Hangzhou International Innovation Institute, Beihang University(北京航空航天大学杭州国际创新研究院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 RANGER通过视觉上下文学习实现零样本语义导航,无需依赖深度和姿态信息,利用3D基础模型和视觉语言模型提升任务效率与环境适应性。

Comments Accepted at ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01213 2026-04-02 cs.RO cs.MA 79%

Collaborative Task and Path Planning for Heterogeneous Robotic Teams using Multi-Agent PPO

异构机器人团队协同任务与路径规划的多智能体PPO方法

Matthias Rubio, Julia Richter, Hendrik Kolvenbach, Marco Hutter

机构 * Robotic Systems Lab (RSL), ETH Zürich(苏黎世联邦理工学院机器人系统实验室(RSL))

专题命中 具身导航 :robotic(title,abstract);分类 cs.RO

AI总结 本文提出基于多智能体PPO的协同规划策略,用于解决复杂的目标分配与调度问题,通过对比穷举搜索得到的单目标最优解,评估其在行星探索场景中的在线重规划能力。

Comments 8 pages, 3 figures, associated code on https://github.com/leggedrobotics/multi_robot_global_planner

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00416 2026-04-02 cs.RO cs.AI cs.CV cs.LG 79%

Learning Humanoid Navigation from Human Data

从人类数据学习人形导航

Weizhuo Wang, Yanjie Ze, C. Karen Liu, Monroe Kennedy

机构 * Stanford University(斯坦福大学)

专题命中 具身导航 :navigation(title);分类 cs.RO、cs.AI、cs.CV

AI总结 本文提出EgoNav系统,通过5小时人类行走数据训练人形机器人自主导航,无需机器人数据或微调。采用扩散模型预测未来轨迹分布,结合360度视觉记忆与DINOv3骨干网络,实现实时推理与路径选择,验证了在未知环境中避障和多模态覆盖的优越性。

Comments 8 pages 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00343 2026-04-02 cs.RO 79%

Real Time Local Wind Inference for Robust Autonomous Navigation

实时局部风场推断用于稳健自主导航

Spencer Folk

机构 * University of Pennsylvania(宾夕法尼亚大学) NASA Ames Research Center(美国国家航空航天局艾姆斯研究中心)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文通过融合距离测量与稀疏实地风测数据,实现实时风场推断,解决密集城市环境中地形数据的充分性及学习风模型在运动规划中的应用,提升自主导航的能耗效率与避障能力。

Comments PhD Thesis, University of Pennsylvania, 2026. 152 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00162 2026-04-02 cs.RO 79%

Long-Horizon Geometry-Aware Navigation among Polytopes via MILP-MPC and Minkowski-Based CBFs

基于MILP-MPC和Minkowski基础CBF的多面体间长周期几何感知导航

Yi-Hsuan Chen, Salman Ghori, Ania Adil, Eric Feron, Calin Belta

机构 * University of Maryland, College Park(马里兰大学帕克分校) KAUST(阿卜杜拉国王科技大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出一种分层规划控制框架,结合MILP-MPC生成轨迹并利用Minkowski差空间的符号距离CBF确保几何安全,实验证明在复杂环境中实现安全实时导航。

Comments 8 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00059 2026-04-02 cs.RO 79%

MRReP: Mixed Reality-based Hand-drawn Reference Path Editing Interface for Mobile Robot Navigation

MRReP:基于混合现实的手绘参考路径编辑界面用于移动机器人导航

Takumi Taki, Masato Kobayashi, Yuki Uranishi

机构 * Graduate School of Information Science and Technology, The University of Osaka(大阪大学信息科学与技术研究生院) D3 Center, The University of Osaka(大阪大学D3中心) Graduate School of Maritime Sciences, Kobe University(神户大学海事科学研究生院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出MRReP,一种基于混合现实的手绘参考路径编辑界面,通过手势直接在物理地板上绘制路径,提升移动机器人导航中的路径规划精度与用户体验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00892 2026-04-02 cs.CL 78%

When Users Change Their Mind: Evaluating Interruptible Agents in Long-Horizon Web Navigation

当用户改变主意:在长周期网络导航中评估可中断代理

Henry Peng Zou, Chunyu Miao, Wei-Chieh Huang, Yankai Chen, Yue Zhou, Hanrong Zhang, Yaozu Wu, Liancheng Fang, Zhengyao Gu, Zhen Zhang, Kening Zheng, Fangxin Wang, Yi Nian, Shanghao Li, Wenzhe Fan, Langzhou He, Weizhi Zhang, Xue Liu, Philip S. Yu

机构 * University of Illinois Chicago(伊利诺伊大学芝加哥分校) McGill University(麦吉尔大学) MBZUAI(穆罕默德·本·扎耶德人工智能大学) University of California Santa Barbara(加州大学圣塔芭芭拉分校) University of Southern California(南加州大学)

专题命中 具身导航 :navigation(title,abstract)

AI总结 本文首次系统研究长周期环境感知网络导航中可中断代理的表现,通过InterruptBench基准测试六种强大LLM,在单轮和多轮中断设置中分析其适应性和恢复效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16483 2026-04-02 cs.CV 72%

Octree Diffusion for Semantic Scene Generation and Completion

八叉树扩散用于语义场景生成与补全

Xujia Zhang, Brendan Crowe, Christoffer Heckman

机构 * University of Colorado Boulder(科罗拉多大学博尔德分校) Autonomous Robotics and Perception Group(自主机器人与感知实验室)

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.CV;robotics(journal_ref)

AI总结 本文提出Octree Latent Semantic Diffusion框架,通过八叉树隐式表示实现跨域的3D语义场景补全、扩展和生成,结合结构扩散与语义扩散生成语义标签,无需重训练即可完成单扫描的补全与零样本泛化。

Comments Accepted to ICRA 2026. Revised version with updated paragraphs

Journal ref Proceedings of the 2026 IEEE International Conference on Robotics and Automation (ICRA)

详情

展开后加载摘要…

URL PDF HTML 收藏