arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-07-07 至 2026-07-07 共收录 71 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 1 篇

2602.07341 2026-07-07 cs.LG cs.RO 版本更新 84%

Scalable Dexterous Robot Learning with AR-based Remote Human-Robot Interactions

基于增强现实的远程人机交互实现可扩展的灵巧机器人学习

Yicheng Yang, Ruijiao Li, Lifeng Wang, Shuai Zheng, Shunzheng Ma, Keyu Zhang, Tuoyu Sun, Chenyun Dai, Jie Ding, Zhuo Zou

专题命中 机器人学习 :robot learning(title,abstract);manipulation(abstract);分类 cs.RO、cs.LG

AI总结 研究针对灵巧机器人手臂系统的可扩展学习,借助基于增强现实的远程人机交互收集数据。提出分两阶段的方法,先行为克隆预训练,后对比学习强化学习优化策略,提升效率与安全性,实验验证效果优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 22 篇

2512.06628 2026-07-07 cs.RO cs.CV 版本更新 92%

MIND-V: Hierarchical World Model for Long-Horizon Robotic Manipulation with RL-based Physical Alignment

MIND-V:基于强化学习物理对齐的长期机器人操作分层世界模型

Ruicheng Zhang, Mingyang Zhang, Jun Zhou, Xiaofan Liu, Zunnan Xu, Zhizhou Zhong, Puxin Yan, Haocheng Luo, Xiu Li

机构 * Tsinghua University(清华大学) X Square Robot(X Square机器人) Sun Yat-sen University(中山大学) HKUST(香港科技大学)

专题命中 机器人操作 :manipulation(title,abstract);world model(title,abstract);robotic(title,abstract);分类 cs.RO、cs.CV

AI总结 提出MIND-V分层世界模型,通过语义推理、行为语义桥接和运动视频生成,结合强化学习物理对齐,实现长期机器人操作视频的物理合理合成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08807 2026-07-07 cs.RO cs.LG 版本更新 90%

Humanoid Everyday: A Comprehensive Robotic Dataset for Open-World Humanoid Manipulation

Humanoid Everyday:面向开放世界人形机器人操作的综合机器人数据集

Zhenyu Zhao, Hongyi Jing, Xiawei Liu, Jiageng Mao, Abha Jha, Hanwen Yang, Rong Xue, Sergey Zakharov, Vitor Guizilini, Yue Wang

机构 * University of Southern California(南加州大学) Toyota Research Institute(丰田研究院)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);robot learning(abstract);分类 cs.RO、cs.LG

AI总结 提出Humanoid Everyday数据集,包含10.3k轨迹、260个任务的多模态数据,用于人形机器人灵巧操作、人机交互和移动操作研究,并配套云评估平台。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23087 2026-07-07 cs.RO 版本更新 88%

CoLA-Flow Policy: Temporally Coherent Imitation Learning via Continuous Latent Action Flow Matching for Robotic Manipulation

CoLA-Flow Policy: 通过连续潜在动作流匹配实现机器人操作的时序一致模仿学习

Wu Songwei, Jiang Zhiduo, Sun Wandong, Xie Guanghu, Zhao Rui, Liu Hong, Liu Yang

机构 * State Key Laboratory of Robotics and System, Harbin Institute of Technology(机器人系统国家重点实验室,哈尔滨工业大学) The University of Sydney(悉尼大学) Honor Device Co., Ltd.(荣耀设备有限公司)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 本文提出CoLA-Flow Policy,一种基于连续潜在动作空间的轨迹级模仿学习框架,通过学习显式的潜在空间流,解耦全局运动结构与低层控制噪声,从而实现平滑可靠的长时程执行,并结合几何感知点云条件和执行时多模态调节,提升现实环境的鲁棒性。

Comments 8 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30111 2026-07-07 cs.RO cs.AI cs.LG 版本更新 87%

Automating the Design of Embodied Agent Architectures

具身智能体架构设计的自动化

Jian Zhou, Sihao Lin, Jin Li, Shuai Fu, Gengze Zhou, Qi Wu

机构 * Australian Institute for Machine Learning, University of Adelaide, SA, Australia(澳大利亚机器学习研究所,阿德莱德大学,南澳大利亚州,澳大利亚)

专题命中 机器人操作 :embodied agent(title,abstract);manipulation(abstract);navigation(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 提出AgentCanvas运行时和KDLoop搜索过程,将架构搜索扩展到感知型具身智能体,在视觉-语言导航等任务上取得性能提升,但面临噪声、局部最优和信用分配等挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.16738 2026-07-07 cs.RO cs.AI 版本更新 84%

MOSAIC: Skill-Centric Manipulation Planning with Physics Simulation

MOSAIC:基于物理模拟的以技能为中心的操作规划

Itamar Mishani, Yorai Shaoul, Maxim Likhachev

机构 * Robotics Institute, School of Computer Science(机器人研究所、计算机科学学院)

专题命中 机器人操作 :manipulation(title,abstract);robotics(abstract,comments);分类 cs.RO、cs.AI

AI总结 研究用预定义技能规划长期操作运动的问题,核心方法是利用物理模拟估计技能执行结果,贡献是引入MOSAIC方法,通过两个互补技能家族有效发现基于物理的解决方案。

Comments Accepted for Publication at the 2026 IEEE International Conference on Robotics and Automation (ICRA). Project page: https://skill-mosaic.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16809 2026-07-07 cs.RO cs.AI 版本更新 84%

CABTO: Context-Aware Behavior Tree Grounding for Robot Manipulation

CABTO:面向机器人操作的上下文感知行为树接地

Yishuai Cai, Xinglin Chen, Yunxin Mao, Kun Hu, Yaodong Yang, Yuanpei Chen, Wenjing Yang, Ji Wang, Minglong Li

机构 * National University of Defense Technology(国防科技大学) PsiBot Peking University(北京大学) PKU-Psibot Lab(北京大学-PsiBot实验室)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 本文提出CABTO框架,通过预训练大模型和上下文反馈,自动构建完整且一致的行为树系统,解决机器人操作中行为树接地的复杂性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29936 2026-07-07 cs.RO 版本更新 83%

OpenSPM: An Environment-Transferable Robotic Key Spatial Pose Memory and Closed-Loop High-Frequency Flow-Matching Action Generation Model

OpenSPM:一种环境可迁移的机器人关键空间位姿记忆与闭环高频流匹配动作生成模型

Iok Tong Lei, Qingchen Xie, Yifan Wang, Yap Ying Jie, Zhidong Deng

专题命中 机器人操作 :robotic(title,abstract);manipulation(abstract);分类 cs.RO

AI总结 提出OpenSPM框架,通过空间位姿记忆和流匹配动作生成模型,实现开放环境桌面机器人操作的高频、精确控制,在LIBERO-GOAL任务中达到85.6%成功率和1033.3 Hz等效控制频率。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07866 2026-07-07 cs.RO cs.LG cs.SY eess.SY 版本更新 81%

Language-Guided Grasping under Partial Observation for Mobile Manipulation in Field Inspection and Maintenance

用于现场检查和维护中移动操作的部分观察下语言引导抓取

Dilermando Almeida, Juliano Negri, Guilherme Lazzarini, Thiago H. Segreto, Ranulfo Bezerra, Gustavo J. G. Lahr, Ricardo V. Godoy, Marcelo Becker

机构 * Department of Mechanical Engineering, Federal University of Uberlândia(联邦大学伯南迪利亚机械工程系) Department of Mechanical Engineering, University of São Paulo(圣保罗大学机械工程系) Graduate School of Information Sciences, Tohoku University(东北大学信息科学研究生院) Faculdade Israelita de Ensino e Pesquisa Albert Einstein, Hospital Israelita Albert Einstein(艾伯特·爱因斯坦以色列教学与研究学院,艾伯特·爱因斯坦医院)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO、cs.LG

AI总结 提出用于腿部移动操纵器在部分观察下的语言引导抓取流程,经多步骤处理,在四足机器人上实现并评估,相比基线提高抓取成功率,提升语言引导抓取可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07961 2026-07-07 cs.LG cs.CR cs.NI 版本更新 79%

Graph Representation Learning Augmented Model Manipulation on Federated Fine-Tuning of LLMs

图表示学习增强的模型操纵在联邦微调大型语言模型中的应用

Hanlin Cai, Kai Li, Houtianfu Wang, Haofan Dong, Yichen Li, Falko Dressler, Ozgur B. Akan

机构 * Centre for neXt Communications (CXC), Department of Engineering, University of Cambridge(下一代通讯中心(CXC),工程系,剑桥大学) Interdisciplinary Centre for Security, Reliability and Trust (SnT), University of Luxembourg(安全、可靠与信任跨学科中心(SnT),卢森堡大学) Telecommunication Networks group (TKN) at the School of Electrical Engineering and Computer Science, TU Berlin(电信网络组(TKN)位于电气工程与计算机科学学院,柏林技术大学) Center for neXt-Generation Communications (CXC), Department of Electrical and Electronics Engineering, Koç University(下一代通讯中心(CXC),电子与电气工程系,科克大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.LG

AI总结 本文提出AugMP策略,通过图表示学习框架和迭代操纵算法,增强对抗性更新的有效性和隐蔽性,实验表明其能显著降低全局LLM准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15061 2026-07-07 cs.RO cs.CV 版本更新 79%

Ask-to-Clarify: Resolving Instruction Ambiguity through Multi-turn Dialogue

Ask-to-Clarify: 通过多轮对话解决指令歧义

Xingyao Lin, Xinghao Zhu, Tianyi Lu, Guojin Zhong, Sicheng Xie, Hui Zhang, Xipeng Qiu, Zuxuan Wu, Yu-Gang Jiang

机构 * College of Computer Science and Artificial Intelligence, Fudan University, Shanghai, China(复旦大学计算机科学与人工智能学院) Shanghai Innovation Institute, Shanghai, China(上海创新研究院) Mechanical Systems Control Lab, UC Berkeley, California, USA(伯克利机械系统控制实验室)

专题命中 机器人操作 :robotics(abstract);embodied agent(abstract);manipulation(abstract);分类 cs.RO、cs.CV

AI总结 本文提出Ask-to-Clarify框架,通过多轮对话解决指令歧义问题,结合视觉语言模型和扩散模型,采用两阶段知识绝缘策略训练,实现多任务中更高效的协作式具身代理。

Comments Accepted by IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24589 2026-07-07 eess.AS cs.SD 版本更新 78%

YingMusic-Singer: Controllable Singing Voice Synthesis with Flexible Lyric Manipulation and Annotation-free Melody Guidance

YingMusic-Singer-Plus: 可控歌唱语音合成与灵活歌词操控及无标注旋律引导

Chunbo Hao, Junjie Zheng, Guobin Ma, Yuepeng Jiang, Huakang Chen, Wenjie Tian, Gongyu Chen, Zihao Chen, Lei Xie

机构 * AI Lab, GiantNetwork(巨人网络AI实验室)

专题命中 机器人操作 :manipulation(title,abstract)

AI总结 本文提出YingMusic-Singer-Plus,一种基于扩散模型的可控歌唱语音合成方法,支持灵活歌词操控和无标注旋律引导,优于现有基准模型。

Comments INTERSPEECH 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03283 2026-07-07 cs.CV 版本更新 77%

Utonia: Toward One Encoder for All Point Clouds

Utonia:迈向适用于所有点云的单一编码器

Yujia Zhang, Xiaoyang Wu, Yunhan Yang, Xianzhe Fan, Han Li, Yuechen Zhang, Zehao Huang, Naiyan Wang, Hengshuang Zhao

机构 * The University of Hong Kong(香港大学) The Chinese University of Hong Kong(香港中文大学) Xiaomi(小米)

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);robotic(abstract);分类 cs.CV

AI总结 研究旨在训练跨多领域的单自监督点变压器编码器Utonia,其能学习一致表征空间实现跨域转移,统一各领域点云,提升感知能力,还对具身和多模态推理有益,有望成为稀疏3D数据基础模型。

Comments produced by Pointcept, project page: https://pointcept.github.io/Utonia

Journal ref International Conference on Machine Learning 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03078 2026-07-07 cs.RO 版本更新 72%

3D Cal: An Open-Source Software Library for Depth Reconstruction on Vision-Based Tactile Sensors

3D Cal:用于基于视觉的触觉传感器深度重建的开源软件库

Rohan Kota, Kaival Shah, J. Edward Colgate, Gregory Reardon

机构 * McCormick School of Engineering, Center for Robotics and Biosystems, Northwestern University(麦科姆ick工程学院,机器人与生物系统中心,西北大学)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO;robotics(comments)

AI总结 介绍3D Cal开源库,将低成本3D打印机变为自动探测设备,为校准基于视觉的触觉传感器生成大量标记训练数据,还提供端到端管道训练自定义卷积网络进行深度重建,给出校准准则并展示良好性能。

Comments Accepted for publication in IEEE Robotics and Automation Letters (RA-L). Project page: https://rohankotanu.github.io/3DCal/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06941 2026-07-07 cs.LG cs.AI cs.CL 版本更新 62%

Endogenous Resistance to Activation Steering in Language Models

语言模型中激活引导的内生抵抗

Alex McKenzie, Keenan Pepper, Stijn Servaes, Martin Leitgab, Murat Cubuktepe, Mike Vaiana, Diogo de Lucena, Judd Rosenblatt, Michael S. A. Graziano

机构 * University of Washington(华盛顿大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI、cs.LG

AI总结 研究发现大型语言模型在任务不匹配的激活引导下能内生抵抗,通过显式重启恢复正确生成,并识别出相关稀疏自编码器潜在变量,可增强或削弱该抵抗。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08521 2026-07-07 cs.CV cs.AI 版本更新 62%

VISOR: Visual Input-based Steering for Output Redirection in Vision-Language Models

VISOR:视觉语言模型中用于输出重定向的基于视觉输入的转向

Mansi Phute, Ravikumar Balakrishnan

机构 * Georgia Institute of Technology(佐治亚理工学院) HiddenLayer, Inc(HiddenLayer公司)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI、cs.CV

AI总结 研究提出VISOR方法,通过优化视觉输入实现对视觉语言模型行为的精细控制,在关键对齐任务中验证其有效性,且具有低开销等优势,但也揭示了视觉通道安全漏洞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04356 2026-07-07 cs.CV 版本更新 57%

Stage-wise Attention-Guided Region Sequencing for Adversarial Attacks on Large Vision-Language Models

用于对大型视觉语言模型进行对抗攻击的逐阶段注意力引导区域排序

Jaehyun Kwak, Nam Cao, Boryeong Cho, Segyu Lee, Sumyeong Ahn, Se-Young Yun

机构 * KAIST(韩国科学技术院) KENTECH(KENTECH研究院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 研究针对大型视觉语言模型的有针对性对抗攻击,基于注意力分析提出逐阶段注意力引导区域排序,介绍了黑盒区域排序框架SAGA,在多个模型上取得了最先进的攻击成功率和最佳不可感知性。

Comments Pre-print

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19098 2026-07-07 cs.GT cs.CY 版本更新 50%

Desirable Effort Fairness and Optimality Trade-offs in Strategic Learning

战略学习中理想的努力公平性与最优性权衡

Valia Efthymiou, Ekaterina Fedorova, Chara Podimata

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究战略学习中决策规则与策略性适应特征的主体间的互动,将问题构建为约束优化问题,给出理论保证并通过实验展示准确性与理想努力公平性间的权衡。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16493 2026-07-07 cond-mat.str-el cond-mat.mtrl-sci 版本更新 50%

Dynamics of a jointly commensurate moiré charge density wave

莫尔电荷序超晶格中的联合公度性驱动剪切拓扑缺陷

Kyoung Hun Oh, Yifan Su, Honglie Ning, B. Q. Lv, Alfred Zong, Dong Wu, Qiaomei Liu, Gyeongbo Kang, Hyeongi Choi, Hyun-Woo J. Kim, Seunghyeok Ha, Jaehwon Kim, Suchismita Sarker, Jacob P. C. Ruff, Xiaozhe Shen, Duan Luo, Stephen Weathersby, Patrick Kramer, Xinxin Cheng, Dongsung Choi, Doron Azoury, Masataka Mogi, B. J. Kim, N. L. Wang, Hoyoung Jang, Nuh Gedik

专题命中 机器人操作 :manipulation(abstract)

AI总结 通过时间分辨衍射和光谱技术研究EuTe₄中光致电荷密度波动力学,发现联合公度CDW的振幅快速猝灭而相位涨落缓慢演化,并揭示了沿波矢垂直方向形成的剪切型拓扑缺陷。

Comments 24 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12693 2026-07-07 econ.EM stat.ME 版本更新 50%

Placebo Discontinuity Design

安慰剂断点设计

Rahul Singh, Moses Stewart

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究在标准回归断点设计连续性假设因运行变量被策略性操纵而违反时,利用安慰剂治疗和结果识别治疗效果,引入局部工具变量估计器并证明其一致性及推断程序合理性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10058 2026-07-07 physics.optics 版本更新 50%

Hopping of nanoparticles in optical tweezers governed by Mie resonances

由米氏共振控制的光镊中纳米颗粒的跳跃

Ivan Toftul, Libang Mao, Sivacarendran Balendhran, Mohammad Taha, Yuri Kivshar, Sergey Kruk

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究光镊中纳米颗粒动力学,利用波长尺度颗粒支持的高阶米氏共振,在单高斯光束光镊中实现复杂颗粒动力学,揭示其为复杂光力内在机制,建立米氏共振纳米光子学平台。

Comments 7 figures, 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08152 2026-07-07 cs.SI cs.CY 版本更新 50%

Dynamics of collective minds in online communities

在线社区中集体思维的动态变化

Seungwoong Ha, Henrik Olsson, Kresimir Jaksic, Max Pellert, Mirta Galesic

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究在线社区集体思维受编辑实践和社区动态影响,通过计算模型结合多平台数据及调查来理解其塑造机制,发现部分影响可快速逆转,部分则持久改变集体思维,为避免操纵提供思路。

Comments 80 pages,21 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16285 2026-07-07 cond-mat.mtrl-sci physics.optics 版本更新 50%

Polarization of photoluminescence by optically driven orbital reconstruction in magnetically ordered CrCl3

通过磁有序CrCl3中光驱动的轨道重构实现光致发光的极化

Lanqing Zhou, Marjana Ležaić, Yuriy Mokrousov, Minh N. Bui, Renu Rani, Govind Ummethala, Amir H. Tavabi, Tatiana E. Gorelik, Rafal E. Dunin-Borkowski, Detlev Grützmacher, Beata E. Kardynał

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究通过极化分辨光致发光光谱和密度泛函理论计算,探究块状绝缘反铁磁CrCl3中受激Cr3+离子,发现光致发光极化与CrCl3磁态有关,为Cr3+离子激发态电子结构提供见解。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身导航 18 篇

2511.17384 2026-07-07 cs.RO cs.CV 版本更新 88%

IndustryNav: Exploring Spatial Reasoning of Embodied Agents in Dynamic Industrial Navigation

IndustryNav:探索动态工业导航中具身智能体的空间推理

Yifan Li, Lichi Li, Anh Dao, Xinyu Zhou, Wenjun Huang, Tianyi Ma, Yicheng Qiao, Zheda Mai, Daeun Lee, Zichen Chen, Pan Wang, Lehan Yang, Tianlong Wang, Zhen Tan, Sheng Li, Mohit Bansal, Yang Ni, Yu Kong

机构 * Michigan State University(密歇根州立大学) Independent Researcher(独立研究者) University of California, Irvine(加州大学尔湾分校) Ohio State University(俄亥俄州立大学) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) University of California, Santa Barbara(加州大学圣巴巴拉分校) University of Pittsburgh(匹兹堡大学) University of Virginia(弗吉尼亚大学) Arizona State University(亚利桑那州立大学) Purdue University Northwest(普渡大学西北分校)

专题命中 具身导航 :embodied agent(title,abstract);navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 针对视觉大语言模型在空间推理的挑战,提出IndustryNav基准,利用动态工业场景评估,给出零样本导航管道及安全指标,研究发现模型在路径规划等方面有缺陷,凸显向主动探索等任务发展的需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14401 2026-07-07 cs.CV cs.AI 版本更新 87%

pFedNavi: Structure-Aware Personalized Federated Vision-Language Navigation for Embodied AI

pFedNavi:用于具身人工智能的结构感知个性化联邦视觉语言导航

Qingqian Yang, Hao Wang, Sai Qian Zhang, Jian Li, Yang Hua, Miao Pan, Tao Song, Zhengwei Qi, Haibing Guan

机构 * Openmind (Wuhu) Intelligent Robot Co., Ltd.(Openmind(芜湖)智能机器人有限公司) Shanghai Key Laboratory of Scalable Computing and Systems(上海可扩展计算与系统重点实验室) National Natural Science Foundation of China(国家自然科学基金委员会) US National Science Foundation(美国国家科学基金会)

专题命中 具身导航 :navigation(title,abstract);embodied AI(title);分类 cs.AI、cs.CV

AI总结 视觉语言导航需大量私有室内环境轨迹数据,存在隐私问题。本文提出针对视觉语言导航的结构感知个性化联邦学习框架pFedNavi,通过自适应确定特定客户端层并进行细粒度参数融合平衡全局知识与局部特性,性能优于基线。

Comments Accepted by the IEEE INFOCOM 2026 Workshop on Emerging Intelligent Networks (EIN)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10210 2026-07-07 cs.RO cs.CV 版本更新 84%

Nano-U: Efficient Terrain Segmentation for Tiny Robot Navigation

Nano-U:用于微型机器人导航的高效地形分割

Federico Pizzolato, Francesco Pasti, Nicola Bellotto

机构 * Dept of Information Engineering, University of Padua(信息工程系,帕多瓦大学)

专题命中 具身导航 :navigation(title);robotic(abstract,comments);robotics(abstract);分类 cs.RO、cs.CV

AI总结 本文提出Nano-U框架,通过量化感知蒸馏实现低功耗微型机器人高效地形分割,适用于Botanic Garden和TinyAgri数据集。

Comments Code repository: https://github.com/federico-pizz/Nano-U Accepted at Towards Autonomous Robotic Systems (TAROS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16806 2026-07-07 cs.AI cs.RO 版本更新 84%

Insect-inspired Visual Point-goal Navigation

一种高效的昆虫启发式方法用于视觉点目标导航

Yihe Lu, Barbara Webb

机构 * School of Informatics, University of Edinburgh(爱丁堡大学信息学院)

专题命中 具身导航 :navigation(title,abstract);embodied AI(abstract);分类 cs.RO、cs.AI

AI总结 本文提出了一种基于昆虫大脑结构的新型视觉点目标导航模型,通过模拟昆虫的联想学习和路径整合能力,实现高效导航。

Comments This work has been submitted for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26946 2026-07-07 cs.CV cs.RO 版本更新 81%

Three-Step Nav: A Hierarchical Global-Local Planner for Zero-Shot Vision-and-Language Navigation

三步导航:一种用于零样本视觉-语言导航的分层全局-局部规划器

Wanrong Zheng, Yunhao Ge, Laurent Itti

机构 * University of Southern California(南加州大学) NVIDIA Research(NVIDIA研究)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 本文提出三步导航方法,通过全局-局部分层规划解决零样本视觉-语言导航中的漂移和低成功率问题,无需梯度更新或微调,实现最先进的性能。

Comments Accepted to AISTATS 2026. Code: https://github.com/ZoeyZheng0/3-step-Nav

Journal ref Proceedings of the 29th International Conference on Artificial Intelligence and Statistics (AISTATS), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06921 2026-07-07 cs.RO cs.LG cs.SY eess.SY 版本更新 81%

CN-CBF: Composite Neural Control Barrier Function for Robot Navigation in Dynamic Environments

CN-CBF:动态环境中机器人导航的复合神经控制障碍函数

Bojan Derajić, Sebastian Bernhard, Wolfgang Hönig

机构 * Technical University of Berlin(柏林技术大学) AUMOVIO Robotics Institute Germany (RIG)(德国机器人研究所(RIG))

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.LG

AI总结 针对自主机器人在动态环境下安全导航难题,提出复合神经控制障碍函数设计方法。利用复合CBF,结合离线数据训练单个CBF近似安全集,用残差神经架构确保安全集与失效集不相交,实验验证该方法有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01251 2026-07-07 cs.RO 版本更新 80%

Towards Data-Driven Metrics for Social Robot Navigation Benchmarking

迈向用于社交机器人导航基准测试的数据驱动指标

Pilar Bachiller-Burgos, Ulysses Bernardet, Luis V. Calderita, Pranup Chhetri, Anthony Francis, Noriaki Hirose, Noé Pérez, Dhruv Shah, Phani T. Singamaneni, Xuesu Xiao, Luis J. Manso

机构 * Aston University(阿斯顿大学) Logical Robotics(逻辑机器人公司) University of California Berkeley(加州大学伯克利分校) TOYOTA Motor North America(丰田北美公司) Princeton University(普林斯顿大学) LAAS-CNRS(LAAS-CNRS研究所) George Mason University(乔治·梅森大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO;robotics(comments)

AI总结 致力于开发数据驱动的社交机器人导航指标以促进地面机器人基准测试和策略优化,介绍方法动机、数据集格式等,给出首个全面的学习社交机器人导航指标及相关结果。

Comments This work was presented at the 18th International Conference on Social Robotics (ICSR'2026)

详情

展开后加载摘要…

URL PDF HTML 收藏