arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-07-22 至 2026-07-22 共收录 85 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 2 篇

2209.15428 2026-07-22 cs.RO 87%

PyPose: A Library for Robot Learning with Physics-based Optimization

PyPose:一个结合物理优化的机器人学习库

Chen Wang, Dasong Gao, Kuan Xu, Junyi Geng, Yaoyu Hu, Yuheng Qiu, Bowen Li, Fan Yang, Brady Moon, Abhinav Pandey, Aryan, Jiahe Xu, Tianhao Wu, Haonan He, Daning Huang, Zhongqiang Ren, Shibo Zhao, Taimeng Fu, Pranay Reddy, Xiao Lin, Wenshan Wang, Jingnan Shi, Rajat Talak, Kun Cao, Yi Du, Han Wang, Huai Yu, Shanzhao Wang, Siyu Chen, Ananth Kashyap, Rohan Bandaru, Karthik Dantu, Jiajun Wu, Lihua Xie, Luca Carlone, Marco Hutter, Sebastian Scherer

专题命中 机器人学习 :robot learning(title,abstract);robotics(abstract);navigation(abstract);robotic(abstract)

AI总结 PyPose结合深度感知模型与物理优化,提供高效的机器人学习库,实现计算速度提升超过10倍,适用于SLAM、规划、控制等任务。

Comments Project Website: https://pypose.org Documentation: https://pypose.org/docs/ Tutorial: https://pypose.org/tutorials/ Source code: https://github.com/pypose/pypose

Journal ref IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31493 2026-07-22 cs.RO 版本更新 57%

ChronoFlow-Policy: Unifying Past-Current-Future Interaction Flow in Visuomotor Policy Learning

ChronoFlow-Policy:在视觉运动策略学习中统一过去-当前-未来交互流

Bokai Lin, Yifu Xu, Xinyu Zhan, Hongjie Fang, Jialin Tian, Fu-Cheng Zhang, Yong-Lu Li, Cewu Lu, Lixin Yang

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) Noematrix

专题命中 机器人学习 :manipulation(abstract);分类 cs.RO

AI总结 提出ChronoFlow统一表示过去、当前和未来的交互动态,并基于此设计扩散策略ChronoFlow-Policy,在模拟和真实操作任务中优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 22 篇

2511.01177 2026-07-22 cs.RO 版本更新 89%

Scaling Cross-Embodiment World Models for Dexterous Manipulation

为灵巧操作扩展跨实体世界模型

Zihao He, Bo Ai, Tongzhou Mu, Yulin Liu, Weikang Wan, Jiawei Fu, Yilun Du, Henrik I. Christensen, Hao Su

机构 * UC San Diego(UC圣迭戈大学) Harvard University(哈佛大学) Shanghai Jiao Tong University(上海交通大学) Hillbot

专题命中 机器人操作 :manipulation(title,abstract);world model(title,abstract);robotic(abstract);分类 cs.RO

AI总结 研究跨实体学习中不同形态机器人数据共享和控制转移问题,提出将人类和机器人手表示为3D粒子集,在随机交互数据上训练基于图的世界模型并与模型预测控制集成,实验表明该方法能提高泛化能力、有效结合数据并实现不同机器人手的控制。

Comments Accepted to IROS 2026, Project Page: https://alan-heoooh.github.io/dexwm.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21378 2026-07-22 cs.RO cs.AI 版本更新 88%

RoboInspector: Unveiling the Unreliability of Policy Code for LLM-enabled Robotic Manipulation

RoboInspector:揭示用于基于大语言模型的机器人操作的策略代码的不可靠性

Chenduo Ying, Linkang Du, Peng Cheng, Yuanchao Shu

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO、cs.AI

AI总结 研究基于大语言模型的机器人操作中策略代码不可靠问题,设计RoboInspector从任务复杂性和指令粒度揭示其不可靠性,通过实验识别四种不可靠行为及原因,还引入优化方法,可提高策略代码生成可靠性达35%。

Comments Accepted to ACM Transactions on Intelligent Systems and Technology

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14852 2026-07-22 cs.RO 版本更新 88%

Towards Human-like Physical Intelligence: Lifelong Vision-Language-Action Learning for Robotic Manipulation

迈向类人物理智能:用于机器人操作的终身视觉-语言-动作学习

Yao He, Gan Sun, Wenqi Liang, Fazeng Li, Yang Cong

机构 * South China University of Technology(华南理工大学) University of Trento(特伦托大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 研究针对机器人操作中可塑性-稳定性权衡难题,提出缓存高效的终身视觉-语言-动作学习框架LifelongVLA。通过双时间尺度LoRA门控模块及缓存高效随机重放策略,有效缓解权衡问题,实现技能扩展、行为保留,减少再训练依赖,优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08541 2026-07-22 cs.RO 版本更新 85%

EquiBim: Learning Symmetry-Equivariant Policy for Bimanual Manipulation

EquiBim: 学习双臂操作的对称等变策略

Zhiyuan Zhang, Aditya Mohan, Seungho Han, Wan Shou, Dongyi Wang, Yu She

机构 * Purdue University(普渡大学) University of Arkansas(阿肯色大学)

专题命中 机器人操作 :manipulation(title,abstract);robot learning(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出EquiBim框架,通过强制对称性等变性提升双臂操作的性能和鲁棒性,适用于多种感知与动作表示。

Comments Accepted to IROS 2026. Project page: https://zhangzhiyuanzhang.github.io/equibim-website/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13869 2026-07-22 cs.RO cs.AI 版本更新 84%

TransDex: Pre-training Visuo-Tactile Policy with Point Cloud Reconstruction for Dexterous Manipulation of Transparent Objects

TransDex:基于点云重建的视觉-触觉政策预训练用于透明物体的精细操作

Fengguan Li, Yifan Ma, Chen Qian, Wentao Rao, Weiwei Shang

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 TransDex通过点云重建预训练实现视觉-触觉融合政策,解决透明物体操作中的自遮挡和深度噪声问题,提升真实机器人系统中精细操作性能。

Comments Project page: https://transdex.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17787 2026-07-22 cs.RO cs.AI 版本更新 81%

AnchorRefine: Synergy-Manipulation Based on Trajectory Anchor and Residual Refinement for Vision-Language-Action Models

AnchorRefine:基于轨迹锚点和残差细化的轨迹-锚点与残差细化的视觉-语言-动作模型

Tingzheng Jia, Kan Guo, Lanping Qian, Yongli Hu, Daxin Tian, Guixian Qu, Chunmian Lin, Baocai Yin, Jiapu Wang

机构 * Beijing University of Technology(北京理工大学) Beihang University(北航) Nanjing University of Science and Technology(南京理工大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO、cs.AI

AI总结 本文提出AnchorRefine框架,通过分解视觉-语言-动作动作建模为轨迹锚点和残差细化,提升几何和接触精度,实验表明在模拟和现实任务中均取得显著提升。

Comments The authors have decided to withdraw this manuscript because the work requires substantial revision and further experimental validation

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18950 2026-07-22 cs.RO 新提交 77%

Design and stability analysis of an underactuated hand with passively rotating fingers

具有被动旋转手指的欠驱动手的设计与稳定性分析

Léonie Plancoulaine, Sylvain Guégan, Franck Plestan, Damien Chablat

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 研究具有空间移动性的欠驱动机器人手指,通过创新设计简化运动复杂性,引入稳定性标准和差动机构,经实验验证理论结果,降低了机械复杂性等,推动了柔顺机器人手发展,为未来自主操作研究奠定基础。

Journal ref Proceedings of the ASME 2026 International Design Engineering Technical Conferences \& Computers and Information in Engineering Conference, ASME, Aug 2026, Houston, United States

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19060 2026-07-22 cs.LG cond-mat.soft cs.AI physics.data-an stat.ML 新提交 73%

Deep learning-based prediction of time-resolved adhesive forces in viscoelastic Hertzian contacts

基于深度学习的粘弹性赫兹接触中时间分辨粘附力预测

Ali Maghami, Merten Stender, Michele Ciavarella, Antonio Papangelo

机构 * Chair of Cyber-Physical Systems in Mechanical Engineering, Technische Universität Berlin(柏林工业大学机械工程系网络物理系统主席) TriboDynamics Lab, Department of Mechanics, Mathematics and Management, Polytechnic University of Bari(巴里理工大学力学、数学与管理系摩擦动力学实验室)

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);分类 cs.AI、cs.LG

AI总结 研究针对软机器人等领域中快速预测粘弹性接触响应的挑战,训练标量条件、序列到序列的深度学习模型,引入FMS表示,经多种架构训练比较,最佳模型有LSTM架构,能快速预测力轨迹,为数值评估提供替代,可用于控制应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18742 2026-07-22 cs.SE 新提交 71%

Beyond Text Editing: Algebraic Manipulation of Source Code

超越文本编辑:源代码的代数操作

Kevin Pulo

专题命中 机器人操作 :manipulation(title)

AI总结 研究提出源代码代数方法,通过逻辑代数操作修改代码库,概述其操作属性。实验表明大语言模型代理用此方法完成代码更改成功率更高、令牌数更少,为代码编辑提供新方向,推动相关研究。

Comments Accepted for publication in the Visions and Emerging Results Track of the 42nd IEEE International Conference on Software Maintenance and Evolution (ICSME 2026), 14-18 September 2026, Benevento, Italy

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11340 2026-07-22 cs.RO 版本更新 70%

CR-Solver: GPU-Accelerated Kinematics Solver for Tendon-driven Continuum Robots

CR-Solver:用于腱驱动连续体机器人的GPU加速运动学求解器

Heqing Yang, Yang Yi, Linqing Zhong, Linjiang Huang, Si Liu

机构 * Beihang University(北京航空航天大学)

专题命中 机器人操作 :manipulation(abstract);navigation(abstract);分类 cs.RO

AI总结 针对连续体机器人运动规划问题,提出CR-Solver求解器,它基于优化框架统一逆运动学等,利用GPU加速并行优化,在三项任务验证中比传统CPU求解器显著加速,成功率超95%精度达毫米级,且用纯Python实现,为高性能运动规划提供基础。

Comments IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17049 2026-07-22 cs.SE cs.RO 版本更新 70%

Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots

评估具有视觉语言动作能力的机器人的不确定性和质量

Pablo Valle, Chengjie Lu, Shaukat Ali, Aitor Arrieta

机构 * Mondragon University(蒙dragon大学) Simula Research Laboratory(Simula研究实验室)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 研究针对具有视觉语言动作能力的机器人,采用八个不确定性指标和五个质量指标,通过大规模实证研究评估其有效性,发现部分指标与人类评估有相关性且能区分任务执行质量,挑战了仅依赖成功率的评估做法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10946 2026-07-22 cs.RO cs.AI cs.LG 版本更新 67%

ImplicitRDP: An End-to-End Visual-Force Diffusion Policy with Structural Slow-Fast Learning

ImplicitRDP:一种具有结构快慢学习的端到端视觉-力扩散策略

Wendi Chen, Han Xue, Yi Wang, Fangyuan Zhou, Jun Lv, Yang Jin, Shirun Tang, Chuan Wen, Cewu Lu

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) Noematrix Ltd.(诺姆矩阵有限公司)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 研究人类水平接触操作中视觉与力感测信号整合难题,提出ImplicitRDP策略,用结构快慢学习机制及虚拟目标表示正则化,经实验验证其在丰富接触任务中显著优于基线,有卓越反应性与成功率。

Comments Accepted to RA-L 2026. Project page: https://implicit-rdp.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16577 2026-07-22 cs.CV cs.GR 版本更新 57%

CNS-Edit++: Category-Agnostic 3D Editing with Coupled Neural Shape Representation

CNS-Edit++:基于耦合神经形状表示的类别无关3D编辑

Jingyu Hu, Weilong Yan, Zhengzhe Liu, Haipeng Li, Ka-Hei Hui, Hao Zhang, Chi-Wing Fu

机构 * The Chinese University of Hong Kong(香港中文大学) Lingnan University(岭南大学) National University of Singapore(新加坡国立大学) The Hong Kong University of Science and Technology(香港科技大学) Autodesk AI Lab(欧特克人工智能实验室) Simon Fraser University(西蒙弗雷泽大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 研究提出基于耦合神经形状表示和神经特征体积优化的潜在空间3D形状编辑框架CNS-Edit++,能在特定类别和类别无关模型上实例化,有多种编辑操作符及区域控制机制,经评估其性能优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18090 2026-07-22 cs.RO cond-mat.mtrl-sci cond-mat.soft physics.app-ph 57%

Muscle-inspired magnetic actuators that push, pull, crawl, and grasp

具有推、拉、爬行和抓取能力的肌肉启发型磁致动器

Muhammad Bilal Khan, Florian Hofmann, Kilian Schäfer, Matthias Lutzi, Oliver Gutfleisch

机构 * Functional Materials, Institute of Materials Science, Technical University of Darmstadt(功能材料,材料科学研究所,达姆施塔特技术大学) Additive Manufacturing Center, Technical University of Darmstadt(增材制造中心,达姆施塔特技术大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 本文提出了一种基于增材制造的磁性复合材料,通过调节激光能量实现机械刚度和磁响应的精确控制,展示了多功能磁性软机器人应用的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02838 2026-07-22 cs.SI cs.LG 版本更新 57%

Beyond Content: Behavioral Policies Reveal Actors in Information Operations

超越内容:行为策略揭示信息操作中的行为者

Philipp J. Schneider, Lanqin Yuan, Marian-Andrei Rizoiu

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 通过分析用户行为策略而非内容,有效识别恶意行为者,提升信息操作检测的鲁棒性和跨平台适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19109 2026-07-22 cs.CR math.NT 新提交 50%

Exploiting Load/Store Leakage of Sparse Vectors for Key Recovery in HQC

利用稀疏向量的加载/存储泄漏进行HQC中的密钥恢复

Gustavo Banegas, Benjamin Smith, Jad Zahreddine

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究针对HQC密钥恢复的侧信道攻击,利用其稀疏秘密向量操作中的加载/存储泄漏,通过分析Cortex-M4汇编识别泄漏面,构建零字鉴别器简化解码问题,分析解码复杂度并经实验验证,还讨论了消除攻击利用的稀疏性的对策。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24641 2026-07-22 math.OC cs.SY eess.SY 版本更新 50%

Suboptimal and Reduced-Order MPC via Timescale Separation

基于时间尺度分离的次优与降阶MPC

Stefano Di Gregorio, Guido Carnevale, Giuseppe Notarstefano

专题命中 机器人操作 :robotic(abstract)

AI总结 提出一种通用框架,通过次优控制计算和降阶模型,结合采样时间设计,利用时间尺度分离分析闭环稳定性,保证递归可行性和指数稳定。

Comments arXiv admin note: text overlap with arXiv:2511.19336

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15366 2026-07-22 physics.app-ph 版本更新 50%

Tailoring reflectionless complex media for non-Abelian braiding of acoustic modes

设计具有完美传输的多重散射声学介质用于非阿贝尔编织及更广泛领域

Hongkuan Zhang, Guancong Ma

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究提出一种基于多重散射的方法,设计具有完美传输的复杂介质,实现非阿贝尔编织及任意单位运算,拓展了声学和波型应用的控制能力。

Journal ref Reports on Progress in Physics (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15152 2026-07-22 math.AP 版本更新 50%

Pseudo-magnetic Fields and Effective Dynamics in Strained Honeycomb Structures

应变蜂窝结构中的伪磁场与有效动力学

Chengyu Zhang, Borui Miao, Yi Zhu

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究应变蜂窝结构介质中狄拉克点附近波包的有效动力学,通过双尺度假设和克服应变变形波算子主部及零势时谱不远离零两个难点,建立了应变诱导伪磁狄拉克动力学的严格连续波理论。

Comments 50 pages, 6 figures. Revised version, substantially updated, submitted to a journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15539 2026-07-22 physics.app-ph 50%

Mid-Air Single-Sided Acoustic Levitation in High-Pressure Regions of Zero-Order Bessel Beams

空气中单侧声学悬浮在零阶贝塞尔光束高压区域

Yusuke Koroyasu, Christopher Stone, Yoichi Ochiai, Takayuki Hoshi, Bruce W. Drinkwater, Tatsuki Fushimi

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究首次在零阶贝塞尔光束高压区域实现稳定的空气中单侧声学悬浮,支持多粒子操控和长距离工作

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10557 2026-07-22 cond-mat.mes-hall cond-mat.mtrl-sci 版本更新 50%

Asymmetric Antibimerons: Statics and Dynamics

不对称反双聚体:静态与动态

Pavel A. Vorobyev, Daichi Kurebayashi, Oleg A. Tretiakov

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究预测了不对称反双聚体(AAB),通过各向异性界面Dzyaloshinskii-Moriya相互作用稳定,解释其形状起源,证明相反拓扑电荷的AAB可共存,用微磁模拟等描述其电流驱动动力学及碰撞对拓扑电荷的操纵,为相关研究提供路线图。

Comments 7 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.06204 2026-07-22 quant-ph 50%

Modular Quantum-to-Quantum Bernoulli Factory in an Integrated Photonic Processor

模块化量子到量子伯努利工厂在集成光子处理器中

Francesco Hoch, Taira Giordani, Luca Castello, Gonzalo Carvacho, Nicolò Spagnolo, Francesco Ceccarelli, Ciro Pentangelo, Simone Piacentini, Andrea Crespi, Roberto Osellame, Ernesto F. Galvão, Fabio Sciarrino

专题命中 机器人操作 :manipulation(abstract)

AI总结 该研究提出了一种模块化、通用的量子到量子伯努利工厂方案,利用光子路径编码实现随机性操控,展示了其在集成光子处理器中的可行性。

Journal ref Nature Photonics 19, 12-19 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身导航 23 篇

2607.11063 2026-07-22 cs.AI 版本更新 83%

AdvNav: Behavior-Guided Black-Box Adversarial Attacks on Vision-Language Navigation

AdvNav:视觉语言导航中基于行为引导的黑盒对抗攻击

Chenyang Li, Kaige Li, Zeyu Jiang, Changhao Chen

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 具身导航 :navigation(title,abstract);embodied AI(abstract);分类 cs.AI

AI总结 研究视觉语言导航系统对抗攻击,提出AdvNav框架,利用双粒度行为反馈构建替代目标,采用混合优化策略。在R2R数据集上评估,对两种模型取得较高攻击成功率,证明其有效性与通用性,揭示感知漏洞并为VLN模型设计提供见解。

Comments ACM International Conference on Multimedia 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30293 2026-07-22 cs.RO 版本更新 83%

CSAR: Containerized System Architecture for Robotics

CSAR:面向机器人的容器化系统架构

Gregorio Ambrosio-Cestero, Cipriano Galindo, Javier Gonzalez-Jimenez, Jose-Raul Ruiz-Sarmiento

机构 * Machine Perception and Intelligent Robotics group (MAPIR), Dept. of System Engineering and Automation, Málaga Institute for Mechatronics Engineering and Cyber-Physical Systems (IMECH.UMA), University of Málaga(机器感知与智能机器人组(MAPIR),系统工程与自动化系,马拉加机电一体化工程与信息物理系统研究所(IMECH.UMA),马拉加大学)

专题命中 具身导航 :robotics(title,abstract);robotic(abstract);分类 cs.RO

AI总结 提出CSAR架构,结合LXC/LXD容器化、ROS 2/DDS通信和三层边缘基础设施,解决机器人团队在依赖隔离、兼容性、可复现性和异构部署中的挑战,并通过3D SLAM和GPU加速语义映射用例验证其有效性。

Comments 14 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19288 2026-07-22 cs.CV cs.RO 新提交 81%

No Training, Better Flights: Test-Time Scaled VLMs for UAV Navigation

无需训练,飞行更佳:用于无人机导航的测试时缩放视觉语言模型

Feinan Cheng, Dongliang Xu, Wenli Nong, Zhiheng Zhang, Ang Liu, Tianyu Wang, Yue Yao

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 研究如何将测试时缩放应用于无人机视觉语言导航,通过迭代细化和多标准评分函数,无需额外训练,使冻结模型自我校正,生成更准确可靠飞行计划,实现最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15875 2026-07-22 cs.RO cs.AI 版本更新 81%

Fly0: Persistent Metric Anchoring for Zero-Shot Aerial Vision-Language Navigation

Fly0: 解耦语义定位与几何规划以实现零样本空中导航

Zhenxing Xu, Yihong Lu, Weidong Bao, Zhengqiu Zhu, Jingxuan Zhou, Zhichuang Wang, Ji Wang, Lihua Liu, Wei He

机构 * National Key Laboratory of Big Data and Decision(大数据与决策国家重点实验室) National University of Defense Technology(国防科技大学) State Key Laboratory of Digital Intelligent Modeling and Simulation(数字智能建模与仿真国家重点实验室) Information Support Force Engineering University(信息支援力量工程大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 Fly0通过解耦语义推理与几何规划,实现零样本空中导航,提升导航成功率和减少导航误差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18794 2026-07-22 cs.RO 新提交 79%

Beyond Transformers: Linear Attention Policy for Open-Vocabulary Object Goal Navigation

超越Transformer:用于开放词汇对象目标导航的线性注意力策略

Jiahong Zhang, Yifan Lin, Yandong Zhang, Sijun Shen, Kexin Wang, Yuqi Pan, Hongjuan Pei, Wei Wang, Guoqi Li

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 研究开放词汇对象目标导航中智能体状态更新问题,提出基于线性注意力的导航策略LANav,采用线性注意力作主干,引入加权状态扩展线性注意力提升性能,在多方面优于基于Transformer基线,证明其可行性与跨场景鲁棒性。

Comments 12 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18604 2026-07-22 cs.RO cs.AI cs.LG cs.NI cs.SY eess.SY 新提交 78%

Intelligent Multi-UAV Navigation in ITNTNs: A Hierarchical LLM Approach

智能多无人机在综合陆地与非陆地网络中的导航:一种分层大语言模型方法

Zijiang Yan, Hao Zhou, Wael Jaafar, Jianhua Pei, Ping Wang, Halim Yanikomeroglu, Hina Tabassum

专题命中 具身导航 :navigation(title);分类 cs.RO、cs.AI、cs.LG

AI总结 针对高速无人机在三维空中高速公路部署中面临的协调问题,提出分层大语言模型驱动控制框架,利用云端大语言模型管理全局负载平衡,边缘大语言模型转化局部观测为子目标,引导深度强化学习控制器执行轨迹,降低碰撞率并提高系统吞吐量。

Comments This paper has been accepted by IEEE GLOBECOM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏