arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-08-04 至 2026-08-04 共收录 55 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 2 篇

2606.20389 2026-08-04 cs.RO 版本更新 83%

CoLI: A Reproducible Platform for Continuum Robot Learning via Monolithic 3D Printing and Isomorphic Teleoperation

CoLI: 通过整体3D打印和同构遥操作实现连续体机器人学习的可复现平台

Ziyuan Tang, Chenxi Xiao

机构 * School of Information Science and Technology at ShanghaiTech University(上海科技大学信息科学与技术学院)

专题命中 机器人学习 :robot learning(title);robotics(abstract);manipulation(abstract);分类 cs.RO

AI总结 提出一种基于多材料3D打印和同构遥操作的连续体机器人平台,简化制造流程并实现无奇异映射控制,支持模仿学习自主控制,通过硬件表征和操作任务验证其可复现性和学习就绪性。

Comments 8 pages, 7 figures, 1 table, accepted by IROS2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28394 2026-08-04 cs.CV 版本更新 57%

Hand-Object Interaction in the Age of Large Foundation Models:Reconstruction, Generation, and Embodied Transfer

大基础模型时代的手物交互:重建、生成与具身迁移

Weiquan Lin, Yu Deng, Shiyang Liu, Luping Xiao, Xu Tang, Junzhi Yu, Jiaolong Yang, Lei Zhang, Xingyu Chen

专题命中 机器人学习 :robot learning(abstract);分类 cs.CV

AI总结 本综述系统梳理大基础模型在手物交互(HOI)领域的应用,建立基础模型子先验分类,分析其在HOI任务与机器人学习中的作用,总结数据集与评估协议并展望未来方向。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 23 篇

2604.19522 2026-08-04 cs.RO 版本更新 91%

GenerativeMPC: VLM-RAG-guided Whole-Body MPC with Virtual Impedance for Bimanual Mobile Manipulation

GenerativeMPC:基于VLM-RAG的全身体姿MPC与虚拟阻抗的双臂移动 manipulation

Marcelino Julio Fernando, Miguel Altamirano Cabrera, Jeffrin Sam, Yara Mahmoud, Konstantin Gubernatorov, Dzmitry Tsetserukou

机构 * Intelligent Space Robotics Laboratory(智能空间机器人实验室) Skolkovo Institute of Science and Technology(斯克尔科沃科学与技术研究所)

专题命中 机器人操作 :manipulation(title,title_cn);navigation(abstract);分类 cs.RO

AI总结 本文提出GenerativeMPC框架,通过VLM-RAG将语义理解与物理控制参数结合,实现双臂移动 manipulation的高效安全控制,实验表明在近人区域速度降低60%并实现安全社交导航。

Comments 6 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.32027 2026-08-04 cs.RO cs.AI cs.LG 版本更新 89%

Freeform Preference Learning for Robotic Manipulation

自由形式偏好学习用于机器人操作

Marcel Torne, Anubha Mahajan, Abhijnya Bhat, Chelsea Finn

机构 * Stanford University(斯坦福大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title);robot policy(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 提出自由形式偏好学习(FPL),通过自然语言定义偏好轴并学习语言条件奖励模型,在长时域操作任务中比稀疏奖励和二元偏好方法提升38个百分点,支持行为组合与测试时策略引导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02104 2026-08-04 cs.RO 版本更新 88%

ACDC: Adaptive Curriculum Planning with Dynamic Contrastive Control for Goal-Conditioned Reinforcement Learning in Robotic Manipulation

ACDC:基于动态对比控制的自适应课程规划用于机器人操控的面向目标强化学习

Xuerui Wang, Guangyu Ren, Tianhong Dai, Bintao Hu, Shuangyao Huang, Wenzhang Zhang, Hengyan Liu

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 本文提出ACDC方法,结合自适应课程规划与动态对比控制,提升机器人操控任务中的样本效率和任务成功率。

Comments Withdrawn by the authors after identifying inconsistencies between the described adaptive curriculum and the implementation used to generate the reported experiments, particularly in the success-rate feedback mechanism and replay-weight schedule. These issues require the experiments and conclusions to be reevaluated

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18494 2026-08-04 cs.RO 版本更新 88%

MemoAct: Atkinson-Shiffrin-Inspired Hierarchical Memory-Augmented Policy for Robotic Manipulation

MemoAct:受Atkinson-Shiffrin启发的内存增强视觉-运动策略用于机器人操作

Liufan Tan, Jiale Li, Gangshan Jing

机构 * Chongqing University(重庆大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 本文提出MemoAct,一种基于层次内存的策略,通过不同内存层级解决任务状态跟踪和长周期记忆保留的问题,并通过MemoryRTBench验证其在模拟和现实场景中的优越性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15257 2026-08-04 cs.RO 版本更新 83%

HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing

HapticVLA:通过视觉-语言-动作模型实现接触丰富的操作,无需推理时触觉感知

Konstantin Gubernatorov, Mikhail Sannikov, Ilya Mikhalchuk, Egor Kuznetsov, Makar Artemov, Ogunwoye Faith Oluwatobi, Marcelino Fernando, Artem Asanov, Ziang Guo, Dzmitry Tsetserukou

机构 * Intelligent Space Robotics Laboratory, Skolkovo Institute of Science and Technology(智能空间机器人实验室,斯克洛夫科学与技术研究所)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 HapticVLA通过视觉-语言-动作模型实现接触丰富的操作,无需触觉传感器,在现实实验中成功率达到86.7%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11655 2026-08-04 cs.RO 版本更新 83%

Concurrent Prehensile and Nonprehensile Manipulation: A Practical Approach to Multi-Stage Dexterous Tasks

并行抓取与非抓取操作:多阶段灵巧任务的实用方法

Hao Jiang, Yue Wu, Yue Wang, Gaurav S. Sukhatme, Daniel Seita

专题命中 机器人操作 :manipulation(title,abstract);robotics(abstract);分类 cs.RO

AI总结 本文提出DexMulti方法,通过分解示范为以物体为中心的技能,实现高效多阶段灵巧任务操作,在实际测试中达到66%的成功率,优于基线方法。

Comments 12 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18557 2026-08-04 cs.CV cs.GR cs.RO 版本更新 81%

SynAgent: Generalizable Cooperative Humanoid Manipulation via Solo-to-Cooperative Agent Synergy

SynAgent:通过独狼到协作代理协同实现通用化的人形机器人操作

Wei Yao, Haohan Ma, Hongwen Zhang, Liangjun Xing, Zhile Yang, Yuanjun Guo, Yunlian Sun, Yebin Liu

机构 * School of Computer Science and Engineering, Nanjing University of Science and Technology(南京理工大学计算机科学与工程学院) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院) School of Artificial Intelligence, Beijing Normal University(北京师范大学人工智能学院) Department of Automation, Tsinghua University(清华大学自动化系) College of Artificial Intelligence, Nanjing Forestry University(南京林业大学人工智能学院)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO、cs.CV

AI总结 本文提出SynAgent框架,通过独狼到协作代理协同转移单agent人-物体交互技能,实现可扩展且物理合理的协作操作,实验显示其在协作模仿和轨迹条件控制方面优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29517 2026-08-04 cs.RO 版本更新 79%

CORE: Common Outcome Regularities from Action-Free Visual Demonstrations for Robot Manipulation

CORE: 从无动作视觉演示中提取机器人操作的共同结果规律

Juyi Sheng, Mingxin Tan, Jincheng Li, Mengyuan Liu

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 提出CORE框架,从无动作视觉演示中提取共同结果规律作为视觉目标原型,注入机器人策略提升操作成功率,在多个基准上平均提升3.9至17.0个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14606 2026-08-04 cs.RO cs.SY eess.SY 版本更新 79%

Interaction Dynamics for Dexterous Manipulation

用于灵巧手控制的阻抗MPC与扰动估计

Yongyan Cao

机构 * Voryx Robotic LLC(Voryx机器人有限公司)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 提出一种执行器无关的阻抗模型预测控制框架,通过代数前馈将肌腱传动简化为常系数双积分器,结合编码器增强卡尔曼扰动估计,实现高精度轨迹跟踪与安全接触力控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09246 2026-08-04 cs.CR 版本更新 78%

Practical Spoofing Attacks against Galileo OSNMA with Time-Synchronization Manipulation

通过时间同步操纵对伽利略OSNMA实施的实用欺骗攻击

Haiyang Wang, Yuanyu Zhang, Yangke Tan, Ji He, Shuangtrui Zhao, Ning Xi, Yulong Shen

专题命中 机器人操作 :manipulation(title);navigation(abstract)

AI总结 该研究针对启用OSNMA的伽利略接收机,提出三种符合时间同步要求的欺骗攻击,通过操纵本地参考时间迫使接收机满足时间同步,结合重放或伪造信号实现欺骗,实验验证攻击可成功通过OSNMA认证。

Comments 10 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21429 2026-08-04 cs.LG cs.AI cs.SY eess.SY math.OC 版本更新 73%

Provably Safe Generative Sampling with Constricting Barrier Functions

具有约束屏障函数的可证明安全生成采样

Darshan Gadginmath, Ahmed Allibhoy, Fabio Pasqualetti

机构 * Mechanical Engineering University of California, Riverside(机械工程 加州大学河滨分校) Electrical Engineering and Computer Science University of California, Irvine(电气工程与计算机科学 加州大学伊尔弗分校)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.AI、cs.LG

AI总结 通过约束屏障函数实现安全生成采样,确保生成样本满足硬约束并保持语义保真度。

Comments 26 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03270 2026-08-04 cs.RO cs.AI 版本更新 73%

Grounded Vision-Language Interpreter for Long-Horizon Bimanual Task and Motion Planning

用于长 horizon 双臂任务与运动规划的接地视觉语言解释器

Jeremy Siburian, Keisuke Shirai, Cristian C. Beltran-Hernandez, Masashi Hamaya, Michael Görner, Atsushi Hashimoto

机构 * OMRON SINIC X Corporation(OMRON SINIC X公司) The University of Tokyo(东京大学) University of Hamburg(汉堡大学)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 针对现有视觉语言机器人规划框架的黑箱缺陷与双臂任务探索不足问题,提出混合规划框架 ViLaIn-TAMP,经烹饪领域任务及实际双臂机器人系统验证,其性能优于基准方法。

Comments IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16478 2026-08-04 cs.GR 版本更新 67%

Fast and Reliable Gradients for Deformables Across Frictional Contact Regimes

快速且可靠的变形体梯度在摩擦接触范围内

Ziqiu Zeng, Gang Yang, Zhenhao Huang, Bingyang Zhou, Yulin Li, Jason Pho, Siyuan Luo, Fan Shi

专题命中 机器人操作 :robotics(abstract);manipulation(abstract)

AI总结 本文提出了一种统一的全GPU加速可微模拟器,通过长期一致性、统一接触稳定性以及鲁棒材料识别方法,解决了摩擦接触问题中的梯度不稳定性问题,提升了物理系统识别和控制的精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.07163 2026-08-04 cs.RO cs.CV 版本更新 62%

Mamba Policy: Towards Efficient 3D Diffusion Policy with Hybrid Selective State Models

Mamba Policy:基于混合选择性状态模型的高效3D扩散策略

Jiahang Cao, Qiang Zhang, Jingkai Sun, Jiaxu Wang, Hao Cheng, Yulin Li, Jun Ma, Kun Wu, Zhiyuan Xu, Yecheng Shao, Wen Zhao, Gang Han, Yijie Guo, Renjing Xu

机构 * Microelectronics Thrust, The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)微电子领域) Division of Emerging Interdisciplinary Areas, The Hong Kong University of Science and Technology(香港科技大学新兴交叉领域 division) Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心) Center for X-Mechanics, Zhejiang University(浙江大学X力学中心)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO、cs.CV

AI总结 本研究提出Mamba Policy,以XMamba Block融合Mamba与注意力机制,参数量减超80%,在Adroit等数据集上性能优异且计算资源需求低,长 horizon 场景鲁棒性更强。

Comments Accepted to IROS 2025. Project Page: https://sagecao1125.github.io/mamba_policy/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16898 2026-08-04 cs.CV cs.CL cs.CR 版本更新 57%

Cross-Branch Conflict as a Shield: Safeguarding Facial Identities in Unified Multimodal Image Editing

跨分支冲突作为一种保护手段:在统一多模态图像编辑中保护面部身份

Weiwei Tan, Junxian Li, Rui Wang, Zhenhua Xu, Yanjun Zhang, Yu Leo Zhang

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 研究统一多模态模型中个人肖像编辑的安全问题,提出CCS统一对抗保护框架,通过联合驱动ViT和VAE表示及破坏跨分支兼容性,防止模型恢复身份信息,在抑制身份保留编辑上表现优于现有方法。

Comments 14 pages, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03557 2026-08-04 cs.RO 版本更新 57%

CoorGrasp: Coordinated Contact Control for Adaptive Dexterous Grasping Under Uncertainty

CoorGrasp:不确定性下自适应灵巧抓取的协调接触控制

Mingrui Yu, Yongpeng Jiang, Yongyi Jia, Yi Ren, Xiang Li

机构 * BNRist(北京信息科学与技术国家研究中心)

专题命中 机器人操作 :robotic(abstract);分类 cs.RO

AI总结 研究在形状和位置不确定时灵巧抓取执行问题,提出触觉驱动模型预测控制器,强调多接触协调,有协调感知相分离等三个创新点,经仿真和实验验证,提高了抓取成功率并减少物体不必要移动。

Comments Accepted by ICRA 2026. Best Poster Award at ICRA 2026 Workshop on Dexterity with Multifingered Hands: Hardware, Sensing, and Skills. Project Website: https://ada-grasp-ctrl.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07386 2026-08-04 cs.RO 版本更新 57%

Spline Policy: A Structured Representation for Robot Policies

样条策略:机器人策略的结构化表示

Mengze Tian, Yiming Li, Sichao Liu, Auke Ijspeert, Sylvain Calinon

机构 * École Polytechnique Fédérale de Lausanne (EPFL)(瑞士联邦理工学院(EPFL)) Idiap Research Institute(Idiap研究 institute)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 提出样条策略(SP),用样条参数替代动作块,保留策略主干,支持连续轨迹解码、时域重采样、参数空间编辑及下游控制,并具有局部修正机制。

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16056 2026-08-04 cs.SD cs.AI 版本更新 57%

AST: Adaptive, Seamless, and Training-Free Precise Speech Editing

AST:自适应、无缝且无需训练的精确语音编辑

Sihan Lv, Yechen Jin, Zhen Li, Jintao Chen, Jinshan Zhang, Ying Li, Jianwei Yin, Meng Xi

机构 * School of Software Technology, Zhejiang University(浙江大学软件学院) Innovation and Management Center of the School of Software (Ningbo), Zhejiang University(浙江大学软件学院(宁波)创新与管理中心) Institute of Remote Sensing Satellite, China Academy of Space Technology(中国空间技术研究院遥感卫星研究所) Zhejiang Key Laboratory of Digital-Intelligence Service Technology(浙江省数字智能服务技术重点实验室)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 本文提出AST框架,通过预训练自回归TTS模型实现精确语音编辑,引入潜变量重组和自适应弱事实引导,提升编辑区域的时序一致性和语音质量,同时引入LibriSpeech-Edit数据集和WDTW指标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20635 2026-08-04 cs.CV 版本更新 57%

iMontage: Unified, Versatile, Highly Dynamic Many-to-many Image Generation

iMontage:统一、多功能、高度动态的多对多图像生成

Zhoujie Fu, Xianfang Zeng, Jinghong Lan, Xinyao Liao, Cheng Chen, Junyi Chen, Jiacheng Wei, Wei Cheng, Shiyu Liu, Yunuo Chen, Gang Yu, Guosheng Lin

机构 * Nanyang Technological University(南洋理工大学) StepFun Shanghai Jiao Tong University(上海交通大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 iMontage通过整合视频模型的先验知识与图像数据的多样性,实现了统一、多功能且动态的多对多图像生成。

Comments Our homepage: https://kr1sjfu.github.io/iMontage-web/

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.06945 2026-08-04 cs.CV 版本更新 57%

Direct and Adaptable Mesh-Gaussian Scene Reconstruction from Multi-View Images

从多视图图像进行直接且可自适应的网格-高斯场景重建

Ancheng Lin, Tianqing Su, Zuo Yuan, Quanke Su, Samuel S. Mao, Yusheng Xiang

机构 * School of Computer Science, Australian Artificial Intelligence Institute (AAII)(计算机科学学院,澳大利亚人工智能研究所) University of Technology Sydney(悉尼技术大学) School of Automobile(汽车学院) Chang’an University(长安大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 该研究针对现有方法分离几何与外观建模的问题,提出端到端网格-高斯场景表示,实现直接联合学习,提升重建效率与质量,可高效适配局部场景修改,支撑具身智能相关环境维护。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28695 2026-08-04 quant-ph physics.chem-ph 版本更新 50%

Poincaré Sphere Representation of Spin-Driven Polarization Encoding in Two-Dimensional Perovskite Light Sources

基于干涉场重建的非线性光学光源安全度量

Zijian Gan, Shuyue Feng, Camryn J. Gloor, Wei You, Andrew M. Moran

专题命中 机器人操作 :manipulation(abstract)

AI总结 通过偏振分辨干涉测量和Bloch矢量非线性响应模型,重建二维钙钛矿(PEA)2PbI4的四波混频信号场的有效单光子偏振密度矩阵,并评估Holevo界和有效秘密比特率,发现相干时间自由度可降低Holevo界约2.6-5.8%,且通过引入有效秘密比特每脉冲度量,无需光子数分辨检测即可快速评估候选材料的安全信息吞吐量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06958 2026-08-04 eess.SP 版本更新 50%

Millimeter-Wave Position Sensing Using Reconfigurable Intelligent Surfaces: Positioning Error Bound and Phase Shift Configuration

毫米波位置传感使用可重构智能表面:定位误差界限与相移配置

Xin Cheng, Yuqing Yang, Guangjie Han, Menglu Li, Ruoguang Li, Feng Shu

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文研究了利用多个RIS的三维多输入单输出毫米波定位系统,通过引入顺序RIS激活和定向波束成形框架,分析了Fisher信息推导出的定位误差界限,并提出两种优化方法以最小化误差界限。

Journal ref Cheng X, Yang Y, Han G, et al. Millimeter-Wave Position Sensing Using Reconfigurable Intelligent Surfaces: Positioning Error Bound and Phase Shift Configuration[J]. IEEE Transactions on Vehicular Technology, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08618 2026-08-04 nlin.CD 版本更新 50%

Modulation of Neuronal Firing Modes by Electric Fields in a Thermosensitive FitzHugh-Nagumo Model

热敏 FitzHugh-Nagumo 模型中电场对神经元放电模式的调控

Ediline L. F. Nguessap, Antonio C. Roque, Fernando F. Ferreira

专题命中 机器人操作 :manipulation(abstract)

AI总结 该研究扩展了热敏 FitzHugh-Nagumo 神经元模型,通过分岔分析等方法揭示电场可调控神经元放电模式,为神经调控疗法等提供了机制见解。

Comments 27 pages, 14 figures

Journal ref Nonlinear Dynamics, Volume 114, article number 27 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身导航 13 篇

2607.26148 2026-08-04 cs.RO 版本更新 88%

Embodied Agents Take Control: Minimal-Interface Zero-Shot Agents Rival Industrial-Scale Policies in Vision-and-Language Navigation

具身智能体自主掌控:最小接口零样本智能体在视觉语言导航中可媲美工业级策略

Jian Zhou, Xunyi Zhao, Gengze Zhou, Zerui Li, Sihao Lin, Jiajun Liu, Qi Wu

机构 * Australian Institute for Machine Learning(澳大利亚机器学习研究所) Adelaide University(阿德莱德大学) Responsible AI Research Centre(负责任人工智能研究中心) CSIRO Data61(联邦科学与工业研究组织数据61中心) The University of Queensland(昆士兰大学)

专题命中 具身导航 :embodied agent(title,abstract);navigation(title,abstract);分类 cs.RO

AI总结 本研究提出智能具身控制,以零样本导航为测试平台,评估三种智能体框架,发现最小接口下部分框架可媲美工业级策略,同时揭示模型、框架与接口对具身智能体的互补作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27577 2026-08-04 cs.CV cs.RO 版本更新 84%

Structured Observation Language for Efficient and Generalizable Vision-Language Navigation

结构化观察语言用于高效且通用的视觉-语言导航

Daojie Peng, Fulong Ma, Jun Ma

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 具身导航 :navigation(title,abstract);embodied agent(abstract);分类 cs.RO、cs.CV

AI总结 本文提出SOL-Nav框架,通过将视觉观察转化为结构化语言描述,提升视觉-语言导航的效率和泛化能力,实验表明其在减少模型规模和训练数据依赖方面表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13814 2026-08-04 eess.IV eess.SP 版本更新 78%

Compact Convolutional Segmentation for Visual Landmark Extraction in GNSS-Denied UAV Navigation

一种深度卷积网络用于UAV导航的实时地标提取

Sude Ertan, Osman Tokluoglu, Mustafa Ozturk

专题命中 具身导航 :navigation(title,abstract)

AI总结 本文提出一种深度卷积网络,用于在GNSS受限环境下通过无人机摄像头图像实时提取地标,以实现无人机导航。

Comments The paper has been accepted for presentation and publication at IEEE ASYU 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20785 2026-08-04 cs.RO cs.AI 版本更新 73%

Robostral Navigate

稳健导航

Abdelaziz Bounhar, Abhijeet Somani, Aditi Kabra, Adrian Valente, Adrien Petralia, Adrien Sade, Alan Jeffares, Albert Jiang, Aleksandr Timashov, Alexandre Cahill, Alexandre Gavaudan, Alexandre Laval, Alexandre Sablayrolles, Amelie Heliou, Amos You, Andre Jonasson, Andrew Bai, Andrew Ehrenberg, Andrew Zhao, Angele Lenglemetz, Anmol Agarwal, Antonia Calvi, Arata Suzuki, Arjun Majumdar, Arthur Fournier, Artjom Joosen, Avinash Sooriyarachchi, Aylin Guliz Akkus, Aysenur Karaduman, Baptiste Bout, Baptiste Roziere, Baudouin De Monicault, Benjamin Holzschuh, Benjamin Lefaudeux, Benjamin Tibi, Bernhard Stadlbauer, Blazej Osinski, Camille Le Scao, Chaoran Yu, Charlotte Cronjager, Chen-Yo Sun, Chris Bamford, Christian Wallenwein, Christophe Renaudin, Clemence Lanfranchi, Corentin Barreau, Corentin Sautier, Cristiana-Diana Diaconu, Cyprien Courtot, Daniel Marczak, Darius Dabert, Diego de Las Casas, Dominik Nuss, Dylan Rubini, Dzmitry Soupel, Elizaveta Demyanenko, Elliot Chane-Sane, Emilien Fugier, Emmanuel Gottlob, Erik Aas, Etienne Goffinet, Etienne Millon, Eujeong Choi, Fabian Paischer, Fabian Schlager, Faruk Ahmed, Federico Baldassarre, Filip Szatkowski, Florian Wiesner, Gabrielle Berrada, Gaetan Ecrepont, Gaetan Lepage, Gaspard Blanchet, Gaspard Donada-Vidal, Gauthier Delerce, Gauthier Guinet, Genevieve Hayes, Georgii Novikov, Giada Pistilli, Gianluca Galletti, Guillaume Breton, Guillaume Kunsch, Guillaume Lample, Guillaume Martin, Guillaume Raille, Gunjan Dhanuka, Gunshi Gupta, Han Zhou, Harshil Shah, Hasan Furkan Vural, Hedi Hadiji, Hope McGovern, Hugo Cisneros, Hugo Thimonier, Indraneel Mukherjee, Ivan Cuevas Salazar, Jacques Sun, Jan Ludziejewski, Jason Rute, Jean Quentin, Jean-Hadrien Chabran, Jean-Malo Delignon, Jie Zhang, Joachim Studnia, Joep Barmentlo, Johannes Brandstetter, John Harvill, Jonas Amar, Jonas Schweizer, Josephine Delas, Josselin Somerville, Julien Denize, Julien Tauran, Kartik Khandelwal, Khyathi Raghavi Chandu, Kilian Tep, Kush Jain, Larissa Laich, Laura Calem, Laurence Aitchison, Laurent Callot, Laurent Fainsin, Leo Cotteleer, Leonard Blier, Lingxiao Zhao, Louis Martin, Louis Serrano, Lucile Saulnier, Ludovic Ho Fuh, Luis Montero, Maarten Buyl, Manon Chossegros, Marcin Mozejko, Margaret Jennings, Markus Hennerbichler, Martin Alexandre, Mathieu Poiree, Mathieu Schmitt, Mathilde Guillaumin, Matthieu Andre, Matthieu Dinot, Matthieu Futeral, Maurits Bleeker, Mauro Comi, Max Mynter, Maxim Berman, Maxime Darrin, Maxime Louis, Maximilian Augustin, Maximilian Muller, Melina Jingting Laimon, Mert Unsal, Mia Chiquier, Michael Pilcer, Michal Pietruszka, Michal Zajac, Mikhail Biriuchinskii, Minh-Quang Pham, Minwoo Kang, Morgane Riviere, Namit Katariya, Nathan Grinsztajn, Nathan Simpson, Neeraj Aggarwal, Neha Gupta, Ola Mysiak, Oliver Leicht, Olivier Bousquet, Olivier Duchenne, Parag Jain, Patricia Wang, Patrick Blies, Patrick von Platen, Paul Jacob, Paul Wambergue, Paula Kurylowicz, Pavan Kumar Reddy, Pavel Kuksa, Philippe Pinel, Philomene Chagniot, Pierre Stock, Pierre-Andre Savalle, Piotr Milos, Prateek Gupta, Pravesh Agrawal, Quentin Desreumaux, Quentin Torroba, Quercus Hernandez, Ram Ramrakhya, Randall Isenhour, Ranjit Parva, Raul Perez Pelaez, Reinhard Sonnleitner, Remi Delacourt, Richard Kurle, Rishi Shah, Rob Romijnders, Rohin Arora, Romain Sauvestre, Roman Soletskyi, Rosalie Millner, Rupert Menneer, Sagar Vaze, Samuel Barry, Samuel Belkadi, Samuel Humeau, Sanchit Gandhi, Sandeep Subramanian, Sarthak Mittal, Saskia Adaime, Sean Cha, Sebastian Kaltenbach, Shashwat Dalal, Shashwat Verma, Sherif Waly, Shrimai Prabhumoye, Siddhant Waghjale, Siddharth Gandhi, Simon Lepage, Simon Sorg, Soham Ghosh, Sophie Marbach, Srijan Mishra, Stanislas Lange, Steve Hong, Sumukh Aithal, Szymon Antoniak, Tarun Kumar Vangani, Teven Le Scao, Theo Cachet, Thibaut Lavril, Thomas Chabal, Thomas Coste, Thomas Defard, Thomas Foubert, Thomas Robert, Thomas Wang, Tianyu Zhang, Tim Lawson, Timothee Lacroix, Tobias Kronlachner, Tom Bewley, Tom Edwards, Tomas Hodan, Tuhin Das, Tyler Wang, Ulrick BLE, Umar Jamil, Umberto Tomasini, Valentin Mace, Van Phung, Vedant Nanda, Victor Jouault, Victor Letzelter, Victor Paltz, Victor Poucheret, Vincent Maladiere, Vincent Pfister, Virgile Richard, Vladislav Bataev, Wassim Bouaziz, Wen Ding Li, William Havard, William Marshall, Xinghui Li, Xingran Guo, Xinyu Yang, Yann Dreze, Yassine El Ouahidi, Yassir Bendou, Yihan Wang, Yimu Pan, Yves Martin des Taillades, Zaccharie Ramzi, Zhenlin Xu, Zsofia Csakany

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 研究旨在解决大规模导航系统部署问题,提出Robostral Navigate模型,仅用单目RGB图像流预测路点,具鲁棒性。通过模拟场景减少对真实数据依赖,用前缀缓存训练等方法,在基准测试中达新最优,提升导航系统性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19719 2026-08-04 cs.LG cs.RO 版本更新 73%

Koopman Dreamer: Spectrally Constrained Latent Dynamics for Stable World-Model Imagination

库普曼梦想家:用于稳定世界模型想象的频谱约束潜在动力学

Jiaqi Li, Xinglong Zhang, Haibin Xie, Yixing Lan, Wei Pan, Xin Xu

机构 * College of Intelligence Science and Technology, National University of Defense Technology(国防科技大学智能科学与技术学院) School of Engineering, Newcastle University(纽卡斯尔大学工程学院)

专题命中 具身导航 :navigation(abstract);world model(abstract);分类 cs.RO、cs.LG

AI总结 研究针对潜在世界模型长期展开中模态持久性和误差积累控制有限的问题,提出库普曼梦想家模型,通过频谱约束潜在动力学核心及多种目标结合优化,推导误差界,实验证明其提高了长期潜在展开稳定性及闭环控制性能。

Comments 20 pages, 13 figures, 11 tables. Revised manuscript with a more concise and precise abstract and improved clarity and presentation throughout the main text. The main technical content, experimental results, and conclusions remain unchanged

详情

展开后加载摘要…

URL PDF HTML 收藏