arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-06-09 至 2026-06-09 共收录 54 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 18 篇

2606.06033 2026-06-09 cs.RO 版本更新 86%

RealDexUMI: A Wearable Universal Manipulation Interface for Dexterous Robot Learning

RealDexUMI:用于灵巧机器人学习的可穿戴通用操作接口

Chaoyi Xu, Yixuan Jiang, Jiahui Huan, Yuhui Fu, Haoyu Zhou, Weitian Yuan, Jiayi Yu, Wanpeng Zhang, Haoqi Yuan, Zongqing Lu

机构 * Peking University(北京大学) BeingBeyond Beihang University(北航) LinkerBot Tsinghua University(清华大学)

专题命中 机器人操作 :manipulation(title,abstract);robot learning(title);分类 cs.RO

AI总结 提出RealDexUMI,一种基于共享灵巧末端执行器模块的可穿戴通用操作接口,通过掌侧同构遥操作手套实现无重定向、直观精确的手部控制,在八项真实机器人任务中平均成功率达88.75%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20689 2026-06-09 cs.RO 版本更新 83%

FingerEye: Learning Dexterous Manipulation with Continuous Vision-Tactile Sensing

FingerEye:通过连续视觉-触觉感知学习灵巧操作

Zhixuan Xu, Yichen Li, Xuanye Wu, Tianyu Qiu, Lin Shao

机构 * National University of Singapore(新加坡国立大学) RoboScience(机器人科学) Huazhong University of Science and Technology(华中科技大学) South China University of Technology(华南理工大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 FingerEye通过连续视觉-触觉感知提升机器人灵巧操作,结合视觉和触觉反馈,在模拟和现实环境中使腕部策略的成功率提升超30个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01661 2026-06-09 cs.RO 版本更新 79%

Symskill: Symbol and Skill Co-Invention for Data-Efficient and Reactive Long-Horizon Manipulation

Symskill:符号与技能共发明用于数据高效且反应性强的长周期操作

Yifei Simon Shao, Yuchen Zheng, Sunan Sun, Pratik Chaudhari, Vijay Kumar, Nadia Figueroa

机构 * GRASP Laboratory, University of Pennsylvania(GRASP实验室,宾夕法尼亚大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 Symskill通过联合学习谓词、运算符和技能,实现了数据高效且反应性强的长周期操作,结合了组合泛化与实时恢复能力。

Comments ICRA 2026 Best Conference Paper Award; ICRA 2026 Best Paper Award on Planning and Control; CoRL 2025 Best Paper Award on Learning Effective Abstractions for Planning (LEAP) Workshop (https://symskill.github.io/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11934 2026-06-09 cs.RO 版本更新 79%

Robot-DIFT: Correspondence-Sensitive Diffusion Features for Contact-Rich Robot Manipulation

Robot-DIFT: 用于接触丰富机器人操作的对应敏感扩散特征

Yu Deng, Yufeng Jin, Xiaogang Jia, Jiahong Xue, Gerhard Neumann, Georgia Chalvatzaki

机构 * TU Darmstadt(图宾根大学) KIT(卡尔斯鲁厄理工学院) FZI(弗劳恩霍夫研究所) Hessian.AI(黑森人工智能公司) Robotics Institute Germany(德国机器人研究所) Honda Research Institute Europe GmbH(本田欧洲研究院)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 提出Robot-DIFT,通过流形蒸馏将扩散模型转化为确定性学生网络,结合空间-语义特征金字塔网络,为接触敏感任务提供实时对应敏感特征,在多个基准上超越现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12263 2026-06-09 cs.CL cs.AI cs.LG 版本更新 76%

Multimodal Generative Engine Optimization: Rank Manipulation for Vision-Language Model Rankers

多模态生成式引擎优化:针对视觉-语言模型排序器的排名操纵

Yixuan Du, Chenxiao Yu, Haoyan Xu, Ziyi Wang, Yue Zhao, Xiyang Hu

机构 * Georgetown University(乔治城大学) University of Southern California(南加州大学) University of Maryland, College Park(马里兰大学学院公园分校) Arizona State University(亚利桑那州立大学)

专题命中 机器人操作 :manipulation(title);分类 cs.AI、cs.LG

AI总结 提出多模态生成式引擎优化(MGEO)方法,通过联合优化图像扰动和文本后缀,利用视觉-语言模型内部跨模态知识耦合,实现对产品排名的有效操纵,揭示了多模态基础模型知识基础的脆弱性。

Comments Proceedings of the 4th Workshop on Towards Knowledgeable Foundation Models (KnowFM) at ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02274 2026-06-09 cs.RO 版本更新 70%

Dexterity-BEV: Aligning 3D World and Actions for Generalizable Robot Policies Learning

Dexterity-BEV: 对齐3D世界与动作以实现通用机器人策略学习

Huayi Zhou, Wei Gao, Dekun Lu, Ruiji Liu, Zhanqi Zhang, Ziyang Zhang, Jian Chen, Wenlve Zhou, Sheng Xu, Shumin Li, Kangyi Guo, Shichen Xu, Zixin Huang, Yongyi Su, Kui Jia

机构 * DexForce Technology(德克斯技术公司) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出Dexterity-BEV框架,通过对齐顶点图和顶点谱的3D表示以及鸟瞰图对齐,解决2D基础模型在3D操作中的局限性,提升机器人策略的泛化能力。

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20591 2026-06-09 cs.RO 版本更新 70%

LightTact: A Visual-Tactile Fingertip Sensor for Deformation-Independent Contact Sensing

LightTact: 一种用于变形无关接触感知的视觉-触觉指尖传感器

Changyi Lin, Boda Huo, Mingyang Yu, Emily Ruppel, Bingqing Chen, Jonathan Francis, Ding Zhao

机构 * Carnegie Mellon University(卡内基梅隆大学) Bosch Center for Artificial Intelligence (BCAI)(博世人工智能中心(BCAI))

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出LightTact传感器,通过环境光阻断光学配置实现变形无关的接触检测,在无宏观变形下(如液体、超软材料)实现高对比度接触分割,并解锁轻接触机器人操作。

Comments Project website: https://linchangyi1.github.io/LightTact

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01324 2026-06-09 cs.RO 版本更新 61%

Integrated Hierarchical Decision-Making in Inverse Kinematic Planning and Control

集成化分层决策在逆运动学规划与控制中

Kai Pfeiffer, Quan Zhang, Yuqing Chen, Gordon Boateng, Yuquan Wang, Vincent Bonnet, Aberrahmane Kheddar

机构 * University of Cambridge(剑桥大学)

专题命中 机器人操作 :robotics(abstract,comments);分类 cs.RO

AI总结 本文提出一种高效的非线性规划框架,整合分层决策与全身逆运动学规划控制,解决逆运动学规划中同时选择端效应器位置的问题。

Comments Accepted paper to "Robotics: Science and Systems" (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06497 2026-06-09 cs.GR cs.CV cs.HC 版本更新 57%

Real-Time AttentionBender: Granular Interactive Network Bending of Video Diffusion Transformers

实时注意力弯曲:视频扩散变换器的粒度交互式网络弯曲

Adam Cole, Rebecca Fiebrink, Mick Grierson

机构 * Creative Computing Institute(创意计算研究所) University of the Arts London(伦敦艺术大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 提出实时注意力弯曲工具,通过操纵视频扩散变换器的自注意力、交叉注意力及前馈网络,实现逐层、逐步、逐令牌的交互式生成控制,增强艺术家的创作代理与模型材料亲密性。

Comments 5 pages, 4 figures. Accepted to ACM Creativity & Cognition XAIxArts Workshop 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08304 2026-06-09 cs.CR cs.AI 版本更新 57%

Securing Retrieval-Augmented Generation: A Taxonomy of Attacks, Defenses, and Future Directions

保障检索增强生成:攻击、防御与未来方向的分类法

Yuming Xu, Mingtao Zhang, Zhuohan Ge, Haoyang Li, Nicole Hu, Yongqi Zhang, Zhiyuan Wen, Jason Chen Zhang, Qing Li, Lei Chen

机构 * The Hong Kong Polytechnic University(香港理工大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 本文提出SLOT分类法,从攻击面、防御层、目标(遵循CIA属性)和攻击目标四个维度系统化梳理检索增强生成(RAG)的安全风险与防御,并指出知识访问管道中的结构性错配,最后展望未来方向。

Comments We have curated a paper list on RAG security in https://github.com/TreeAI-Lab/Awesome-RAG-Security, and we warmly welcome authors who wish to have their new work included to contact us via email

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17245 2026-06-09 cs.AI 版本更新 57%

Web Agents Should Use Typed Actions Instead of Click-Based Browsing

Web 智能体应使用类型化动作而非基于点击的浏览

Linxi Jiang, Rui Xi, Zhijie Liu, Shuo Chen, Zhiqiang Lin, Suman Nath

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 本文提出通过语义层支持的类型化动作(web verbs)替代低层交互原语,以构建可靠、可审计的Web智能体,并通过案例展示其优势。

Comments Accepted to the ICML 2026 Position Paper Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03256 2026-06-09 cs.CV 版本更新 57%

Muses: Designing, Composing, Generating Nonexistent Fantasy 3D Creatures without Training

Muses: 无需训练的设计、组合与生成不存在的幻想3D生物

Hexiao Lu, Xiaokun Sun, Zeyu Cai, Hao Guo, Ying Tai, Jian Yang, Zhenyu Zhang

机构 * Nanjing University(南京大学) China Agricultural University(中国农业大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 提出Muses,首个无需训练的馈送式幻想3D生物生成方法,利用3D骨架实现结构感知的设计、组合与生成,在视觉保真度和文本对齐方面达到最优。

Comments Project page: https://luhexiao.github.io/Muses.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06399 2026-06-09 cs.CL 版本更新 50%

CollabSim: A CSCW-Grounded Methodology for Investigating Collaborative Competence of LLM Agents through Controlled Multi-Agent Experiments

CollabSim: 一种基于CSCW的方法,通过受控多智能体实验研究LLM智能体的协作能力

Jiaju Chen, Bo Sun, Yuxuan Lu, Yun Wang, Dakuo Wang, Bingsheng Yao

机构 * Northeastern University(东北大学) Microsoft Research Asia(微软亚洲研究院)

专题命中 机器人操作 :manipulation(abstract)

AI总结 提出CollabSim框架,结合CSCW理论定义协作能力、控制交互条件并探测智能体内部状态,以系统分析LLM多智能体系统的协作能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.02676 2026-06-09 physics.optics 版本更新 50%

Valley-locked Optical Spin Merons in Valley Photonic Crystal Waveguides

谷锁定的光旋磁体在谷光子晶体波导中的研究

Lvjin He, Shanshan Chen, Ziyang Chen, Lan Zhang, Lipeng Wan, Weimin Deng, Tianbao Yu

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出利用拓扑保护的谷边态实现光旋磁体在芯片上的稳健定向传输,通过谷自由度实现谷锁定的旋磁体,为光子系统中的应用提供新途径。

Comments 17 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07906 2026-06-09 physics.flu-dyn 版本更新 50%

Tuning Cross-stream Lift in Viscoelastic Shear: Distinct Hydrodynamic Signatures of Force-bearing and Force-free Mechanisms

调节粘弹性剪切中的跨流提升:力承载与力自由机制的水动力特征

Soumyodeep Chowdhury, Kushagra Tiwari, Jitendra Dhakar, Akash Choudhary

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究了粒子在粘弹性剪切流中受外力驱动时的升力和阻力修正,发现驱动机制决定升力方向,力承载机制与力自由机制产生相反的升力。通过推导流场和应力,证明其差异源于不同的水动力扰动,产生不同的聚合物应力分布。

Comments Four figures, revised version of manuscript

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04464 2026-06-09 cs.CY econ.GN q-fin.EC 版本更新 50%

Bounded by Risk, Not Capability: Quantifying AI Occupational Substitution Rates via a Tech-Risk Dual-Factor Model

受风险限制而非能力:通过技术-风险双因素模型量化AI职业替代率

Shuyao Gao, Minghao Huang

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文通过技术-风险双因素模型量化AI职业替代率,揭示了职业替代并非瞬间发生,而是渐进过程,并指出算法概率无法涵盖专家受专业责任限制的'机构溢价'。

Comments 32 pages, 4 figures. v2: added link to the reproducibility repository (https://github.com/ShuyaoGao/bounded-risk-oai), updated author email, and updated several references

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14402 2026-06-09 cs.SI cs.GT 版本更新 50%

A Unified Framework for Scalable and Robust Paper Assignment

可扩展且稳健的论文分配统一框架

Michael Cui, Chenxin Dai, Yixuan Even Xu, Fei Fang

专题命中 机器人操作 :manipulation(abstract)

AI总结 提出RAMP框架,通过线性化扰动最大化目标和属性感知采样,在大型会议中平衡分配质量、多样性和鲁棒性,实现20分钟内处理2万篇论文和审稿人。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23457 2026-06-09 cs.CR 版本更新 50%

Future-Proofing Authentication Against Insecure Bootstrapping for 5G Networks: Feasibility, Resiliency, and Accountability

面向5G网络的不安全启动认证的未来防护:可行性、弹性与可问责性

Saleh Darzi, Mirza Masfiqur Rahman, Imtiaz Karim, Rouzbeh Behnia, Attila A Yavuz, Elisa Bertino

专题命中 机器人操作 :manipulation(abstract)

AI总结 针对5G初始启动阶段缺乏基站认证导致易受虚假基站攻击的问题,提出BORG框架,采用分层身份基门限签名与故障停止属性,实现分布式信任、可验证伪造检测和抗量子审计日志,并在真实5G测试平台上验证了其低开销和紧凑签名。

Comments 21 pages, 3 tables, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身导航 11 篇

2605.06317 2026-06-09 cs.CV cs.AI 版本更新 81%

NavOne: One-Step Global Planning for Vision-Language Navigation on Top-Down Maps

NavOne: 一种基于顶部向下地图的视觉语言导航的一步全局规划

Dijia Zhan, Jinyi Li, Chenxi Zheng, Shaoyu Huang, Yong Li, Jie Tang, Xuemiao Xu

机构 * South China University of Technology(南方科技大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI、cs.CV

AI总结 本文提出了一种基于顶部向下地图的视觉语言导航方法,通过引入NavOne框架,实现多模态地图的单步全局路径规划,显著提升了导航效率和性能。

Comments 10 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02519 2026-06-09 cs.RO 版本更新 79%

IMAC-AgriVLN: Can Agricultural Vision-and-Language Navigation Agents be Aware of Instruction Mistakes?

IMAC-AgriVLN:农业视觉与语言导航智能体能否意识到指令错误?

Xiaobei Zhao, Xingqi Lyu, Xin Chen, Xiang Li

机构 * China Agricultural University(中国农业大学) China Agricultural University-Sichuan Advanced Agricultural & Industrial Institute(中国农业大学-四川先进农业与工业研究院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 针对农业VLN中指令可能错误的问题,提出A2A-MI基准和IMAC模块,通过分析指令与前方图像判断并纠正错误,显著提升导航性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01205 2026-06-09 cs.RO 版本更新 79%

ImagineUAV: Aerial Vision-Language Navigation via World-Action Modeling and Kinodynamic Planning

ImagineUAV:通过世界-动作建模和动力学规划实现空中视觉语言导航

Xuchen Liu, Jiawei Huang, Shihao Xia, Bingxi Liu, Jinqiang Cui, Jiankun Yang

机构 * Pengcheng Laboratory(鹏城实验室) School of Computer Science and Cyber Engineering(计算机科学与网络工程学院) Guangzhou University(广州大学) Southern University of Science and Technology(南方科技大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 针对无人机视觉语言导航中几何不一致和动力学失配问题,提出基于潜视频扩散模型的世界-动作建模框架,通过生成未来观测推断6自由度运动并规划无碰撞轨迹,以1.3B参数在基准和实际飞行中超越先前方法。

Comments Video demo: https://www.youtube.com/watch?v=Ng1alP0yhc0

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23082 2026-06-09 q-bio.NC 版本更新 78%

Spatial navigation in preclinical Alzheimer's disease: A review

阿尔茨海默病前期阶段的空间导航:综述

Syrine Salouhou, Victor Gilles, Remi Vallée, Gillian T. Coughlan, Romain Bachelet, Michael Hornberger, Hugo Spiers, Antoine Coutrot, Antoine Garnier-Crussard

专题命中 具身导航 :navigation(title,abstract)

AI总结 本文综述了阿尔茨海默病前期阶段空间导航的认知功能,探讨其与AD病理标志物如p-tau的相关性,提出空间导航任务作为早期检测高风险个体的敏感方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.19749 2026-06-09 eess.IV cs.CV 版本更新 70%

SPIRONet: Spatial-Frequency Learning and Graph-based Channel Interaction Network for Vessel Segmentation

SPIRONet:用于血管分割的空间-频率学习与基于图的通道交互网络

De-Xing Huang, Xiao-Hu Zhou, Xiao-Liang Xie, Shi-Qi Liu, Shuang-Yi Wang, Zhen-Qiu Feng, Mei-Jiang Gui, Hao Li, Tian-Yu Xiang, Bo-Xian Yao, Zeng-Guang Hou

机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)

专题命中 具身导航 :robotics(abstract);navigation(abstract);分类 cs.CV

AI总结 提出SPIRONet,通过双空间-频率编码器、交叉注意力融合和基于图的通道交互模块,解决低信噪比、细小血管和强干扰下的血管分割难题,在五个数据集上取得最优性能。

Comments Accepted by Biomedical Signal Processing and Control. 15 Pages, 9 Figures, 13 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00917 2026-06-09 cs.RO cs.CV cs.LG 版本更新 67%

A Survey on Deep Multi-Task Learning in Connected Autonomous Vehicles

联网自动驾驶车辆中深度多任务学习综述

Jiayuan Wang, Farhad Pourpanah, Q. M. Jonathan Wu, Ning Zhang

机构 * Department of Electrical and Computer Engineering, University of Windsor(温莎大学电气与计算机工程系) Department of Electrical and Computer Engineering, Queen’s University(皇后大学电气与计算机工程系)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV、cs.LG

AI总结 综述联网自动驾驶车辆中深度多任务学习,涵盖感知、预测、规划、控制及V2X通信与资源管理,分析现有方法优缺点并指出未来方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20906 2026-06-09 cs.CV cs.RO 版本更新 62%

Distant Object Localisation from Noisy Image Segmentation Sequences

基于噪声图像分割序列的远距离目标定位

Julius Pesonen, Arno Solin, Eija Honkavaara

机构 * Research Council of Finland(芬兰研究理事会) RCF Flagship Forest–Human–Machine Interplay—Building Resilience, Redefining Value Networks and Enabling Meaningful Experiences (UNITE)(RCF旗舰森林-人类-机器交互——构建韧性,重新定义价值网络和赋能有意义体验(UNITE))

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 针对远距离目标定位问题,提出多视图三角测量和粒子滤波两种方法,后者还能提供形状和不确定性估计,结合无人机图像分割与GNSS姿态估计实现可靠野火监测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22243 2026-06-09 cs.RO 版本更新 57%

SODA-CitrON: Static Object Data Association by Clustering Multi-Modal Sensor Detections Online

SODA-CitrON:通过在线聚类多模态传感器检测实现静态物体数据关联

Jan Nausner, Kilian Wohlleben, Michael Hubner

机构 * Jan Nausner, Kilian Wohlleben, Michael Hubner

专题命中 具身导航 :robotics(abstract);分类 cs.RO

AI总结 本文提出SODA-CitrON方法,通过在线聚类多模态传感器检测实现静态物体的数据关联,同时估计位置并维持持久跟踪,优于现有方法在F1分数、位置RMSE、MOTP和MOTA指标上。

Comments 8 pages, 5 figures; \c{opyright} 2026 IEEE. Accepted for the 2026 International Conference on Information Fusion (FUSION 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03606 2026-06-09 cs.LG 版本更新 57%

Observation-driven correction of numerical weather prediction for marine winds

基于观测驱动的海洋风数值天气预报修正

Matteo Peduto, Qidong Yang, Jonathan Giezendanner, Devis Tuia, Sherrie Wang

专题命中 具身导航 :navigation(abstract);分类 cs.LG

AI总结 提出ORCA模型,利用Transformer架构融合稀疏、异质的海洋观测数据,实时修正GFS风场预报,在0-48小时预报时效内误差降低13%-45%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14413 2026-06-09 eess.SP 版本更新 56%

Comprehensive Review of Doppler Shift Localization Methods: Advances, Limitations, and Research Opportunities

多普勒位移定位方法综述:进展、局限与研究机会

Rafal Szczepanik

专题命中 具身导航 :navigation(abstract,comments)

AI总结 本文综述了非合作发射机在GNSS不可用或退化环境中的可靠定位方法,分析了多普勒技术的演变、测量模型和估计器,并探讨了环境特定部署和开放研究挑战。

Comments 27 pages, 1 table. TransNav: International Journal on Marine Navigation and Safety of Sea Transportation (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02383 2026-06-09 cs.MA cs.GT cs.SY eess.SY 版本更新 50%

A Game-Theoretic Decision Framework for Optimal Selection of Coordination Detection Methods in Multi-UAV Fleet Operations

多无人机编队操作中协调检测方法最优选择的博弈论决策框架

Christian Manasseh, Savana Ammons

专题命中 具身导航 :navigation(abstract)

AI总结 提出一个博弈论决策框架,通过将方法选择建模为监控者与自然之间的零和博弈,解决多无人机编队协调检测中速度与准确性的权衡问题,并利用混合策略保证最坏情况下的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身推理 7 篇

2605.01799 2026-06-09 cs.CV 版本更新 87%

Embody4D: A Generalist Data Engine for Embodied 4D World Modeling

Embody4D: 面向具身4D世界建模的通用数据引擎

Peiyan Tu, Hanxin Zhu, Jingwen Sun, Shaojie Ren, Cong Wang, Yuyan Xu, Jiayi Luo, Xiaoqian Cheng, Zhibo Chen

机构 * Zhejiang University(浙江大学) Beijing Zhongguancun Academy(北京中关村学院) University of Science and Technology of China(中国科学技术大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Shanghai Jiao Tong University(上海交通大学) Beihang University(北京航空航天大学)

专题命中 具身推理 :world model(title,abstract);embodied agent(abstract);manipulation(abstract);robotic(abstract)

AI总结 提出Embody4D视频到视频世界模型,通过3D感知合成管道、潜在置信度专家调制和交互注意力机制,将单目机器人视频转换为多视角视频,解决具身智能中视角稀疏问题,提升下游规划与学习性能。

详情

展开后加载摘要…

URL PDF HTML 收藏