arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-07-31 至 2026-07-31 共收录 26 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 1 篇

2505.04999 2026-07-31 cs.RO cs.AI cs.LG 版本更新 82%

CLAM: Continuous Latent Action Models for Robot Learning from Unlabeled Demonstrations

CLAM:基于未标记演示的连续潜在动作模型用于机器人学习

Anthony Liang, Pavel Czempin, Matthew M. Hong, Yutai Zhou, Jingzhen Wang, Erdem Biyik, Stephen Tu

机构 * Department of Computer Science, University of Southern California(南加州大学计算机科学系) Department of Electrical and Computer Engineering, University of Southern California(南加州大学电气与计算机工程系)

专题命中 机器人学习 :robot learning(title);manipulation(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 CLAM通过连续潜在动作标签和联合训练动作解码器,有效解决复杂连续控制任务中未标记数据的学习问题,实现在DMControl和MetaWorld等基准及真实机器人上的性能提升。

Comments Latent Action Models, Self-supervised Pretraining, Learning from Videos

Journal ref IEEE/RSJ International Conference on Intelligent Robots and Systems 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 12 篇

2603.01229 2026-07-31 cs.RO cs.AI 版本更新 88%

RMBench: Memory-Dependent Robotic Manipulation Benchmark with Insights into Policy Design

RMBench: 具有政策设计洞察的内存依赖机器人操作基准

Tianxing Chen, Yuran Wang, Mingleyang Li, Yan Qin, Hao Shi, Zixuan Li, Yifan Hu, Yingsheng Zhang, Kaixuan Wang, Yue Chen, Hongcheng Wang, Junjie Wang, Tianhang Yang, Renjing Xu, Ruihai Wu, Yao Mu, Yaodong Yang, Hao Dong, Ping Luo

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO、cs.AI

AI总结 RMBench通过9个涵盖多层级内存复杂度的任务系统评估政策内存能力,提出Mem-0模块化政策支持可控消融研究,揭示现有政策的内存限制及架构设计对内存性能的影响。

Comments website: https://rmbench.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05117 2026-07-31 cs.RO 版本更新 83%

SeedPolicy: Horizon Scaling via Self-Evolving Diffusion Policy for Robot Manipulation

SeedPolicy: 通过自进化扩散策略实现机器人操控的水平扩展

Youqiang Gui, Yuxuan Zhou, Shen Cheng, Xinyang Yuan, Haoqiang Fan, Peng Cheng, Shuaicheng Liu

机构 * Sichuan University(四川大学) Dexmal Inc.(Dexmal公司) Independent Researcher(独立研究员) UESTC

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出SEGA模块,通过门控注意力机制提升扩散策略在长时域操控中的表现,实验表明其在RoboTwin 2.0基准上优于现有方法,具有更高的效率和性能。

Comments 17 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11891 2026-07-31 cs.RO cs.LG 版本更新 81%

Critic Architecture Matters: Dual vs. Unified Critics for Humanoid Loco-Manipulation

评论家架构的重要性:双评论家与统一评论家在人形机器人移动操作中的对比

Mehmet Turan Yardımcı

机构 * Department of Computer Engineering(计算机工程系) Çukurova University(丘布亚大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO、cs.LG

AI总结 针对人形机器人多目标强化学习,对比统一评论家与双评论家架构,实验表明双评论家策略在到达速度、吞吐量和成功率上显著优于统一评论家,且架构选择比奖励工程影响更大。

Comments Accepted at the ICRA 2026 Workshop on Reinforcement Learning for Imitation Learning (RL4IL), Vienna. 5 pages, 2 figures. v2: corrects the unified-critic run's curriculum level (10 of 40) and per-run environment counts, adds a Confounding Factors section, and softens the causal framing; measurements unchanged. https://mturan33.github.io/critic-architecture-matters/

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13349 2026-07-31 cs.CV cs.AI 版本更新 81%

ID-Guard: A Universal Framework for Combating Facial Manipulation via Breaking Identification

ID-Guard:一种通过破坏身份特征来对抗面部操纵的通用框架

Zuomin Qu, Wei Lu, Xiangyang Luo, Qian Wang, Xiaochun Cao

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.AI、cs.CV

AI总结 本研究针对面部操纵滥用的问题,提出ID-Guard通用框架,通过身份破坏模块生成跨模型可迁移扰动,可防御多种操纵模型并集成到其他任务中。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02764 2026-07-31 cs.RO 版本更新 79%

MorphQuad: Morphable Quadrotor for Superhuman Maneuverability, Manipulation, and Resiliency

MorphQuad:具有超人机动性、操纵性和弹性的可变形四旋翼飞行器

Jose Diaz Peon Gonzalez Pacheco, Jiawei Xu, Andrew Zhao, Hongyu Zhou, Atharva Navsalkar, Andrew Scheffer, Amrith Malli Reddi, Sashreek Shankar, Yuqing Bao, Vasileios Tzoumas

机构 * University of Michigan(密歇根大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 研究旨在实现具有高机动性、操纵性和弹性的飞行器。核心方法是硬件与控制协同设计,让四旋翼飞行器各旋翼系统独立铰接并采用全局稳定控制等。主要贡献是展示了MorphQuad在多方面的优异性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20290 2026-07-31 cs.GR cs.CV 版本更新 70%

PhysOmni: Physics-Grounded Multi-Object Scene Generation from a Single Image with Real-Time Interaction

TelePhysics: 从单张图像生成物理一致的多物体场景 with 实时交互

Xin Zhang, Yabo Chen, Yijie Fang, Wanying Qu, Haibin Huang, Chi Zhang, Feng Xu, Xuelong Li

机构 * Fudan University(复旦大学) Institute of Artificial Intelligence, China Telecom (TeleAI)(中国电信人工智能研究院(TeleAI))

专题命中 机器人操作 :manipulation(abstract,abstract_cn);分类 cs.CV

AI总结 本文提出TelePhysics,一种无需训练的框架,通过整体场景级3D重建将单张图像转换为物理一致且可控的视频。该方法通过统一的空间坐标系统表示完整场景几何,解决物体穿透和对齐模糊问题,实现准确的多物体交互和更丰富的复杂控制类型,从而在保持逼真视觉保真度的同时实现实时物理交互预览。

Comments ACMMM 2026. Project page: https://physomni.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14584 2026-07-31 cs.RO 版本更新 70%

A Robust Placeability Metric for Model-Free Unified Pick-and-Place Reasoning

一种针对无模型统一抓取放置推理的鲁棒放置性度量

Benno Wingender, Nils Dengler, Rohit Menon, Sicong Pan, Maren Bennewitz

机构 * Anonymous Authors(匿名作者) Benno Wingender(伯恩诺·温格德尔) Nils Dengler(尼尔·登格尔) Rohit Menon(罗希特·梅农) Sicong Pan(斯冰·潘) Maren Bennewitz(马伦·本内维茨)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出一种鲁棒的概率放置性度量,通过联合评估稳定性、抓取性和空隙,实现无模型的统一抓取放置推理,并在仿真和真实机器人实验中验证其有效性。

Comments IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12287 2026-07-31 cs.RO 版本更新 70%

SharedAssembly: A Data Collection Approach via Shared Tele-Assembly

SharedAssembly:一种通过共享远程装配实现的数据收集方法

Yansong Wu, Xiao Chen, Yu Chen, Hamid Sadeghian, Fan Wu, Zhenshan Bing, Alois Knoll

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 SharedAssembly是一种新型共享自主双边远程操作框架,可高效采集高精度小间隙装配数据,消除技能差距,新手操作员使用该框架即可达到甚至超过传统系统中专家的表现。

Comments 7 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20722 2026-07-31 cs.CV cs.AI 版本更新 62%

DinoLizer: Separating VAE and Diffusion Artifacts in Generative Inpainting Localization

DinoLizer: 从最佳中学习以实现生成修复的定位

Minh Thong Doi, Vincent Itier, Jan Butora, Jérémie Boulanger, Patrick Bas

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI、cs.CV

AI总结 DinoLizer基于DINOv2改进生成修复中的篡改定位,通过滑动窗口和后处理提升鲁棒性,实现更高的IoU性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30775 2026-07-31 stat.AP stat.ML 版本更新 50%

Bayesian Classification with Probit-link Split-and-merge Gaussian Process Prior in EEG-based Brain-Computer Interfaces

基于脑电图脑机接口中Probit-link分裂合并高斯过程先验的贝叶斯分类

Yunong Wu, Jane E. Huggins, Jian Kang, Tianwen Ma

专题命中 机器人操作 :manipulation(abstract)

AI总结 提出一种基于Probit-link分裂合并高斯过程先验的贝叶斯生成模型,用于脑电图响应二元分类,实现时空特征选择并降低计算复杂度,同时保持预测精度。

Comments 32 pages, 7 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28808 2026-07-31 quant-ph 版本更新 50%

Device-Agnostic Microwave Noise Metrology for Nonlinear Cryogenic Quantum Devices

非线性低温量子器件的设备无关微波噪声计量

Andrea Celotto, Alessandro Alocco, Bernardo Galvano, Luca Fasolo, Emanuele Palumbo, Luca Callegaro, Luca Oberto, Patrizia Livreri, Emanuele Enrico

专题命中 机器人操作 :manipulation(abstract)

AI总结 提出一种基于可控噪声源替代被测器件的原位噪声计量协议,结合普朗克光谱与散射参数校准,实现非线性低温微波器件增益与输入参考附加噪声的便携式表征。

Comments 12 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24846 2026-07-31 physics.optics 版本更新 50%

NIR and visible structured beam generation with a dual-force mechanical long-period fiber grating

利用机械长周期光纤光栅生成近红外和可见结构化光束

Wen-Hsuan Kuan, Xin-Yu Hou, Kuei-Huei Lin, Vidar Gudmundsson

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文通过机械长周期光纤光栅在少模光纤中生成多种结构化光束,包括涡旋、矢量和平顶光束,并实现超过5米的传播不变性。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身导航 4 篇

2603.02291 2026-07-31 cs.RO 版本更新 79%

Goal-Oriented Semantic Communication for ISAC-Enabled Robotic Obstacle Avoidance

面向目标的语义通信用于ISAC赋能的机器人避障

Wenjie Liu, Yansha Deng, Henk Wymeersch

机构 * Department of Engineering, King’s College London(工程系,伦敦国王学院) Department of Electrical Engineering, Chalmers University of Technology(电气工程系,查尔姆斯理工大学)

专题命中 具身导航 :robotic(title);navigation(abstract);分类 cs.RO

AI总结 本文提出面向目标的语义通信框架,通过卡尔曼滤波和动态窗口方法提高无人机避障效率,减少信号传输量达92.4%。

Comments 16 pages, 20 figures. Accepted for publication in IEEE Transactions on Wireless Communications. Author-accepted manuscript

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02941 2026-07-31 cs.RO 版本更新 79%

Metrics vs Surveys: An Analysis for Human-Aligned Benchmarking in Social Robot Navigation

指标与调查:社交机器人导航中人类对齐基准测试的分析

Stefano Trepella, Mauro Martini, Noé Pérez-Higueras, Andrea Ostuni, Fernando Caballero, Luis Merino, Marcello Chiaberge

机构 * Department of Electronics and Telecommunications, Politecnico di Torino(理工学院电子与电信系) School of Engineering, Pablo de Olavide University(奥尔塔维德大学工程学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本研究分析社交机器人导航中数值指标与以人为中心调查的关系,发现现有指标未充分体现主观因素,需开发新指标,为人类对齐基准测试提供参考。

Comments Presented at IEEE RO-MAN 2026 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11970 2026-07-31 cs.RO 版本更新 57%

ARCSnake V2: Mechanical Adaptations For An Amphibious Multi-Domain Screw-Propelled Snake-Like Robot

ARCSnake V2:适用于水陆两栖多领域的螺旋推进蛇形机器人的机械改进

Sara Wickenhiser, Lizzie Peiros, Calvin Joyce, Peter Gavrilov, Sujaan Mukherjee, Syler Sylvester, Junrong Zhou, Mandy Cheung, Jason Lim, Florian Richter, Michael C. Yip

机构 * Mechanical and Aerospace Engineering Department, University of California San Diego(加州大学圣地亚哥分校机械与航空航天工程系) Electrical and Computer Engineering Department, University of California, San Diego(加州大学圣地亚哥分校电气与计算机工程系)

专题命中 具身导航 :robotic(abstract);分类 cs.RO

AI总结 ARCSnake V2是ARCSnake V1的改进型两栖螺旋推进蛇形机器人,结合超冗余蛇形机器人高机动性与阿基米德螺旋推进的地形适应性,经实验验证具备水下作业能力,可作为多领域探索等任务的多功能平台。

Comments 8 pages, 5 figures, IROS

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06056 2026-07-31 physics.space-ph 版本更新 50%

LdT: An indicator of ionospheric activity based on statistical distributions in GNSS-derived TEC rates of change

LdT: 基于GNSS导出的TEC变化率统计分布的电离层活动指标

Paul Kinsler, Biagio Forte

专题命中 具身导航 :navigation(abstract)

AI总结 提出一种基于GNSS信号传播扰动的新指标LdT,通过统计TEC变化率的分布,近实时描述电离层在特定空间天气条件下的状态,并表征其时空演化。

Comments 18 pages, currently online at: Advances in Space Research, in press (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 具身推理 1 篇

2607.23969 2026-07-31 cs.RO 版本更新 70%

LeapBot-WA: World-Anchor Action Models via Predictive Latent Alignments

LeapBot-WA:通过预测性潜在对齐实现的世界锚定动作模型

Pei Liu, Nan Zheng, Lang Zhang, Daojie Peng, Yanan Zhang, Feilong Kong, Mingyue Feng, Jiachao Liu, Yaonong Wang, Qifeng Chen, Jun Ma

专题命中 具身推理 :world model(abstract);robotic(abstract);分类 cs.RO

AI总结 研究针对世界动作模型依赖像素级视频生成的瓶颈,提出LeapBot-WA,通过预测性潜在对齐建立新范式,引入ISAE弥合模态差距,设计MoT架构,在多数据集上表现出色,实现高效强大的潜在中心范式及零样本鲁棒性和现实世界迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 机器人基础模型 1 篇

2603.22078 2026-07-31 cs.RO 版本更新 70%

Do World Action Models Generalize Better than VLAs? A Robustness Study

世界动作模型是否比视觉语言动作模型表现更好?一项鲁棒性研究

Zhanguang Zhang, Zhiyuan Li, Behnam Rahmati, Rui Heng Yang, Yintao Ma, Amir Rasouli, Sajjad Pakdamansavoji, Yangzheng Wu, Lingfeng Zhang, Tongtong Cao, Feng Wen, Xinyu Wang, Xingyue Quan, Yingxue Zhang

机构 * Huawei Technologies(华为技术有限公司) University of Toronto(多伦多大学)

专题命中 机器人基础模型 :world model(abstract);robotic(abstract);分类 cs.RO

AI总结 本文比较了最新状态的VLA策略和最近发布的WAMs,在不同视觉和语言扰动下评估其性能,发现WAMs在鲁棒性上表现更强,而VLA需要大量训练数据和多样化学习目标。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 模仿学习与强化学习 3 篇

2603.13707 2026-07-31 cs.RO cs.AI cs.LG 版本更新 82%

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning

REFINE-DP:通过强化学习实现人形机器人的动态-操作协调政策微调

Zhaoyuan Gu, Yipu Chen, Zimeng Chai, Alfred Cueva, Thong Nguyen, Yifan Wu, Huishu Xue, Minji Kim, Isaac Legene, Fukang Liu, KyoungMok Kim, Ayan Barula, Yongxin Chen, Ye Zhao

机构 * The Institute for Robotics and Intelligent Machines(机器人与智能机械研究所)

专题命中 模仿学习与强化学习 :manipulation(title,abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 本文提出REFINE-DP框架,通过联合优化扩散政策高层规划器和基于强化学习的低层动态-操作控制器,提升人形机器人在复杂环境中的任务成功率与执行稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26434 2026-07-31 cs.RO cs.AI 版本更新 62%

Reinforcement Learning on Cost-Constrained Quadrupedal Hardware

成本受限四足硬件上的强化学习

Javier C. Weddington, Bence P. Ölveczky, Stephen A. Baccus

机构 * Stanford University(斯坦福大学) Harvard University(哈佛大学) Stanford University School of Medicine(斯坦福大学医学院)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.AI

AI总结 该研究针对低成本四足硬件的仿真-现实差距,采用生物启发方法,结合延迟前向模型与时间感知神经网络,学习到鲁棒CPG,实现了成本受限硬件上的强化学习控制。

Comments Sim-to-real transfer, locomotion, reinforcement learning, central pattern generator

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01110 2026-07-31 cs.RO 版本更新 57%

Compact Task-Aligned Imitation Learning for Laboratory Automation

紧凑的任务对齐模仿学习用于实验室自动化

Kanata Suzuki, Hanon Nakamura, Kana Miyamoto, Tetsuya Ogata

机构 * Spatial Robotics Research Center, Fujitsu Limited.(富士通株式会社空间机器人研究中心) Faculty of Science and Engineering, Waseda University(早稻田大学理工学部) National Institute of Advanced Industrial Science and Technology(国家工业科学与技术研究院)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

AI总结 本文提出了一种紧凑的模仿学习框架,通过小基础模型和扩散变换器专家实现高效实验室自动化,实验显示其在三个任务中的高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏

7. 机器人数据与评测 3 篇

2601.13732 2026-07-31 cs.RO 版本更新 57%

SUNSET - A Sensor-fUsioN based semantic SegmEnTation exemplar for ROS-based self-adaptation

SUNSET -- 一种基于传感器融合的语义分割示例,用于基于ROS的自适应系统

Andreas Wiedholz, Rafael Paintner, Alwin Hoffmann, Carlos Hernandez, Tobias Huber

机构 * XITASO GmbH(XITASO公司) German Aerospace Center (DLR) Institute of Flight Systems(德国航空航天中心(DLR)飞行系统研究所)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 SUNSET是一种基于ROS2的自适应系统示例,通过传感器融合语义分割流水线和训练好的机器学习模型,实现对动态环境中的不确定性进行严格评估和自适应处理。

Comments Accepted at RoSE Workshop 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04680 2026-07-31 cs.RO math.OC 版本更新 57%

A Three-Stage Offline SDRE-Based Control Framework for Human Motion Reproduction on a Suspended Bipedal Robot

用于悬挂式双足机器人人体运动复现的三阶段离线SDRE控制框架

Ping-Kong Huang, Chien-Wu Lan, Chin-Tien Wu, Ching-Kai Lin

机构 * Department of Applied Mathematics, National Yang Ming Chiao Tung University(应用数学系,阳明交通大学) Department of Electrical Engineering, National Central University(电气工程系,国立中央大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 本文针对下肢外骨骼人体评估的安全风险,提出三阶段离线SDRE控制框架,结合PID-LQR补偿,在悬挂式双足机器人上实现行走、下蹲运动的高精度可重复复现,性能优于基准控制器。

Comments 14 pages, 11 figures. Preliminary version submitted for documentation purposes on arXiv

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11640 2026-07-31 q-fin.TR cs.CY q-fin.CP 版本更新 50%

Fill-Side Behavioral Concentration on Polymarket: Identification Limits under Record-Level Attribution

Polymarket上的非零售交易:在报价归属限制下的行为层级和微观结构特征实证研究

Maksym Nechepurenko

专题命中 机器人数据与评测 :manipulation(abstract)

AI总结 本文研究Polymarket非零售参与行为,发现其离线CLOB架构导致地址层面报价生命周期无法追踪,通过密度聚类发现交易行为单峰分布,且通过特征分层实现稳健的零售与非零售分离。

Comments 9 pages, 2 propositions, 2 tables. Major pre-publication correction: the archived sample is a 2.285-day legacy-CTF-only block range, not a seven-day venue sample. The revision makes record-level two-sided attribution and mint/burn direction limits explicit and narrows clustering and concentration claims. No new empirical run

详情

展开后加载摘要…

URL PDF HTML 收藏

8. 其他机器人 1 篇

2603.01512 2026-07-31 cond-mat.soft 版本更新 50%

A hyperelastic theory for nonlinear hydrogel diffusiophoresis

非线性水凝胶扩散电泳的弹性理论

Chinmay Katke, C. Nadir Kaplan

专题命中 其他机器人 :robotics(abstract)

AI总结 本研究提出非线性弹性理论,用于预测大变形水凝胶的快速扩散电泳行为,适用于软机器人和药物输送应用。

Comments 22 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏