arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-08-17 至 2026-08-17 共收录 53 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身推理 8 篇

2608.14481 2026-08-17 cs.RO cs.AI 新提交 74%

Ensuring Safe Physical AI in Urban Mobility via Hazard-Informed Synthesized Envelopes

通过危险信息合成包络确保城市移动中的安全物理人工智能

Alexei Odinokov, Rostislav Yavorskiy

机构 * Xortech DOO

专题命中 具身推理 :world model(abstract);robotic(abstract);分类 cs.RO、cs.AI;robotics(comments)

AI总结 针对异构机器人城市部署的安全挑战,提出结合危险分析与运行时执行的统一框架,通过跨层安全转换保障物理AI的城市移动安全。

Comments The 2026 International Conference on Control, Robotics Engineering and Technology (CRET 2026), this https URL (https://www.cret.net/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13901 2026-08-17 cs.RO 新提交 74%

Ontology-Grounded World Models for Failure Diagnosis and Closed-Loop Repair in Physical AI Systems

用于物理人工智能系统故障诊断与闭环修复的本体论驱动世界模型

Kailin Wang, Haoxiang Jie, Yaoyuan Yan, Jiacheng Zhou, Zhiyou Heng

机构 * AI Lab, Country Garden Services Group(碧桂园服务集团AI实验室) Fudan University(复旦大学) Omni AI

专题命中 具身推理 :world model(title);分类 cs.RO

AI总结 本文提出分层于EV-WM之上的Onto-EV-WM本体驱动接口,在PointMaze、LIBERO-Goal等基准测试中实现高故障修复成功率,为物理AI系统提供有效的故障诊断与闭环修复方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14530 2026-08-17 cs.CV cs.AI 新提交 62%

Marionette: Predicting World States, Rendering Geometry, Painting Appearance

Marionette:预测世界状态、渲染几何、绘制外观

Zian Meng, Zhen Li, Chuanhao Li, Qiang Li, Kaipeng Zhang

机构 * Alaya Lab(Alaya实验室) Shanghai Innovation Institute(上海创新研究院) Huazhong University of Science and Technology(华中科技大学)

专题命中 具身推理 :world model(abstract);分类 cs.AI、cs.CV

AI总结 Marionette是面向带关节角色的交互式游戏的世界模型,通过显式建模3D世界状态、委托几何计算、合成外观,实现了可控的长时序行为,且外观生成无明显保真度损失。

Comments Project page: this https URL (https://alayalab.github.io/Marionette/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14125 2026-08-17 cs.AI 新提交 57%

Traj-LeWM: Path-Aware World-Model Planning via Latent Trajectory Cost

Traj-LeWM:通过潜在轨迹代价实现路径感知的世界模型规划

Xiaodi Huang, Ziyi Ding, Jingtian Wan, Yuchen Liu, Yuan Zhang, Xiao-Ping Zhang, Jiayu Chen, Zhang Zhang, Tao Huang

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Shanghai Jiao Tong University(上海交通大学) Tsinghua Shenzhen International Graduate School(清华大学深圳国际研究生院) The University of Hong Kong(香港大学) INFIFORCE University of Science and Technology of China(中国科学技术大学) Peking University(北京大学)

专题命中 具身推理 :world model(abstract);分类 cs.AI

AI总结 本文针对LeWM的局限提出Traj-LeWM,通过引入潜在轨迹代价结合终点距离的联合评分,在多个机器人与导航任务上实现性能提升,验证了轨迹级信息的互补作用。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人基础模型 1 篇

2602.09430 2026-08-17 cs.RO cs.AI 版本更新 73%

AtomBridge: Agentic VLA Inference Plugin for Long-Horizon Tasks in Scientific Experiments

Sci-VLA:用于科学实验中长周期任务的代理VLA推理插件

Yiwen Pang, Bo Zhou, Changjin Li, Xuanhao Wang, Shengxiang Xu, Deng-Bao Wang, Peng Cheng, Shimin Di, Jingkuan Song, Min-Ling Zhang

机构 * School of Computer Science and Engineering & School of Software Engineering & School of Artificial Intelligence, Southeast University, Nanjing, China(计算机科学与工程学院、软件工程学院、人工智能学院,东南大学,南京,中国) Pattern Learning and Mining Lab, Southeast University, Nanjing, China(模式学习与挖掘实验室,东南大学,南京,中国)

专题命中 机器人基础模型 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 本文提出了一种基于大语言模型的代理VLA推理插件,用于提升科学实验中长周期任务的执行效率和成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 模仿学习与强化学习 3 篇

2608.14332 2026-08-17 cs.RO cs.LG 新提交 62%

CORAL: Curriculum-Optimized Reward Adaptation for LiDAR-Based Goal-Directed Urban Driving

CORAL:面向基于激光雷达的目标导向城市驾驶的课程优化奖励适配

Anisa Saleem, Duksu Kim

机构 * Korea University of Technology and Education (KOREATECH)(韩国技术教育大学)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.LG

AI总结 CORAL结合五阶段课程与阶段感知奖励,在CARLA中训练多流演员-评论家策略,实现基于激光雷达的城市驾驶,长路线约束下成功率显著优于PPO基线,且可零样本跨城镇迁移。

Comments 13 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14498 2026-08-17 cs.LG cs.DC 新提交 57%

Rollplex: Cross-Phase GPU Spatial Sharing for Vision Language Model Post-Training

Rollplex:面向视觉语言模型后训练的跨阶段GPU空间共享

Hanfeng Lu, Tianyu Feng, Suyi Li, Yuheng Zhao, Wei Gao, Shaopan Xiong, Ju Huang, Siran Yang, Jiamang Wang, Lin Qu, Wei Wang

机构 * HKUST(香港科技大学) Alibaba Inc(阿里巴巴公司)

专题命中 模仿学习与强化学习 :embodied agent(abstract);分类 cs.LG

AI总结 Rollplex是一种跨阶段GPU空间共享运行时,通过解耦RL后训练的参考与训练阶段、优化内存与并行度,提升VLMs后训练的GPU利用率与训练速度。

Comments 16 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14082 2026-08-17 cs.RO 新提交 57%

PILOT: Privileged Imitation Learning for End-to-End Motion Planning of Autonomous UAVs under Partial Observability

PILOT:部分可观测条件下自主无人机端到端运动规划的特权模仿学习方法

Qingrui Zhang, Feng Xue, Xiang Zhou, Chenghao Yu

机构 * School of Aeronautics and Astronautics, Sun Yat-sen University(中山大学航空航天学院) Sun Yat-sen University(中山大学)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO

AI总结 本文提出PILOT框架,通过特权模仿学习结合TCN时空感知融合模块,实现部分可观测下无人机端到端运动规划,性能接近最优控制专家且计算开销降超80%,零样本部署验证其可行性与泛化性。

Comments 13 Pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 人机交互与遥操作 3 篇

2608.14406 2026-08-17 cs.RO physics.ins-det 新提交 79%

Effect of Twisted-Yarn Architecture on Pressure and Proximity Sensing Characteristics of Textile Capacitive Sensors for Robotic Skin

捻纱结构对用于机器人皮肤的纺织电容式传感器的压力与接近传感特性的影响

Ishtia Zahir, Eslam Saleh, Maryam Rezayati, Güunter Grabher, Gaffar Hossain

机构 * V-Trion GmbH(V-Trion有限公司) Institute of Mechatronic Systems, ZHAW Zurich University of Applied Sciences(苏黎世应用科技大学机电系统研究所) Grabher Group GmbH(格拉伯集团有限公司)

专题命中 人机交互与遥操作 :robotic(title,abstract);分类 cs.RO

AI总结 本研究开发基于银涂层纱线的纺织电容传感器,探究捻纱层数对其压力、接近传感等特性的影响,实现传感性能调谐,验证其可用于机器人皮肤的实时触觉检测。

Comments 10 pages. Submitted to IEEE Transactions on Instrumentation and Measurement

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11461 2026-08-17 cs.RO 版本更新 57%

CoViLLM: An Adaptive Human-Robot Collaborative Assembly Framework Using Large Language Models

CoViLLM:一种利用大语言模型的自适应人机协作装配框架

Jiabao Zhao, Jonghan Lim, Hongliang Li, Ilya Kovalenko

机构 * The Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 人机交互与遥操作 :manipulation(abstract);分类 cs.RO

AI总结 本文提出CoViLLM框架,结合深度相机定位、人类操作员分类和大语言模型,实现定制化和新产品的自适应装配,通过NIST装配任务板验证,实验表明该框架提升了人机协作的灵活性。

Comments 6 pages, 7 figures. Accepted to ASME MSEC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10818 2026-08-17 cs.CV cs.PF 版本更新 57%

Resource-Efficient RGB-Only Action Recognition for Edge Deployment

高效边缘部署的纯RGB动作识别

Dongsik Yoon, Jongeun Kim, Dayeon Lee

机构 * HDC LABS, Republic of Korea(韩国HDC实验室)

专题命中 人机交互与遥操作 :robotic(abstract);分类 cs.CV

AI总结 本文提出了一种高效的纯RGB动作识别网络,通过时间移位和无参数注意机制,在边缘设备上实现了准确率与效率的良好平衡。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 机器人数据与评测 10 篇

2601.02078 2026-08-17 cs.RO 版本更新 77%

Genie Sim 3.0: A High-Fidelity Comprehensive Simulation Platform for Humanoid Robot

Genie Sim 3.0:人形机器人综合仿真平台

Chenghao Yin, Da Huang, Di Yang, Jichao Wang, Nanshu Zhao, Chen Xu, Wenjun Sun, Linjie Hou, Zhijun Li, Junhui Wu, Zhaobo Liu, Zhen Xiao, Sheng Zhang, Lei Bao, Rui Feng, Zhenquan Pang, Jiayu Li, Qian Wang, Maoqing Yao

机构 * AgibotTech(Agibot科技)

专题命中 机器人数据与评测 :robot learning(abstract);manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 Genie Sim 3.0通过高保真场景生成和开放数据集,提升机器人学习模型的泛化能力与仿真到现实的迁移效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14284 2026-08-17 cs.RO cs.CV 新提交 73%

PRM-as-a-Judge 1.5: A Toolkit for Robot Process Assessment

PRM-as-a-Judge 1.5:机器人过程评估工具包

Yuyang Liu, Yanqing Shen, Ruike Chen, Jifan Zhao, Yuxuan Tian, Yichi Zhang, Tianfeng Long, Zixuan Yin, Yipu Wang, Ziheng Qin, Wenxing Tan, Yang Shi, Mingyu Cao, Runze Xiao, Ziqi Wang, Zhixin Yin, Shiwei Chu, Yi-Fan Zhang, Yao Mu, Yuheng Ji, Yihao Wang, Jun Yan, Zhongyuan Wang, Pengwei Wang, Xiaolong Zheng

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 该研究推出PRM-as-a-Judge 1.5工具包,新增三个评估指标并结合RoboPulse++,发布含基准与可视化工具的评估套件,呼吁建立透明可复现的机器人评估体系。

Comments Project page: this https URL (https://prm-as-a-judge.github.io)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29599 2026-08-17 cs.RO cs.CV 版本更新 66%

How to Relieve Distribution Shifts in Semantic Segmentation for Off-Road Environments

如何缓解越野环境语义分割中的分布偏移

Ji-Hoon Hwang, Daeyoung Kim, Hyung-Suk Yoon, Dong-Wook Kim, Seung-Woo Seo

机构 * Department of Electrical and Communication Engineering, Seoul National University(电子与通信工程系,首尔国立大学)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO、cs.CV;robotics(comments)

AI总结 提出ST-Seg框架,通过风格扩展和纹理正则化缓解越野场景中源-目标域差异和传感器退化导致的分布偏移,提升语义分割鲁棒性。

Comments 8 pages, 6 figures. Accepted to IEEE Robotics and Automation Letters (RA-L)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13719 2026-08-17 cs.AI cs.RO 新提交 62%

Coverage Aware Active Evaluation for Failure Discovery with Paired Systems

面向配对系统故障发现的覆盖率感知主动评估

Anjali Parashar, Rachel Luo, Apoorva Sharma, Sushant Veer, Edward Schmerling, Carson Sobolewski, Mingxin Yu, Chuchu Fan, Marco Pavone

机构 * Laboratory of Information & Decision Systems (LIDS), MIT(麻省理工学院信息与决策系统实验室(LIDS)) NVIDIA Research(英伟达研究院)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO、cs.AI

AI总结 该研究针对自主系统故障发现难题,提出结合代理评估与残差建模、支持感知互信息目标的自适应方法,在三类任务中发现的故障数是基线的两倍。

Comments 9 main pages followed by Appendix, total 21 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01236 2026-08-17 cs.RO cs.AI 版本更新 62%

LLM-Advisor: An LLM Advisor for Cost-efficient Path Planning across Multiple Terrains

LLM-Advisor: 一种用于多地形高效路径规划的LLM基准

Ling Xiao, Toshihiko Yamasaki

机构 * Graduate School of Information Science and Technology, Hokkaido University(弘前大学信息科学与技术研究生院) Department of Information and Communication Engineering, The University of Tokyo(东京大学信息与通信工程系)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 LLM-Advisor利用大型语言模型优化多地形路径规划,提升路径成本效率,适用于现实场景。

Comments This paper has been accepted by IEEE Transactions on Automation Science and Engineering

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14490 2026-08-17 cs.AI 新提交 57%

Twin: Playing an Unknown Game with a Test-Time Digital Twin

Twin:利用测试时数字孪生玩未知游戏

Alexy Skoutnev, Kirill Acharya, Gaston Longhitano, Madeleine Udell, Kevin Ellis, Iddo Drori

专题命中 机器人数据与评测 :world model(abstract);分类 cs.AI

AI总结 该研究提出Twin系统,通过测试时数字孪生构建可执行世界模型,在ARC-AGI-3等未知游戏中通关率达97.8%,效率优于人类,核心是通过模拟交互和反例修复推断游戏规则与目标。

Comments Project website with action-by-action replays of all 25 runs: this https URL (https://arc-agi-3-twin.vercel.app/) Code: this https URL (AGI-3" target="_blank" rel="noopener">https://github.com/Alexyskoutnev/TWIN-ARC-AGI-3)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14407 2026-08-17 cs.AI 新提交 57%

The Past and Future of AI Scientists

AI科学家的过去与未来

Ross D. King

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.AI

AI总结 本文综述AI科学家的过去与未来,指出其核心挑战是多技术集成,现有技术已支持构建更通用系统,其有望变革科学,诺贝尔图灵挑战目标进展超前。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10155 2026-08-17 eess.IV cs.CV 版本更新 57%

Data-driven registration and modeling of brain deformation for image-guided neurosurgery

数据驱动的图像配准与变形建模在图像引导神经外科中的应用:系统综述

Tiago Assis, Colin P. Galvin, Joshua P. Castillo, Nazim Haouchine, Marta Kersten-Oertel, Zeyu Gao, Mireia Crispin-Ortuzar, Stephen J. Price, Thomas Santarius, Yangming Ou, Sarah Frisken, Nuno C. Garcia, Alexandra J. Golby, Reuben Dorent, Ines P. Machado

机构 * LASIGE, Faculty of Sciences, University of Lisbon(里斯本大学科学学院LASIGE) Department of Neurosurgery and Department of Radiology, Brigham and Women's Hospital, Harvard Medical School(哈佛医学院布里洛妇女医院神经外科与放射科) Gina Cody School of Engineering and Computer Science, Concordia University(康科迪亚大学工程与计算机科学学院) Cancer Research UK Cambridge Centre, University of Cambridge(剑桥大学癌症研究英国中心) Department of Oncology, University of Cambridge(剑桥大学肿瘤科) Department of Clinical Neurosciences, University of Cambridge(剑桥大学临床神经科学系) Computational Health Informatics Program (CHIP) and Department of Radiology, Boston Children's Hospital, Harvard Medical School(哈佛医学院波士顿儿童医院计算健康信息学计划与放射科) Sorbonne Université, Institut du Cerveau - Paris Brain Institute - ICM(索邦大学巴黎脑研究所-ICM)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.CV

AI总结 系统综述2020-2025年间基于学习的脑变形补偿方法,包括深度学习配准、变形场回归、多模态对齐、切除感知架构及混合模型,指出当前方法在鲁棒性、标准化基准、可解释性和临床部署方面的局限,并展望未来研究方向。

Comments 41 pages, 7 figures, 9 tables. Final postprint version available in Medical Image Analysis at this https URL (https://doi.org/10.1016/j.media.2026.104217)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04491 2026-08-17 cs.RO 版本更新 57%

Estimating Dynamic Soft Continuum Robot States From Boundaries

从边界估计动态软体连续体机器人的状态

Tongjia Zheng, Jessica Burgner-Kahrs

机构 * The Continuum Robotics Laboratory(连续机器人实验室) the Robotics Institute at the University of Toronto(多伦多大学机器人研究所)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 本研究提出一种基于基座力/力矩测量的对偶边界观测器,实现动态无穷维软体连续体机器人状态估计,兼具传感需求低、增益调参高效等优势,经仿真与实验验证了其性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14433 2026-08-17 cond-mat.soft 新提交 50%

Surface Roughness and Filler Restructuring in Magneto-Active Elastomers: Magnetically Hard versus Magnetically Soft Particles

磁活性弹性体中的表面粗糙度与填料重构:硬磁粒子与软磁粒子的对比

Júlio P. A. Santos, Mehdi Hasanzade, Chaitanya Doifode, Raphael Kriegl, Alexander Kovalev, Mikhail Shamonin, Stanislav N. Gorb, Sofia Kantorovich

专题命中 机器人数据与评测 :robotics(abstract)

AI总结 本研究通过分子动力学对比研究了相同饱和磁化强度下,填充硬磁与软磁粒子的磁活性弹性体的表面粗糙度与填料重构差异,明确了二者不同的演化路径,并指出需开发考虑羰基铁微粒子多畴特性的软磁模型。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 其他机器人 2 篇

2608.13958 2026-08-17 cs.AI cs.CY cs.LO 新提交 57%

Implementing Computational Law in Wolfram Language for the Governance of Artificial Intelligence

用Wolfram语言实现计算法以用于人工智能治理

James K. Wiles

机构 * Wolfram Institute for Computational Foundations of Science(沃尔夫勒姆计算基础科学研究所)

专题命中 其他机器人 :embodied agent(abstract);分类 cs.AI

AI总结 本文在Wolfram语言中实现Reified Input/Output Logic,测试GPT-4转换英文法律陈述的情况,通过AI看门狗案例展示计算法可作为AI治理工具,理想目标是形式化可编程执行的法律。

Comments 25 pages, 1 figure, 2 tables, 12 code listings. Wolfram Language implementation and verification script (31 assertions) available at this https URL (https://github.com/Zaffer/research-computational-law)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22580 2026-08-17 cs.RO 版本更新 57%

Versatile Exoskeleton Control Supports Elderly Joint Energetics During Hip-Intensive Tasks

任务无关的外骨骼控制支持老年人在髋部高强度任务中的关节能量代谢

Jiefu Zhang, Nikhil V. Divekar, Chandramouli Krishnan, Robert D. Gregg

机构 * Department of Robotics, University of Michigan(机器人学系,密歇根大学)

专题命中 其他机器人 :robotic(abstract);分类 cs.RO

AI总结 本文提出了一种任务无关的髋部外骨骼控制器,通过高精度匹配生物功率曲线,显著减少髋部生物正功并提升总功率,为老年人移动提供新的生物力学干预方案。

详情

展开后加载摘要…

URL PDF HTML 收藏