arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-07-10 至 2026-07-10 共收录 76 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 3 篇

2509.01838 2026-07-10 cs.LG cs.AI 76%

Goal-Conditioned Reinforcement Learning for Data-Driven Maritime Navigation

面向数据驱动的航海导航的基于目标的强化学习

Vaishnav Vaidheeswaran, Dilith Jayakody, Samruddhi Mulay, Anand Lo, Md Mahbub Alam, Gabriel Spadon

机构 * Faculty of Computer Science(计算机科学学院)

专题命中 模仿学习与强化学习 :navigation(title);分类 cs.AI、cs.LG

AI总结 本文提出基于目标的强化学习方法,用于数据驱动的航海导航,通过多离散动作空间学习优化路线,结合动作掩码与正向奖励提升策略性能。

Journal ref IEEE International Conference on Big Data (BigData), 2025, pp. 1194-1203

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15136 2026-07-10 cs.LG cs.AI 版本更新 62%

Safe Flow Q-Learning: Offline Safe Reinforcement Learning with Reachability-Based Flow Policies

安全流Q学习:基于可达性的安全离线强化学习流策略

Mumuksh Tayal, Manan Tayal, Ravi Prakash

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

AI总结 本文提出Safe Flow Q-Learning,结合达性启发的安全价值函数和高效的一步流策略,通过自一致性Bellman递归学习安全价值,行为克隆训练流策略并转化为奖励最大化安全动作选择器,减少部署时的拒绝采样,提升实时安全应用性能。

Comments 21 pages, 6 figures, 3 tables; First 2 authors have contributed equally; Paper accepted at Reinforcement Learning Conference (RLC) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 人机交互与遥操作 1 篇

2511.03075 2026-07-10 cs.RO 版本更新 79%

A Collaborative Reasoning Framework for Anomaly Diagnostics in Underwater Robotics

水下机器人异常诊断的协作推理框架

Markus Buchholz, Niamh Ellis, Rahaf Abu Hara, Ignacio Carlucho, Yvan R. Petillot

机构 * School of Engineering & Physical Sciences, Heriot-Watt University(工程与物理科学学院,赫瑞斯泰大学)

专题命中 人机交互与遥操作 :robotics(title,abstract);分类 cs.RO

AI总结 研究水下机器人异常诊断,提出AURA协作框架,集成大语言模型、数字孪生和人在回路交互,通过两个代理进行异常检测与诊断,经人类验证的诊断转化为训练示例完善模型,建立可信赖、不断改进的人机团队模式。

Comments Paper was submitted for ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 机器人数据与评测 9 篇

2607.08127 2026-07-10 cs.CV cs.RO 新提交 73%

Understanding and Mitigating the Video-Action Generalization Gap via Temporal Ratio

通过时间比率理解和缓解视频动作泛化差距

Utkarsh A. Mishra, Yongxin Chen, Danfei Xu, Yang Liu, Xi Chen, Jiayuan Mao

机构 * Georgia Tech(佐治亚理工学院) Amazon FAR(亚马逊FAR)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 研究视频动作泛化差距,引入时间比率(TR),通过TR衡量动作头对未来潜在展开的依赖程度,提出推理时自适应引导方法,利用TR特性缓解组合泛化差距。

Comments 26 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07972 2026-07-10 cs.RO 新提交 70%

In vivo feasibility study of humanoid robots in surgery

人形机器人在手术中的体内可行性研究

Zekai Liang, Nikita Thareja, Peihan Zhang, Calvin Joyce, Soofiyan Atar, Florian Richter, Garth Jacobsen, Shanglei Liu, Ryan Broderick, Michael Yip

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 研究评估人形机器人用于腹腔镜手术任务的可行性,开发基于人形机器人的腹腔镜远程操作框架,通过多种评估量化其技术可行性等,为手术应用中当前人形机器人的能力和局限性提供基于证据的评估,突出前景与关键挑战。

Journal ref Nature (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08741 2026-07-10 cs.GR cs.CV cs.LG cs.RO 新提交 67%

ARDY: Autoregressive Diffusion with Hybrid Representation for Interactive Human Motion Generation

ARDY:用于交互式人体运动生成的具有混合表示的自回归扩散

Kaifeng Zhao, Mathis Petrovich, Haotian Zhang, Tingwu Wang, Siyu Tang, Davis Rempe

机构 * NVIDIA(英伟达) ETH Zürich(苏黎世联邦理工学院)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO、cs.CV、cs.LG

AI总结 研究旨在解决交互式应用中人体运动生成问题,提出ARDY框架,采用混合表示和两阶段自回归变压器去噪器,能通过在线文本提示和运动学约束实现高保真运动生成,经评估验证了有效性和实用性。

Comments ACM Transactions on Graphics (SIGGRAPH 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07962 2026-07-10 cs.CV cs.AI 新提交 62%

Beyond Thermal Imaging: Inferring Thermophysical Properties from Time-Resolved Thermal Observations

超越热成像:从时间分辨热观测中推断热物理性质

Chenghao Xu, Malcolm Mielle, Olga Fink

机构 * École polytechnique fédérale de Lausanne(洛桑联邦理工学院) Schindler Holding AG(迅达控股公司)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.AI、cs.CV

AI总结 研究从热观测推断热物理性质的问题,提出ThermoField框架,通过可微热传递模拟统一热场景重建和热物理参数估计,能在复杂3D场景中联合重建几何、估计热扩散率并预测热演变,为相关研究提供统一方法。

Comments 31 pages, In submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04100 2026-07-10 cs.CV cs.AI 版本更新 62%

TOPO-Bench: An Open-Source Topological Mapping Evaluation Framework with Quantifiable Perceptual Aliasing

TOPO-Bench:一个具有可量化感知混叠的开源拓扑映射评估框架

Jiaming Wang, Jizhuo Chen, Diwen Liu, Harold Soh

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.AI、cs.CV

AI总结 针对拓扑映射缺乏标准评估体系及感知混叠量化不足的问题,提出将拓扑一致性形式化并以定位精度为替代指标,还给出数据集模糊度定量度量,开源相关数据集、基线及工具,推动拓扑映射研究的一致性与可重复性。

Comments Jiaming Wang, Diwen Liu, and Jizhuo Chen contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18235 2026-07-10 cs.CV cs.RO 版本更新 62%

BiasBench: A reproducible benchmark for tuning the biases of event cameras

BiasBench:用于调整事件相机偏差的可重现基准测试

Andreas Ziegler, David Joseph, Thomas Gossard, Emil Moldovan, Andreas Zell

机构 * Cognitive Systems Group, University of Tübingen(图宾根大学认知系统组)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO、cs.CV

AI总结 研究针对事件相机偏差调整工具少的问题,提出BiasBench这一包含多场景的可重现事件数据集,并展示三个场景及下游应用质量指标,还提出基于强化学习的方法促进在线偏差调整。

Comments Accepted to CVPR 2025 Workshop on Event-based Vision

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08674 2026-07-10 cs.CV 新提交 57%

Do Transformations Reveal the Truth? Generative Residual Learning for Generalized AI-Generated Image Detection

变换能揭示真相吗?用于广义人工智能生成图像检测的生成残差学习

Kutub Uddin, Nusrat Tasnim, Awais Khan, Mohammad Umar Farooq, Khalid Malik

机构 * University of Michigan Flint(密歇根大学弗林特分校) Korea Aerospace University(韩国航空航天大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.CV

AI总结 针对生成式AI带来的威胁及AIGI检测难题,提出GenRes框架,通过神经张量网络建模关系特征增强泛化;引入GenRes++,用注意力机制聚合多变换样本特征;利用PE-Core提取特征,实验证明GenRes++性能优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07763 2026-07-10 cs.LG 新提交 57%

Unlocking Temporal Generalization in Hamiltonian Video Dynamics Models

解锁哈密顿视频动力学模型中的时间泛化

Eli Laird, Corey Clark

机构 * Department of Computer Science, Southern Methodist University(南卫理公会大学计算机科学系)

专题命中 机器人数据与评测 :world model(abstract);分类 cs.LG

AI总结 研究世界模型在可变时间分辨率下预测动力学的问题,利用哈密顿生成网络(HGN),指出其在非保守环境中时间泛化失效的问题及原因,通过针对性修复实现稳定动力学预测,推荐连续时间视频生成中时间泛化的策略。

Comments To appear in the 1st Workshop on Physics-Aware Video Generation and Restoration at the 28th International Conference on Pattern Recognition

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08033 2026-07-10 eess.IV 新提交 50%

SCI-Mamba: Unsupervised Learning based Low-Light Image Enhancement for Non-Cooperative Spacecraft

SCI-Mamba:基于无监督学习的非合作航天器低光图像增强

Yiyong Sun, Weihang Shan, Shijun Wei, Diwei Zhou, Guang Zhai

专题命中 机器人数据与评测 :robotic(abstract)

AI总结 针对非合作航天器低光图像增强问题,提出SCI-Mamba无监督增强网络,结合自校准无监督学习等,构建数据集,经与其他方法比较,验证其在视觉、色彩及速度方面优势,为空间操作提供实用低光增强方案。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 其他机器人 4 篇

2607.08098 2026-07-10 cs.CV cs.RO 新提交 62%

EVIS: A Physics-Grounded Event Camera Plugin for NVIDIA Isaac Sim

EVIS:用于NVIDIA Isaac Sim的基于物理的事件相机插件

Linli Shi, Ruijun Zhang, Ziyun Wang

机构 * Johns Hopkins University(约翰霍普金斯大学)

专题命中 其他机器人 :robotics(abstract);分类 cs.RO、cs.CV

AI总结 研究针对事件相机数据收集难题,提出基于物理的EVIS插件用于NVIDIA Isaac Sim,能在模拟器内生成带标签事件流,通过特定模型和可配置设置实现实时单GPU生成,其流可供预训练网络用于下游任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.04203 2026-07-10 cs.LG cs.CV 版本更新 62%

Computation, Condensation, and the Incompleteness Between Them: A Coupled Foundation of Intelligence

计算、凝聚及其之间的不完备性:智能的耦合基础

Xin Li

机构 * Department of Computer Science, University at Albany, SUNY(计算机科学系,阿尔巴尼大学,SUNY)

专题命中 其他机器人 :embodied agent(abstract);分类 cs.CV、cs.LG

AI总结 该研究探讨计算理论与智能所回答问题的差异,指出智能需计算与记忆两个算子耦合,证明单独算子不完备,确定耦合代价是关键操作不可判定且有误差下限,认为耦合是普遍法则并给出其可证伪核心与范围。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08610 2026-07-10 econ.GN q-fin.EC 新提交 50%

Sharing economy in the era of full automation: Evidence from autonomous vehicle on-demand mobility services

全自动化时代的共享经济:来自自动驾驶按需出行服务的证据

Xiaoyan Wang, Kenan Zhang, Yaochen Ma

专题命中 其他机器人 :robotic(abstract)

AI总结 研究自动驾驶按需出行服务中的共享经济,构建时间扩展网络流模型,分析其降低运营成本的条件及关键因素,通过芝加哥案例揭示时空异质性及调度优势,为相关众包系统性能研究提供见解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07906 2026-07-10 cond-mat.soft physics.bio-ph physics.med-ph 新提交 50%

Understanding quorum sensing self-organization: Clustering and defect-induced ordering of diffusing particles

理解群体感应自组织:扩散粒子的聚类和缺陷诱导排序

Feifei Liu, Vyacheslav R. Misko, Yunyun Li, Fabio Marchesoni

专题命中 其他机器人 :robotics(abstract)

AI总结 研究群体感应自组织,通过数值模拟,用慢、快扩散胶体粒子与缺陷粒子组成模型系统,发现热缺陷引发QS粒子再入凝固,冷缺陷产生无定形结构,加深对QS相互作用理解,提供控制组织程度机制及潜在应用。

Comments 9 pages, 8 figures (first version submitted on May 14, 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏