arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-07-30 至 2026-07-30 共收录 18 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 18 篇

2607.26452 2026-07-30 cs.AI cs.CV cs.GR 新提交 84%

CG-World: A Large-Scale World-State Dataset and Protocol for World Models

CG-World:面向世界模型的大规模世界状态数据集与协议

Yiming Cai, Fangjie Yu, Meiqing Yu, Ziyue Shi, Pengfei Yuan, Yong Guo

专题命中 机器人数据与评测 :world model(title,abstract);robotics(abstract);分类 cs.AI、cs.CV

AI总结 CG-World是源自工业计算机图形流水线的大规模世界状态数据集,含约85万时间对齐片段,支持干预学习与反事实推理,经评估可为世界模型相关任务提供结构化监督,拟打造共享数据基础设施。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23704 2026-07-30 cs.RO cs.CV 版本更新 84%

LabRobFail: A Benchmark for Robotic Failure Analysis in Chemical Self-driving Laboratory

LabRobFail:化学自动驾驶实验室中机器人故障分析的基准

Haobo Wang, Baoli Sun, Anqi Zou, Dongsheng Huang, Zelin Lv, Ning Wang, Rui Li, Dongzhan Zhou, Weiyu Guo, Zhihui Wang, Wanli Ouyang

专题命中 机器人数据与评测 :robotic(title,abstract);embodied agent(abstract);分类 cs.RO、cs.CV

AI总结 针对化学自动驾驶实验室中机器人可靠性受化学实验特性限制、故障数据稀缺及评估协议缺乏等问题,引入LabRobFail框架,通过注入故障构建数据集,开发专门模型,提升故障检测等能力及下游任务成功率。

Comments Under review. Haobo Wang and Baoli Sun contributed equally. Code and data: https://github.com/Su-ISE-2001/SciRobo

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26232 2026-07-30 cs.CV 新提交 79%

BG-REAL: A Public Real-Data Anchored Benchmark for Background Manipulation Detection and Localization

BG-REAL:用于背景篡改检测与定位的公共真实数据锚定基准

Bugra Alperen Uluirmak, Rifat Kurban

机构 * Erciyes University(埃尔西耶斯大学) Abdullah Gül University(阿卜杜拉居尔大学)

专题命中 机器人数据与评测 :manipulation(title,abstract);分类 cs.CV

AI总结 BG-REAL是针对背景篡改检测与定位的公共真实数据锚定基准,基于Open Images V7构建,含7000个样本,覆盖多类编辑与基准,可评估模型对重新编码伪影的误判风险,为通用图像篡改定位基准提供补充。

Comments 24 pages, 9 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05825 2026-07-30 cs.RO 79%

A Comparative Study of INDI and NDI with Nonlinear Disturbance Observer for Aerial Robotics

一种基于非线性扰动观测器的INDI和NDI的比较研究:用于空中机器人

Benedetta Rota, Mirko Mizzoni, Amr Afifi, Pieter van Goor, Antonio Franchi

机构 * Robotics and Mechatronics group, Faculty of Electrical Engineering, Mathematics, and Computer Science (EEMCS), University of Twente(代尔夫特理工大学电气工程、数学与计算机科学学院机器人与机电组) School of Aerospace, Mechanical, and Mechatronic Engineering (AMME), Faculty of Engineering, University of Sydney(悉尼大学航空航天、机械与机电工程学院) Department of Computer, Control and Management Engineering, Sapienza University of Rome(罗马大学计算机、控制与管理工程系)

专题命中 机器人数据与评测 :robotics(title);robotic(abstract);分类 cs.RO

AI总结 本文通过仿真比较INDI和NDI+非线性扰动观测器在空中机器人中的鲁棒性,分析参数变化、外部扰动和测量噪声下的跟踪性能和控制效果。

Journal ref 2026 International Conference on Unmanned Aircraft Systems (ICUAS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26579 2026-07-30 cs.RO cs.CV 新提交 79%

ContactFlow: A video action conditioning that transfers across embodiments

ContactFlow:一种可跨 embodiment 迁移的视频动作条件模型

Sami Azirar, Enrico Pallotta, Jan Nogga, Jürgen Gall, Sven Behnke, Hermann Blum

机构 * University of Bonn(波恩大学) Lamarr Institute(拉马尔研究所)

专题命中 机器人数据与评测 :manipulation(abstract);world model(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 Contact Flow 是一种与 embodiment 无关的动作表示,可跨人类演示与不同机器人 embodiment 迁移,用于构建能预测合理操纵结果的世界模型,集成到 pipeline 后在相关任务上表现良好。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26121 2026-07-30 cs.RO cs.AI cs.CY 新提交 73%

Towards Trustworthy Embodied Intelligence: A Systems Framework and Graded Trustworthiness Levels

面向可信赖的具身智能:一个系统框架与分级可信赖性水平

Xinyu Yang, Tianxing Chen, Honghao Su, Minxuan Wang, Chenze Yu, Zhangzheng Tu, Yue Chen, Yuxiao Huo, Lingfeng Zhang, Yan Huang, Yan Qin, Shaolong Zhu, Qiwei Liang, Hekun Tian, Shujia Liu, Guangyu Chen, Junhao Gong, Zixuan Li, Wenwei Lin, Zijian Lin, Wenxuan Zhu, Eric J Chen, Yue Yuan, Qize Yu, Jiaqi Liang, Haowen Yan, Hengfei Zhao, Weijie Wan, Zikun Xiao, Junyuan Tang, Baijun Chen, Kai-Chong Lei, Kaixuan Wang, Kailun Su, Zanxin Chen, Yao Mu, Renjing Xu, Chuqiao Lyu, Qi Xiong, Ping Luo, Wenbo Ding

机构 * THU(清华大学) PKU(北京大学) HKUST (GZ)(香港科技大学(广州))

专题命中 机器人数据与评测 :robotics(abstract);embodied AI(abstract);分类 cs.RO、cs.AI

AI总结 该研究提出具身智能可信赖性的四层系统框架,构建涵盖多维度的可信赖性水平层级,为具身智能的可信赖部署、评估等提供依据。

Comments Website: https://xsparkai.com/sparklab/towards-trustworthy-eai

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13337 2026-07-30 cs.RO 70%

Invisible Servoing: a Visual Servoing Approach with Return-Conditioned Latent Diffusion

Bishoy Gerges, Barbara Bazzana, Nicolò Botteghi, Youssef Aboudorra, Antonio Franchi

机构 * Robotics and Mechatronics group, Faculty of Electrical Engineering, Mathematics and Computer Science, University of Twente(特文特大学机器人与机电组,电气工程、数学与计算机科学学院) Department of Applied Mathematics, University of Twente(特文特大学应用数学系) Department of Computer, Control and Management Engineering, Sapienza University of Rome(罗马萨皮恩扎大学计算机、控制与管理工程系)

专题命中 机器人数据与评测 :navigation(abstract);robotic(abstract);分类 cs.RO

Journal ref 2025 International Conference on Unmanned Aircraft Systems (ICUAS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04249 2026-07-30 cs.RO 版本更新 61%

Can Context Bridge the Reality Gap? Sim-to-Real Transfer of Context-Aware Policies

上下文能否弥合现实差距?情境感知策略的模拟到现实迁移

Marco Iannotta, Yuxuan Yang, Johannes A. Stork, Erik Schaffernicht, Todor Stoyanov

机构 * AASS Research Centre, Örebro University(奥雷布罗大学AASS研究中心) Technology Transfer Center Kitzingen, Technical University of Applied Sciences Würzburg-Schweinfurt(基廷根技术转移中心,沃尔夫斯堡-施维林应用技术大学)

专题命中 机器人数据与评测 :robotics(abstract,journal_ref);分类 cs.RO

AI总结 研究机器人强化学习中模拟到现实迁移难题,核心方法是将上下文估计模块集成到基于领域随机化的强化学习框架并比较监督策略,主要贡献是情境感知策略在多任务中优于无上下文基线。

Journal ref Robotics and Autonomous Systems, Volume 205, 2026, 105594

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17565 2026-07-30 cs.RO cs.SY eess.SY 61%

Aerial Robots Carrying Flexible Cables: Dynamic Shape Optimal Control via Spectral Method Model

Yaolei Shen, Antonio Franchi, Chiara Gabellieri

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO;robotics(journal_ref)

Journal ref IEEE Transactions on Robotics (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27169 2026-07-30 cs.LG 新提交 57%

When Do Learned Diffusion Proposals Help Constraint Solving? A Controlled Study on Continuous Algebraic Systems

学习到的扩散提议何时有助于约束求解?针对连续代数系统的对照研究

Quang Bui, Sparsh Roy, Akash Gundimeda, Davin Yin

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.LG

AI总结 本研究针对连续代数系统开展对照实验,发现学习到的扩散提议仅在高维、变量未耦合的场景下,才比随机多起点更有助于约束求解,且其优势并非适用于所有真实系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26646 2026-07-30 cs.CV 新提交 57%

Genie Sim PanoWorld: An Infinite Indoor 3D World Generation Pipeline via Panoramic Scene Modeling and Simulation

Genie Sim PanoWorld:基于全景场景建模与仿真的无限室内3D世界生成流水线

Yongxin Su, Linjie Hou, Feng Wang, Jialin Tang, Zhijun Li, Qian Wang, Maoqing Yao

专题命中 机器人数据与评测 :embodied AI(abstract);分类 cs.CV

AI总结 Genie Sim PanoWorld是两阶段前馈流水线,从单张360°全景生成可自由导航的高保真3D高斯场景,优于几何条件基线,且能零样本泛化至未见室内场景

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26583 2026-07-30 cs.CV 新提交 57%

R-SLPR: Region-based Small-to-Large Point-cloud Registration with Contrastive Learning

R-SLPR:基于区域的小到大点云配准对比学习框架

Yusen Wan, Zeyuan Chen, Qianshi Zou, Xu Chen

机构 * University of Washington(华盛顿大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.CV

AI总结 针对小到大尺度不匹配的点云配准难题,提出R-SLPR三阶段框架,结合斐波那契网格分割与对比学习,在ModelNet40上实现最优精度,大幅降低位置和旋转MAE。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26481 2026-07-30 cs.LG eess.SP 新提交 57%

Conformal Changepoint Localization and Root Cause Analysis with Corrupted Observations

含损坏观测值的保序变点定位与根因分析

Seunghun Yu, Meiyi Zhu, Petar Popovski, Joonhyuk Kang, Osvaldo Simeone

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院) King’s College London(伦敦国王学院) Aalborg University(奥尔堡大学) Northeastern University London(伦敦东北大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.LG

AI总结 本文针对含损坏观测值的系统,提出加权CONCH与加权CROC方法,结合元学习优化权重,可在保证置信集目标覆盖率的前提下缩小其规模,提升变点定位与根因分析的实用性。

Comments 34 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26473 2026-07-30 cs.LG cs.CL 新提交 57%

Learning Dynamic User Personas from Implicit Interaction Streams via Iterative Refinement

通过迭代优化从隐式交互流中学习动态用户画像

Haifeng Wu

机构 * PayPal(贝宝)

专题命中 机器人数据与评测 :embodied agent(abstract);分类 cs.LG

AI总结 针对现有个性化LLM依赖显式偏好监督的局限,提出IRIS框架,通过隐式交互流迭代优化用户画像,在Reddit AITA数据上的100位作者测试中,其决策预测准确率达61.0%,优于多种基线方法。

Comments 23 pages, 1 figure, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03701 2026-07-30 cs.CV 版本更新 57%

VidNum: Diagnosing VLM Failure Modes in Video-Grounded Numerical Reasoning

VidNum-1.4K:一个全面的视频基于数值推理基准

Shaoyang Cui, Lingbei Meng, Yaodi Luo, Peize He

机构 * Department of Psychological and Cognitive Sciences, Tsinghua University(清华大学心理与认知科学系) Shenzhen Loop Area Institute(深圳河套学院)

专题命中 机器人数据与评测 :world model(abstract);分类 cs.CV

AI总结 本文提出VidNum-1.4K基准,通过1379个严格人工标注的视频问题对,评估视频基于的数值推理能力,揭示当前VLMs在多步骤逻辑推理上的不足。

Comments 7 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17166 2026-07-30 cs.RO cs.SY eess.SY 57%

Geometric Inverse Flight Dynamics on SO(3) and Application to Tethered Fixed-Wing Aircraft

三维逆飞行动力学与 tethered 固定翼飞机的应用

Antonio Franchi, Chiara Gabellieri

机构 * Robotics and Mechatronics lab, Faculty of Electrical Engineering, Mathematics & Computer Science, University of Twente(代尔夫特理工大学机器人与机电实验室,电气工程、数学与计算机科学学院,代尔夫特理工大学) Department of Computer, Control and Management Engineering, Sapienza University of Rome(罗马大学计算机、控制与管理工程系,罗马萨皮恩扎大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 本文提出一种坐标无关的逆飞行动力学方法,用于固定翼飞机在SO(3)上的建模,通过几何定义气动方向,推导轨迹到输入的映射,并应用于 tethered 飞行,揭示了气动协调与重力矢量的解耦。

Comments ACCEPTED ICUAS 2026

Journal ref 2026 International Conference on Unmanned Aircraft Systems, ICUAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26553 2026-07-30 cs.SD 新提交 50%

ThinkOmni: A Reasoning-Driven Omni-Modal LLM Framework for Audio Forgery Detection and Localization

ThinkOmni:用于音频伪造检测与定位的推理驱动全模态大语言模型框架

Yuxiong Xu, Kaiqing Lin, Bin Li, Haodong Li, Sheng Li

机构 * Shenzhen University(深圳大学) Afirstsoft Technology Group Co., Ltd.(安福软件科技集团有限公司)

专题命中 机器人数据与评测 :manipulation(abstract)

AI总结 针对现有AFDL方法泛化能力不足的问题,提出推理驱动的全模态大语言模型ThinkOmni,构建FACoT数据集,引入FMIL与FCML,实现了跨数据集的音频伪造检测与定位。

Comments Accepted by ACM MM 2026, 21 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26402 2026-07-30 cs.CY 新提交 50%

From Micro-Cognition to Self-Construction: A Four-Layer Integrative Review of Psychological Theories in HCI

从微观认知到自我建构:人机交互中心理学理论的四层整合综述

Xiaohe Bie, Bo Wang, Xinyu Long

专题命中 机器人数据与评测 :embodied agent(abstract)

AI总结 本文针对HCI从“工具使用”向“心智共生”的范式转变,提出四层整合心理学理论框架,明确其对生成式AI等场景的启示及核心挑战与未来方向。

详情

展开后加载摘要…

URL PDF HTML 收藏