arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-06-09 至 2026-06-09 共收录 171 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 15 篇

2606.08249 2026-06-09 cs.RO cs.LG 新提交 81%

Disturbance-Aware Aerial Robotics for Ethical Wildlife Monitoring

面向道德野生动物监测的扰动感知空中机器人

Mahmut Osmanovic, Isac Paulsson, Teddy Lazebnik

机构 * Department of Computing, Jonkoping University(约翰内斯堡大学计算机系) Department of Information Systems, University of Haifa(海法大学信息系统系)

专题命中 机器人数据与评测 :robotics(title);robotic(abstract);分类 cs.RO、cs.LG

AI总结 提出一种基于强化学习的扰动感知框架,用于异构空中机器人编队自主追踪野生动物,同时最小化行为干扰,在三种动物和四种行为模型上超越规则基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08548 2026-06-09 cs.RO 新提交 79%

OASIS: From Simulation Data Collection to Real-World Humanoid Loco-Manipulation

OASIS:从仿真数据收集到真实世界人形机器人移动操作

Zehao Yu, Jiakun Zheng, Weiji Xie, Jiyuan Shi, Chenyun Zhang, Chenjia Bai, Xuelong Li

机构 * Institute of Artificial Intelligence (TeleAI), China Telecom(中国电信人工智能研究院(TeleAI)) Fudan University(复旦大学) East China University of Science and Technology(华东理工大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 机器人数据与评测 :manipulation(title,abstract);分类 cs.RO

AI总结 提出OASIS框架,利用3D生成模型从真实图像重建物体资产,在仿真中收集并增强轨迹数据,训练层次化视觉运动策略,实现零样本部署下人形机器人移动操作,成功率优于真实遥操作数据。

Comments Project Page: https://oasis-humanoid.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07118 2026-06-09 cs.RO 版本更新 70%

QuadVerse: An Integrated Framework Aligning Visual-Physical Reality for Quadruped Simulation

QuadVerse:一种对齐视觉-物理现实用于四足仿真的集成框架

Yuxiang Chen, Yuanhao Wang, Ziheng Zhang, Meng Zhang, Yu Liu, Yufei Jia, Tiancai Wang, Erjin Zhou, Jin Xie

机构 * Nanjing University(南京大学) BUPT(北京邮电大学) DEXMAL Tsinghua University(清华大学)

专题命中 机器人数据与评测 :robot learning(abstract);navigation(abstract);分类 cs.RO

AI总结 提出QuadVerse框架,通过重建场景校准视觉、物理和致动器,利用3DGS和接触校准减少仿真到现实的差距,实现零样本视觉导航策略部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09108 2026-06-09 cs.RO cs.LG 新提交 62%

RAM: Reachability Across Morphologies

RAM: 跨形态可达性

Tim Walter, Xinyu Chen, Jonathan Külz, Matthias Althoff

机构 * Department of Computer Engineering(计算机工程系) German Electron Synchrotron Technical University(德国电子同步加速器技术大学) Technical University Munich(慕尼黑技术大学) University of Hamburg(汉堡大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.LG

AI总结 提出一种形态条件隐式神经表示RAM,快速、可微地预测可达性并泛化至未见形态,基于前向运动学生成大规模数据集训练,在纳秒级推理中F1达86%,显著加速形态和轨迹优化。

Comments 22 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01478 2026-06-09 cs.RO cs.AI cs.MA cs.SY eess.SY 版本更新 62%

Crazyflow: An Accurate, GPU-Accelerated, Differentiable Drone Simulator in JAX

Crazyflow: 基于JAX的精确、GPU加速、可微分的无人机模拟器

Martin Schuck, Marcel P. Rath, Yufei Hua, Abhishek Goudar, SiQi Zhou, Angela P. Schoellig

机构 * Technical University of Munich(慕尼黑技术大学) University of Toronto(多伦多大学) Simon Fraser University(西蒙弗雷泽大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO、cs.AI

AI总结 提出Crazyflow模拟器,通过GPU加速和可微分设计,实现单机超高速仿真、数千架无人机集群模拟,并支持基于解析梯度的策略学习与采样避障,甚至能在0.38秒内从零训练飞行恢复策略。

Comments Fix minor metadata mistakes

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09237 2026-06-09 cs.RO cs.SY eess.SY 新提交 57%

Can we stabilize an inverted pendulum with feedback from a time-of-flight camera?

我们能否利用飞行时间相机的反馈来稳定倒立摆?

Anthony Czubarow, Antonio Terpin, Raffaello D'Andrea

机构 * Institute for Dynamic Systems and Control, ETH Zürich(苏黎世联邦理工学院动态系统与控制研究所)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 本文证明低成本、低分辨率的飞行时间相机能够提供足够反馈,可靠且精确地平衡推车上的倒立摆,挑战了其无法用于精确反馈控制的普遍观点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09218 2026-06-09 cs.CV 新提交 57%

Minimal Solvers for Full-DoF Motion Estimation from Asynchronous Differential SfM

全自由度运动估计的最小求解器:基于异步差分SfM

Shuo Pan, Banglei Guan, Bin Li, Zhenbao Yu, Zibin Liu, Zi Wang, Yang Shang, Qifeng Yu

机构 * College of Aerospace Science and Engineering, National University of Defense Technology(国防科技大学空天科学学院) The Hunan Provincial Key Laboratory of Image Measurement and Vision Navigation(湖南省图像测量与视觉导航重点实验室)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 提出从异步光流直接估计全自由度自运动的方法,解耦差分对极约束,基于至少五个点实现角速度和线速度的联合恢复,并设计了首个代数最小5点求解器及加速版本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09155 2026-06-09 cs.RO 新提交 57%

Bridged SBI: Correcting Biased Low-Fidelity Posteriors for Cost-Efficient High-Fidelity Inference

Bridged SBI:纠正有偏低保真后验以实现经济高效的高保真推理

Gahee Kim, Yuki Kadokawa, Sandro M. Alcantara Tacora, Taro Abe, Daisuke Endo, Genki Yamauchi, Takeshi Hashimoto, Takamitsu Matsubara

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 针对高保真粒子模拟器计算成本高的问题,提出Bridged SBI方法,利用低保真后验引导高保真推理,通过残差桥接纠正偏差,实现成本效益高的准确后验估计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07916 2026-06-09 cs.AI 新提交 57%

The CIFAR Synthetic Evidence Corpus for Detecting AI-Generated Evidence

CIFAR合成证据语料库:用于检测AI生成证据

Kelly McConvey, Jalehsadat Mahdavimoghaddam, Nima Jamali, Maksym Taranukhin, Sajad Ebrahimi, Wentao Zhang, Yuntian Deng, Karen Eltis, Maura R. Grossman, Vered Shwartz, Ebrahim Bagheri

机构 * University of Toronto(多伦多大学) University of Waterloo(滑铁卢大学) University of British Columbia(不列颠哥伦比亚大学) Vector Institute(向量研究所) University of Ottawa(渥太华大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI

AI总结 针对司法系统中证据真实性检测缺乏合适数据集的问题,构建了包含多种文档类型和篡改策略的CIFAR合成证据语料库,支持在受控条件下评估证据验证系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07642 2026-06-09 cs.CV cs.CY 新提交 57%

Do VLMs See What Sensors Feel? A Scalable Expert-Guided Design for Wheelchair Accessibility Assessment from Street View

视觉语言模型能否感知传感器所感?一种可扩展的专家引导设计用于从街景评估轮椅可达性

Dongdong Wang, Alina Hagen, Isabelle Gatmaitan, Hao Zhou, Yiwen Dong, Shabboo Valipoor, Vivian W. H. Wong, Lingyao Li

机构 * University of Florida(佛罗里达大学) University of South Florida(南佛罗里达大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.CV

AI总结 本文提出专家引导的检索增强框架,利用视觉语言模型从谷歌街景图像识别轮椅可达性障碍,通过GPS轮椅停留行为验证,表明VLM评分与移动摩擦部分一致,但细粒度障碍识别有限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19662 2026-06-09 cs.AI 版本更新 57%

When Tabular Foundation Models Meet Strategic Tabular Data: A Prior Alignment Approach

当表格基础模型遇见策略性表格数据:一种先验对齐方法

Xinpeng Lv, Yunxin Mao, Renzhe Xu, Chunyuan Zheng, Yikai Chen, Haoxuan Li, Jinxuan Yang, Kun Kuang, Yuanlong Chen, Mingyang Geng, Wanrong Huang, Shixuan Liu, Shaowu Yang, Wenjing Yang, Zhouchen Lin, Haotian Wang

机构 * University of Science and Technology of China(中国科学技术大学) Tsinghua University(清华大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI

AI总结 本文研究了表格基础模型在策略性表格数据上的泛化能力,提出了一种策略感知的先验对齐框架SPN,以提高模型在策略性环境中的鲁棒性和预测性能。

Comments Accepted by ICML2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08714 2026-06-09 eess.SY cs.AI cs.LG cs.RO cs.SY 新提交 56%

Hybrid Neural Network and Conventional Controller Approach for Robust Control of Highly Unstable Systems: Application to Tilt-Rotor Control

混合神经网络与传统控制器方法用于高度不稳定系统的鲁棒控制:应用于倾转旋翼控制

Ali Kafili Gavgani, Amin Talaeizadeh, Aria Alasty, Hossein Nejat Pishkenari

机构 * Advanced Research Lab for Control and Agricultural Robotics (Sharif AgRoLab)(控制与农业机器人高级研究实验室(谢尔生产大学AgRoLab)) Department of Mechanical Engineering, Sharif University of Technology, Tehran, Iran(技术大学机械工程系,德黑兰,伊朗)

专题命中 机器人数据与评测 :分类 cs.RO、cs.AI、cs.LG;robotics(comments)

AI总结 提出一种神经网络增强的滑模控制器,将系统动力学分解为输入无关和输入相关部分,前者用轻量网络从少量数据学习,实现对全驱动倾转旋翼系统的鲁棒控制,LSTM优于MLP。

Comments Proceedings of the 13th RSI International Conference on Robotics and Mechatronics (ICRoM 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08345 2026-06-09 cs.CE 新提交 50%

AuditFraudBench: Benchmarking Audit Judgment in Detecting Fraudulent Misstatements

AuditFraudBench:检测欺诈性错报的审计判断基准

Zhiwei Liu, Yueru He, Qing Ou, Tianlei Zhu, Xiaorui Guo, Xueqing Peng, Sophia Ananiadou

专题命中 机器人数据与评测 :manipulation(abstract)

AI总结 提出AuditFraudBench基准,包含利润来源归因、误导性叙述检测和欺诈模式分类三个任务,评估LLM在审计场景中识别财务欺诈的能力,发现现有模型在联合推理财务数据与披露框架方面存在困难。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.22142 2026-06-09 q-fin.TR econ.TH 版本更新 50%

From Means to Medians: Optimal Benchmark Design

从均值到中位数:最优基准设计

Ángel Hernando-Veciana

专题命中 机器人数据与评测 :manipulation(abstract)

AI总结 本文通过引入随价格扭曲规模递增的可变成本和每笔操纵的固定成本,解释了传统金融采用均值基准而DeFi采用中位数基准的现象,并推导出最优基准为截尾均值。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他机器人 7 篇

2606.08214 2026-06-09 cs.RO 新提交 83%

Agentic Neuro-Symbolic Planning and Commissioning for Human-in-the-Loop Industrial Robotics with Digital Twins

面向人机协同工业机器人的智能神经符号规划与调试:基于数字孪生

Zhihao Liu, Victor Nan Fernandez-Ayala, Tianyu Wang, Qiang Qin, Xi Vincent Wang, Dimos V. Dimarogonas, Lihui Wang

机构 * Royal Institute of Technology (KTH)(皇家理工学院(KTH))

专题命中 其他机器人 :robotics(title,abstract);robotic(abstract);分类 cs.RO

AI总结 提出一种结合LLM语言理解与确定性验证执行的神经符号框架,采用SDI架构和两级恢复机制,在数字孪生中验证后执行,显著提升任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07998 2026-06-09 cs.RO cs.CV 版本更新 82%

DIJIT: A Robotic Head for an Active Observer

DIJIT: 面向主动观察者的机器人头部

Mostafa Kamali Tabrizi, Mingshi Chi, Bir Bikram Dey, Kelly Yuan, Markus D. Solbach, Yiqian Liu, Michael Jenkin, John K. Tsotsos

机构 * Department of Electrical Engineering and Computer Science, York University(电气与计算机科学系,约克大学)

专题命中 其他机器人 :robotic(title,abstract);分类 cs.RO、cs.CV;robotics(journal_ref)

AI总结 提出DIJIT双目机器人头部,具有9个机械自由度和4个光学自由度,实现类人眼/头运动,用于主动视觉研究,其扫视精度接近人类。

Journal ref IEEE Robotics and Automation Letters, Vol. 11, No. 6, pp. 7038-7045, June 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.07599 2026-06-09 cs.RO 80%

Partially Observable Markov Decision Processes (POMDPs) and Robotics

部分可观测马尔可夫决策过程(POMDPs)与机器人学

Hanna Kurniawati

机构 * School of Computing, Australian National University(澳大利亚国立大学计算机学院)

专题命中 其他机器人 :robotics(title,abstract);分类 cs.RO

AI总结 本文综述了POMDPs在机器人学中的应用,讨论了计算复杂性问题及采样求解器的改进,展示了POMDPs在提高机器人系统鲁棒性方面的贡献。

Journal ref Annual Review of Control, Robotics, and Autonomous Systems Vol. 5:253-277, 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09432 2026-06-09 cs.LG 新提交 57%

Graph Mamba Operator: A Latent Simulator for Interacting Particle Systems

Graph Mamba Operator: 一种用于相互作用粒子系统的潜在模拟器

Karn Tiwari, Niladri Dutta, N M Anoop Krishnan, Prathosh A P

机构 * Indian Institute of Science, Bangalore(印度科学研究所,班加罗尔) Indian Institute of Technology, Delhi(印度理工学院,德里)

专题命中 其他机器人 :robotics(abstract);分类 cs.LG

AI总结 提出Graph Mamba Operator (GraMO),通过将状态空间模型与图交互学习集成到单一循环中,实现长期时空依赖的联合建模,在N体系统、运动捕捉和机器人数据集上取得最低误差。

Comments Under Submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07999 2026-06-09 cs.AI 新提交 57%

Efficient Skill Grounding via Code Refactoring with Small Language Models

通过小型语言模型的代码重构实现高效技能落地

Sera Choi, Wonje Choi, Saehun Chun, Daehee Lee, Jooyoung Kim, Chaeun Lee, Honguk Woo

机构 * KAIST(韩国科学技术院)

专题命中 其他机器人 :embodied agent(abstract);分类 cs.AI

AI总结 提出RECENT框架,通过将技能语义与执行绑定解耦,利用小型语言模型进行代码重构实现高效技能落地,在动态环境中达到与大型语言模型相当的性能。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17514 2026-06-09 cs.NI cs.AI cs.IT math.IT 交叉投稿 57%

XAI-on-RAN: Explainable, AI-native, and GPU-Accelerated RAN Towards 6G

XAI-on-RAN:面向6G的可解释、AI原生和GPU加速的无线接入网

Osman Tugay Basaran, Falko Dressler

机构 * School of Electrical Engineering and Computer Science, Technische Universität Berlin(电气工程与计算机科学学院,柏林技术大学)

专题命中 其他机器人 :robotics(abstract);分类 cs.AI

AI总结 针对6G关键任务场景中AI决策不透明的问题,提出可解释AI原生RAN框架,通过数学建模权衡透明度、延迟和GPU利用率,实验证明混合XAI模型xAI-Native性能优于基线。

Comments 39th Conference on Neural Information Processing Systems (NeurIPS 2025) Workshop: AI and ML for Next-Generation Wireless Communications and Networking (AI4NextG)

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.12183 2026-06-09 cs.RO 版本更新 57%

An Interval Branch-and-Bound-Based Inverse Kinemetics Algorithm Towards Global Optimal Redundancy Resolution

基于区间分支定界的逆运动学算法实现全局最优冗余度解析

Yajue Yang, Zeqing Zhang, Yuanqing Wu, Jia Pan

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 其他机器人 :robotics(abstract);分类 cs.RO

AI总结 提出一种结合快速数值IK求解器搜索启发式的区间分支定界方法,高效求解机械臂广义逆运动学问题,生成邻域解以提供自运动流形的丰富几何信息,支持最优规划和任意时间求解。

详情

展开后加载摘要…

URL PDF HTML 收藏