arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-05-13 至 2026-05-13 共收录 86 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 7 篇

2605.12416 2026-05-13 cs.LG 70%

Aligning Flow Map Policies with Optimal Q-Guidance

对齐流映射策略与最优Q引导

Christos Ziakas, Alessandra Russo, Avishek Joey Bose

机构 * Imperial College London(帝国理工学院伦敦分校) Mila

专题命中 模仿学习与强化学习 :manipulation(abstract);robotic(abstract);分类 cs.LG

AI总结 本文提出流映射策略,通过学习任意大小的跳跃提升动作生成速度,并引入FMQ和QGBS方法,在12个机器人任务中实现最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11009 2026-05-13 cs.LG cs.RO 62%

ACSAC: Adaptive Chunk Size Actor-Critic with Causal Transformer Q-Network

ACSAC:自适应块大小的Actor-Critic与因果TransformerQ网络

Qian Chen, Junqiao Zhao, Hongtu Zhou, Hang Yu, Yanping Zhao, Chen Ye, Guang Chen

机构 * Tongji University(同济大学)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO、cs.LG

AI总结 针对长 horizon、稀疏奖励任务,ACSAC通过自适应块大小实现平衡反应与时间一致性,提升强化学习性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11697 2026-05-13 cs.RO 57%

Rainbow Deep Q-Learning with Kinematics-Aware Design for Cooperative Delta and 3-RRS Parallel Robot Insertion

彩虹深度Q学习与运动学感知设计用于协作Delta和3-RRS平行机器人插入

Hassen Nigatu, Gaokun Shi, Jituo Li, Wang Jin, Lu Guodong

机构 * Robotics Research Center of Yuyao(余姚机器人研究中心) Robotics Institute of Zhejiang University(浙江大学机器人院) Yuyao Technology Innovation Center(余姚技术创新中心) Department of Electrical and Computer Engineering, University of New Brunswick(新 Brunswick大学电气与计算机工程系)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO

AI总结 本文提出基于Rainbow深度Q网络的运动学感知深度强化学习框架,用于Delta并联机器人与3-RRS并联机械臂的协作插孔任务。通过几何设计优化阶段提升运动学性能,实现六自由度可控子空间,并结合形状奖励机制和两阶段课程训练,提高插孔任务的稳定性和可靠性。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11534 2026-05-13 cs.RO 57%

PRISM: : Planning and Reasoning with Intent in Simulated Embodied Environments

PRISM:在模拟的具身环境中进行规划与意图推理

Yunn Kang Lim, Pengzhan Sun, Ziyi Bai, Xun Xu, Angela Yao, Xulei Yang, Shijie Li

机构 * A*STAR National University of Singapore(国立新加坡大学) BAAI(北京人工智能研究院)

专题命中 模仿学习与强化学习 :embodied agent(abstract);分类 cs.RO

AI总结 PRISM通过诊断性基准测试识别具身代理失败的根源,通过三个能力层级评估基本能力、推理能力和长周期能力,揭示不同模型在空间定位、意图解析和长周期协调上的性能差异。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人数据与评测 12 篇

2603.15759 2026-05-13 cs.RO cs.AI cs.LG 89%

Simulation Distillation: Pretraining World Models in Simulation for Rapid Real-World Adaptation

模拟蒸馏:在模拟中预训练世界模型以实现快速真实世界适应

Jacob Levy, Tyler Westenbroek, Kevin Huang, Fernando Palafox, Patrick Yin, Shayegan Omidshafiei, Dong-Ki Kim, Abhishek Gupta, David Fridovich-Keil

机构 * University of Texas at Austin(德克萨斯大学奥斯汀分校) University of Washington(华盛顿大学) FieldAI

专题命中 机器人数据与评测 :world model(title,abstract);robot learning(abstract);manipulation(abstract);robotic(abstract)

AI总结 本文提出SimDist框架,利用物理模拟器生成大量动作条件机器人经验,通过蒸馏结构先验提升世界模型性能,实现高效真实世界适应。

Comments Robotics: Science and Systems 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11782 2026-05-13 cs.CV 79%

Urban Risk-Aware Navigation via VQA-Based Event Maps for People with Low Vision

面向低视力人群的基于VQA的事件地图城市风险感知导航

Antoni Valls, Jordi Sanchez-Riera

机构 * Institut de Robòtica i Informàtica Industrial, CSIC-UPC(机器人与信息技术研究所,CSIC-UPC)

专题命中 机器人数据与评测 :navigation(title,abstract);分类 cs.CV

AI总结 本文提出基于视觉问答的事件地图框架,利用视觉语言模型进行行人场景描述和危险识别,通过三级查询结构实现细粒度场景理解,生成风险感知导航地图,验证多模态大语言模型在助视导航中的有效性。

Comments 10 pages, 6 figures, submitted to IEEE T-ITS

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21625 2026-05-13 cs.RO 70%

Tacmap: Bridging the Tactile Sim-to-Real Gap via Geometry-Consistent Penetration Depth Map

Tacmap: 通过几何一致的穿透深度图弥合触觉仿真到现实的差距

Lei Su, Zhijie Peng, Renyuan Ren, Shengping Mao, Juan Du, Kaifeng Zhang, Xuezhou Zhu

机构 * Sharpa HKUST(香港科技大学) NVIDIA(英伟达)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 Tacmap通过统一的变形地图表示弥合触觉仿真与现实的差距,利用体积穿透深度实现高保真且高效的触觉仿真,验证了在抓取任务中仿真政策的零样本迁移能力。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24985 2026-05-13 cs.CV cs.AI cs.LG cs.RO 70%

DarkQA: Benchmarking Vision-Language Models on Visual-Primitive Question Answering in Low-Light Indoor Scenes

DarkQA:在低光室内场景中对视觉-原始问题进行问答的视觉语言模型基准测试

Yohan Park, Hyunwoo Ha, Wonjun Jo, Tae-Hyun Oh

机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院) Pohang University of Science and Technology (POSTECH)(釜山科学技术大学)

专题命中 机器人数据与评测 :embodied agent(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 DarkQA针对低光环境下视觉语言模型的感知基本能力进行基准测试,通过多级低光条件评估,揭示模型在复杂任务中的局限性。

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11265 2026-05-13 cs.CV cs.AI cs.LG 67%

DenseTRF: Texture-Aware Unsupervised Representation Adaptation for Surgical Scene Dense Prediction

DenseTRF: 基于纹理的无监督表示适应用于外科场景密集预测

Guiqiu Liao, Matjaž Jogan, Daniel A. Hashimoto

机构 * GRASP Laboratory, University of Pennsylvania(宾夕法尼亚大学GRASP实验室) PCASO Laboratory, Department of Surgery, University of Pennsylvania(宾夕法尼亚大学外科PCASO实验室) Department of Computer and Information Science, University of Pennsylvania(宾夕法尼亚大学计算机与信息科学系)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.AI、cs.CV、cs.LG

AI总结 本文提出DenseTRF框架,通过基于纹理的关注机制学习纹理感知的表示,提升外科场景密集预测的跨分布泛化能力。

Comments Accepted to 29th International Conference on Medical Image Computing and Computer Assisted Intervention (MICCAI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11224 2026-05-13 cs.CV cs.AI 62%

ABRA: Agent Benchmark for Radiology Applications

ABRA:放射学应用代理基准测试

Bulat Maksudov, Vladislav Kurenkov, Kathleen M. Curran, Alessandra Mileo

机构 * School of Computing(计算学院) Dublin City University(都柏林城市大学) School of Medicine(医学院) University College Dublin(都柏林大学)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.AI、cs.CV

AI总结 ABRA是一个放射学代理基准测试,通过21个功能调用工具操作OHIF查看器和Orthanc DICOM服务器,包含655个生成任务,评估代理在规划、执行和结果方面的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11048 2026-05-13 cs.RO cs.AI 62%

ForceFlow: Learning to Feel and Act via Contact-Driven Flow Matching

ForceFlow: 通过接触驱动的流匹配学习感知与行动

Shuoheng Zhang, Yifu Yuan, Hongyao Tang, Yan Zheng, Qiaojun Yu, Pengyi Li, Guowei Huang, Helong Huang, Xingyue Quan, Jianye Hao

机构 * Tianjin University(天津大学) Huawei Noah's Ark Lab(华为诺亚实验室) Shanghai AI Lab(上海人工智能实验室)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO、cs.AI

AI总结 本文提出ForceFlow框架,通过融合力信号与多模态信息,提升机器人在复杂接触任务中的鲁棒性和泛化能力,实验显示其在六个真实任务中成功率提升37%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24577 2026-05-13 cs.CV cs.AI 62%

EndoVGGT: GNN-Enhanced Depth Estimation for Surgical 3D Reconstruction

EndoVGGT:基于图神经网络的手术3D重建中的深度估计

Falong Fan, Yi Xie, Arnis Lektauers, Bo Liu, Jerzy Rozenblit

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.AI、cs.CV

AI总结 本文提出EndoVGGT框架,通过DeGAT模块动态构建语义图谱,提升手术3D重建的几何连续性和非刚性变形恢复能力,实验表明其在PSNR和SSIM上优于现有方法,并具备跨数据集泛化能力。

Comments We withdraw this submission due to significant errors in the presentation and logical structure of the paper. We found that the current version does not accurately convey the research findings and requires a major overhaul of the manuscript's methodology description and results analysis

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08571 2026-05-13 cs.RO 57%

BEACON: Cross-Domain Co-Training of Generative Robot Policies via Best-Effort Adaptation

BEACON:通过最佳努力适应进行跨领域生成机器人策略的协同训练

Antong Zhang, Han Qi, Heng Yang

机构 * Department of Computer Science, Brown University(布朗大学计算机科学系) School of Engineering and Applied Sciences, Harvard University(哈佛大学工程与应用科学学院)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO

AI总结 BEACON提出一种理论驱动框架,通过大量源演示和有限目标演示训练生成机器人策略,通过跨领域协同训练提升鲁棒性和数据效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12443 2026-05-13 eess.SY astro-ph.IM cs.MS cs.SE cs.SY 50%

Basilisk and Docker for Reproducible GN&C Simulation: A Workflow Reference

Basilisk和Docker用于可重复的GN&C模拟:一个工作流参考

Anubhav Gupta

专题命中 机器人数据与评测 :navigation(abstract)

AI总结 本文提出基于Docker的Basilisk工作流,提供可重复和可移植的GN&C模拟环境,涵盖从轨道动力学到姿态动力学的复杂模拟场景。

Comments 21 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12243 2026-05-13 cs.CL 50%

PreScam: A Benchmark for Predicting Scam Progression from Early Conversations

PreScam:一个用于从早期对话预测诈骗进展的基准测试

Weixiang Sun, Shang Ma, Yiyang Li, Tianyi Ma, Zehong Wang, Colby Nelson, Xusheng Xiao, Yanfang Ye

机构 * University of Notre Dame(诺丁汉大学) Arizona State University(亚利桑那州立大学)

专题命中 机器人数据与评测 :manipulation(abstract)

AI总结 本文提出PreScam基准测试,通过分析用户提交的诈骗报告,构建了11573个涵盖20类诈骗的对话实例,评估了语言模型在实时终止预测和诈骗者行为预测任务中的表现,揭示了模型在捕捉诈骗进展方面的能力不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11557 2026-05-13 quant-ph 50%

Wavelet Variance Equipartition as a Threshold for World-Model Quality and Quantum Kernel TN-Simulability

小波方差等分作为世界模型质量的阈值及量子核TN可模拟性

Chon-Fai Kam, Xavier Cadet, Miloud Bessafi, Frederic Cadet

专题命中 机器人数据与评测 :world model(abstract)

AI总结 本文基于小波方差等分提出世界模型质量评估标准,并揭示量子核经典模拟性的临界条件,通过张量网络理论证明潜在空间相变,结合VideoMAE分析展现空间与特征通道的二元性,最终推导出量子机器学习可扩展性的限制因素。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 其他机器人 10 篇

2603.23679 2026-05-13 cs.RO cs.AI 84%

Learning What Can Be Picked: Active Reachability Estimation for Efficient Robotic Fruit Harvesting

学习可采摘之物:用于高效农业机器人采摘的主动可达性估计

Nur Afsa Syeda, Mohamed Elmahallawy, Luis Fernando de la Torre, John Miller

机构 * Washington State University(华盛顿州立大学)

专题命中 其他机器人 :robotic(title,abstract);robotics(abstract);分类 cs.RO、cs.AI

AI总结 本文提出一种结合RGB-D感知与主动学习的方法,用于高效判断水果可达性,减少标注工作量并提高预测精度,实验表明在低标注情况下,熵和边距采样效果最佳。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04352 2026-05-13 cs.RO cond-mat.mtrl-sci 79%

A Soft Robotic Demonstration in the Stratosphere

平流层中的软机器人演示

Codrin Tugui, Tirth Thakar, Anatol Gogoj, Alexander White, Ang Leo Li, Alexander Yin, Edward Pomianek, Mihai Duduta

机构 * University of Connecticut, School of Mechanical, Aerospace, and Manufacturing Engineering(康奈尔大学机械、航空航天与制造工程学院) Institute of Macromolecular Chemistry Petru Poni(彼得·波尼宏观分子化学研究所) University of Toronto, Department of Mechanical and Industrial Engineering(多伦多大学机械与工业工程系)

专题命中 其他机器人 :robotic(title,abstract);分类 cs.RO

AI总结 本文提出一种新型硅基弹性体,通过紫外光交联机制提升其在极端环境下的适应性和机械性能,用于平流层高海拔气球实验中展示软机器人技术的可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11972 2026-05-13 cs.RO cs.AI cs.ET cs.SY eess.SY 76%

Cooperative Robotics Reinforced by Collective Perception for Traffic Moderation

通过集体感知增强的协作机器人用于交通调节

Mohammad Khoshkdahan, John Pravin Arockiasamy, Andy Flores Comeca, Alexey Vinel

机构 * Karlsruhe Institute of Technology, Karlsruhe, Germany(卡尔斯鲁厄理工学院,德国卡尔斯鲁厄) Halmstad University, Halmstad, Sweden(哈马格大学,瑞典哈马格)

专题命中 其他机器人 :robotics(title);分类 cs.RO、cs.AI

AI总结 本文提出一种结合集体感知与协作机器人的交通调节系统,通过机器人主动干预防止非视线交口的碰撞风险,实验证明其在现实非视线条件下有效检测车辆并预防危险合并。

Comments Accepted for publication in the Proceedings of the 2026 IEEE Vehicular Technology Conference (VTC2026-Spring)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07599 2026-05-13 cond-mat.soft 67%

Magnetically Responsive Microprintable Soft Nanocomposites with Tunable Nanoparticle Loading

具有可调纳米粒子负载的磁响应微可打印软纳米复合材料

Rachel M. Sun, Andrew Y. Chen, Yiming Ji, Eric M. Stewart, Daryl W. Yee, Carlos M. Portela

专题命中 其他机器人 :robotics(abstract);robotic(abstract)

AI总结 本文通过两光子聚合与铁氧化物纳米粒子共沉淀结合,制备出具有空间可调纳米粒子分布的3D打印微尺度纳米复合材料,实现了微尺度元材料和机器人应用中的精确机械与磁性控制。

Comments 7 figures, 15 supplementary figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12338 2026-05-13 cs.LG cs.AI stat.CO 62%

Manifold Sampling via Entropy Maximization

通过熵最大化进行流形采样

Cornelius V. Braun, Tilman Burghoff, Marc Toussaint

机构 * Technische Universität Berlin(技术大学柏林) Robotics Institute Germany(德国机器人研究所)

专题命中 其他机器人 :robotics(abstract);分类 cs.AI、cs.LG

AI总结 本文提出MASEM方法,通过熵最大化在未知断开组件数的流形上高效采样,提升约束采样问题的混合速度和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12059 2026-05-13 cs.HC cs.RO 57%

RoboBlockly Studio: Conversational Block Programming with Embodied Robot Feedback for Computational Thinking

RoboBlockly Studio:具有身体反馈的对话式积木编程用于计算思维

Leyi Li, Chenyu Du, Jiafei Sun, Erick Purwanto, Qing Zhang

机构 * Xi'an Jiaotong-Liverpool University(西安交通大学利物浦大学)

专题命中 其他机器人 :robotics(abstract);分类 cs.RO

AI总结 本文提出RoboBlockly Studio,结合积木编程、对话AI教学代理和具身机器人执行,通过迭代循环提升学生计算思维能力,探讨AI与机器人在教育中的应用。

Comments Accepted to ACM DIS 2026. Camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11618 2026-05-13 cs.RO 57%

Sampling-Based Follow-the-Leader Motion Planning for Manipulator-Mounted Continuum Robots

基于采样的跟随者-领导者运动规划用于机械臂搭载的连续机器人

Chengnan Shentu, Nicholas Baldassini, Oluwagbotemi D. Iseoluwa, Radian Gondokaryono, Jessica Burgner-Kahrs

机构 * University of Toronto(多伦多大学)

专题命中 其他机器人 :robotic(abstract);分类 cs.RO

AI总结 本文提出了一种基于采样的跟随者-领导者运动规划方法,用于机械臂搭载的连续机器人,通过分离全局形状搜索与基座姿态确定,实现高效规划与高精度路径跟踪。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16732 2026-05-13 physics.app-ph 50%

Polymer-inspired mechanical metamaterials

受聚合物启发的机械元材料

Zhenyang Gao, Pengyuan Ren, Yifeng Dong, Gengchen Zheng, Min-Son Pham, Xiao Shang, Shaojia Wang, Shuo Yang, Zijue Tang, Yongbing Li, Hua Sun, Yi Wua, Hongjian Jiang, Lan Zhang, Tobin Filleter, Lingyu Kong, Kun Zhou, Haowei Wanga, Yang Lu, Yu Zou, Hongze Wang

专题命中 其他机器人 :robotic(abstract)

AI总结 本文提出受聚合物启发的机械元材料,通过模仿聚合物网络中的交联、分子密度和预拉伸强化机制,设计出具有宏观强化能力的新型结构,为软体机器人关节和柔性连接器提供新方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11713 2026-05-13 nlin.AO cond-mat.stat-mech math-ph math.MP 50%

The role of asymmetric time delay and its structure in 1D swarmalators

不对称时间延迟及其结构在1D swarmalators中的作用

Rommel Tchinda Djeudjo, Gourab Kumar Sar, Timoteo Carletti

专题命中 其他机器人 :robotic(abstract)

AI总结 本文研究了一维swarmalator模型中的不对称时间延迟,揭示其结构对集体相图的重塑作用,发现延迟结构而非其大小是决定swarmalator群体集体行为的关键因素。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07069 2026-05-13 cs.MA cs.CY 50%

Social Theory Should Be a Structural Prior for Agentic AI: A Formal Framework for Multi-Agent Social Systems

社会理论应为代理AI的结构先验:多代理社会系统的正式框架

Lynnette Hui Xian Ng, Iain J. Cruickshank, Adrian Xuan Wei Lim, Kathleen M. Carley

专题命中 其他机器人 :robotics(abstract)

AI总结 本文提出多代理社会系统框架,主张将社会理论作为结构先验,以指导代理AI的行为建模与系统治理。

详情

展开后加载摘要…

URL PDF HTML 收藏