arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 476 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 476 篇

2606.19769 2026-06-19 cs.RO cs.AI 新提交 81%

Data Standards for Humanoid Robotics: The Missing Infrastructure for Physical AI

人形机器人数据标准:物理AI缺失的基础设施

Shaoshan Liu, Xiugong Qin, Xuan Wu, Xuan Xia, Ning Ding, Jialu Liu, Jie Tang

专题命中 机器人数据与评测 :robotics(title);manipulation(abstract);分类 cs.RO、cs.AI

AI总结 本文论证数据标准是人形机器人可扩展性的关键基础设施,通过提出ISO/WD 26264-1标准,解决数据非累积性问题,使具身经验可解释、可共享、可追溯和可复用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17040 2026-06-16 cs.RO cs.CV 新提交 81%

R2RDreamer: 3D-aware Data Augmentation for Spatially-generalized 2D Manipulation Policies

R2RDreamer: 面向空间泛化的2D操作策略的3D感知数据增强

Xiuwei Xu, Haowen Sun, Angyuan Ma, Yiwei Zhang, Zhenyu Wu, Xiaofeng Wang, Bingyao Yu, Zheng Zhu, Jie Zhou, Jiwen Lu

机构 * Tsinghua University(清华大学) BUPT(北京邮电大学) GigaAI

专题命中 机器人数据与评测 :manipulation(title,abstract);分类 cs.RO、cs.CV

AI总结 提出R2RDreamer框架,通过轻量级3D编辑和2D视频补全,从少量真实演示生成几何一致的增强数据,提升2D操作策略的空间泛化能力。

Comments Project page: https://r2rdreamer.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16564 2026-06-16 cs.RO cs.LG 新提交 81%

Elastic ODYN: Differentiable Optimization for Infeasible Control and Learning in Robotics

Elastic ODYN:面向机器人中不可行控制与学习的可微优化

Aristotelis Papatheodorou, Jose Rojas, Ioannis Havoutis, Carlos Mastalli

机构 * University of Oxford(牛津大学) Heriot-Watt University(赫瑞瓦特大学)

专题命中 机器人数据与评测 :robotics(title);robotic(abstract);分类 cs.RO、cs.LG

AI总结 提出Elastic ODYN,一种通过平滑平方ℓ2弹性松弛处理不可行二次规划(QP)的原始-对偶非内点求解器,支持热启动,在无可行点时收敛到最接近可行解,并基于此开发可微QP层和不可行感知SQP方法,在基准QP、奇异接触力学、可微参数辨识及四足/人形机器人轨迹优化中优于现有方法。

Comments 8 pages, 5 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11901 2026-06-11 cs.RO cs.AI 新提交 81%

DuoBench: A Reproducible Benchmark for Bimanual Manipulation in Simulation and the Real World

DuoBench: 一个可复现的双手操作基准,涵盖仿真与现实世界

Tobias Jülg, Seongjin Bien, Simon Hilber, Yannik Blei, Pierre Krack, Maximilian Li, Sven Parusel, Rudolf Lioutikov, Florian Walter, Wolfram Burgard

机构 * University of Technology Nuremberg(纽伦堡工业大学) Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) Franka Robotics Technical University of Munich(慕尼黑工业大学)

专题命中 机器人数据与评测 :manipulation(title,abstract);分类 cs.RO、cs.AI

AI总结 提出DuoBench,一个基于FR3 Duo平台的双手操作基准框架,包含11个任务和阶段式评估方案,用于诊断当前策略在双手协调、仿真到现实迁移等方面的失败模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08249 2026-06-09 cs.RO cs.LG 新提交 81%

Disturbance-Aware Aerial Robotics for Ethical Wildlife Monitoring

面向道德野生动物监测的扰动感知空中机器人

Mahmut Osmanovic, Isac Paulsson, Teddy Lazebnik

机构 * Department of Computing, Jonkoping University(约翰内斯堡大学计算机系) Department of Information Systems, University of Haifa(海法大学信息系统系)

专题命中 机器人数据与评测 :robotics(title);robotic(abstract);分类 cs.RO、cs.LG

AI总结 提出一种基于强化学习的扰动感知框架,用于异构空中机器人编队自主追踪野生动物,同时最小化行为干扰,在三种动物和四种行为模型上超越规则基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15422 2026-07-20 cs.RO 新提交 80%

Robust Silicone Pour Casting and Sensor Embedding Procedures for Soft Robotic Actuators

用于软机器人致动器的稳健硅胶浇注成型和传感器嵌入程序

Harshit Thakker, Paul Dela Cruz, Mostafa Mo. Massoud, Jacqueline Libby

专题命中 机器人数据与评测 :robotic(title);robotics(abstract,comments);分类 cs.RO

AI总结 研究软机器人可重复可扩展制造问题,核心方法是双组分浇注成型制造软气动致动器及嵌入薄膜柔性传感器,并进行有限元建模和多种实验验证,主要贡献是提供稳健制造程序及相关验证,推动软机器人广泛应用。

Comments 8 pages, 17 figures, to be published in: IEEE RAS/EMBS 11th International Conference on Biomedical Robotics and Biomechatronics (BioRob 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18189 2026-06-17 cs.RO 新提交 80%

Beyond Failure Recovery: An Engagement-Aware Human-in-the-loop Framework for Robotic Systems

超越故障恢复:一种面向机器人系统的参与感知人在回路框架

Jiaying Fang, Joyce Yang, Zhanxin Wu, Bohan Yang, Tapomayukh Bhattacharjee

机构 * Cornell University(康奈尔大学)

专题命中 机器人数据与评测 :robotic(title);robotics(abstract,journal_ref);分类 cs.RO

AI总结 提出一种参与感知模型预测控制(E-MPC)方法,通过规划交互频率和类型来维持用户参与度并控制工作负荷,在机器人辅助进食系统中验证了其提升用户体验且不降低任务成功率的效果。

Comments Project website at https://emprise.cs.cornell.edu/empc

Journal ref Robotics: Science and Systems 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13233 2026-08-14 cs.RO 新提交 79%

Manufacturing Complex Airtight Soft Pneumatic Actuators for Soft Robotics: Process Evaluation and Optimization

面向软机器人的复杂气密性软气动执行器制造:工艺评估与优化

Mohammed Abboodi

专题命中 机器人数据与评测 :robotics(title);robotic(abstract);分类 cs.RO

AI总结 本研究评估多种复杂软气动执行器制造工艺,发现熔融沉积建模(FDM)适应性最强,确立了以执行器架构与制造约束兼容性为核心的面向制造设计方法,为相关执行器开发提供实用指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12904 2026-08-14 cs.CV 新提交 79%

HounsWorld: A Multimodal World Model for Hidden Patient-State Readout, Reconstruction, and Simulation

HounsWorld:用于隐藏患者状态读取、重建与模拟的多模态世界模型

Yunhao Bai, Zhongwei Qiu, Guangyu Guo, Yiming Huang, Tony C. W. Mok, Qinji Yu, Ling Zhang, Yan Wang

机构 * East China Normal University(华东师范大学) DAMO Academy, Alibaba Group(阿里巴巴集团达摩院) Hupan Laboratory(湖畔实验室) Zhejiang University(浙江大学)

专题命中 机器人数据与评测 :world model(title,abstract);分类 cs.CV

AI总结 该研究提出3B参数多模态世界模型HounsWorld,结合CT扫描与临床语言,通过共享潜在患者状态实现读取、重建、模拟三类任务,在HounsBench基准上表现优异,提升了CT理解能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08523 2026-08-11 cs.AI 新提交 79%

Discovering Diverse Planning Policies for Multimodal Embodied Agents with Quality-Diversity Optimization

用质量多样性优化发现多模态具身智能体的多样化规划策略

Pengfei Xu, Yong Liu, Xiaoya Nan, Qiang Yang, Peilan Xu

机构 * School of Artificial Intelligence, Nanjing University of Information Science and Technology(南京信息工程大学人工智能学院)

专题命中 机器人数据与评测 :embodied agent(title,abstract);分类 cs.AI

AI总结 针对多模态具身智能体现有规划器易因单一规划风格失效导致停滞的问题,提出质量多样性框架,通过进化策略模板构建多样化策略库,实现自适应规划与故障恢复,在ThreeDWorld基准上提升了任务成功率与交互效率。

Comments To appear in ACM MM (MM '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08036 2026-08-11 cs.RO 新提交 79%

Compiling and Benchmarking Task-State Horizons for Embodied Agents

面向具身智能体的任务状态视界的编译与基准测试

Meiqi Wang, Shichao Li

专题命中 机器人数据与评测 :embodied agent(title);robotic(abstract);分类 cs.RO

AI总结 该研究定义任务状态视界(TSH),推出RoboGraph编译器并发布含588个情节的基准,发现多数先进智能体模型在高TSH下维护、更新任务相关状态存在差距。

Comments 32 pages, including appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02547 2026-08-04 cs.RO 新提交 79%

Why Does Action Chunking Improve Behavioral Cloning Performance in Robotic Control?

为何动作分块能提升机器人控制中行为克隆的性能?

Filippo Lazzati, Kyle Stachowicz, William Chen, Alberto Maria Metelli, Andrew Wagenmaker, Sergey Levine

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 该研究揭示动作分块提升机器人控制性能的原因是隐式集成,提出带随机延迟的策略集成可匹配其性能,显式集成策略类在多领域表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00730 2026-08-04 cs.RO 新提交 79%

Push-Wiper: Toward General-Purpose Robotic Cleaning across Varied Stains and Surfaces with Segmented Pushing Trajectories

Push-Wiper:基于分段推动轨迹的通用机器人清洁方案,用于处理不同污渍与表面

Renhao Lu, Mingxin Wang, Chenyang Cao, Yang Yang, Guoping Pan, Kangkang Dong, Yi Cheng, Houde Liu

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Z-Lab, Zerith Robotics(Zerith机器人公司Z-Lab实验室) University of Toronto(多伦多大学)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 Push-Wiper 框架将粘性污渍清洁转化为聚合问题,通过分段推动轨迹结合 Diffusion Policy 与 ASPI 控制器,清洁得分比基线高130%,可零样本泛化至多种污渍与表面。

Comments 8 pages, 8 figures. Accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29640 2026-08-03 cs.RO 新提交 79%

Bootstrapping Self-Supervised Learning of Binary Classification Using Error Bounds: A Case Study on a Robotic Insertion Task

基于误差边界引导二分类自监督学习:机器人插入任务案例研究

Zebin Duan, Norbert Krüger, Juan Heredia, Thorbjørn Mosekjær Iversen, Frederik Hagelskjær

机构 * Mærsk Mc-Kinney Møller Institute(马士基麦金尼姆勒研究所) University of Southern Denmark(南丹麦大学) Danish Institute for Advanced Study (DIAS)(丹麦高等研究院)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 本研究针对机器人插入任务,提出结合UMAP降维与Wilson Score置信边界的二分类自监督学习数据引擎,可随任务执行减少昂贵验证需求并控制误差水平。

Comments 8 pages, 7 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26232 2026-07-30 cs.CV 新提交 79%

BG-REAL: A Public Real-Data Anchored Benchmark for Background Manipulation Detection and Localization

BG-REAL:用于背景篡改检测与定位的公共真实数据锚定基准

Bugra Alperen Uluirmak, Rifat Kurban

机构 * Erciyes University(埃尔西耶斯大学) Abdullah Gül University(阿卜杜拉居尔大学)

专题命中 机器人数据与评测 :manipulation(title,abstract);分类 cs.CV

AI总结 BG-REAL是针对背景篡改检测与定位的公共真实数据锚定基准,基于Open Images V7构建,含7000个样本,覆盖多类编辑与基准,可评估模型对重新编码伪影的误判风险,为通用图像篡改定位基准提供补充。

Comments 24 pages, 9 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25219 2026-07-29 cs.RO 新提交 79%

SONG: A Photorealistic 3D Gaussian Simulation Platform for Benchmarking Social Navigation

SONG:用于基准测试社会导航的逼真3D高斯模拟平台

Weiqi Huang, Dianyi Yang, Jiaxin Li, Shuangyi Dong, Hao Xu, Zan Wang, Wei Liang

机构 * School of Computer Science & Technology, Beijing Institute of Technology(北京理工大学计算机科学与技术学院)

专题命中 机器人数据与评测 :navigation(title,abstract);分类 cs.RO

AI总结 研究针对社会导航模拟平台不足的问题,介绍了基于3D高斯点云渲染的SONG平台,利用其进行场景和化身表示等,还策划了SONG-Bench及评估套件,通过评估发现相关问题,证明微调数据可提高现实环境成功率,为研究提供测试平台。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17767 2026-07-21 cs.RO 新提交 79%

VLN-AVP: Zero-Shot Vision-Language Navigation with Hybrid Long-Short-Term Memory for Autonomous Valet Parking

VLN-AVP:用于自动代客泊车的基于混合长短时记忆的零样本视觉语言导航

Yijian Li, Xiangru Mu, Changze Li, Hantian Shi, Jiyuan Cai, Jia Cai, Xiaoxue Liu, Yajing Sun, Ming Yang, Tong Qin

机构 * Shanghai Jiao Tong University(上海交通大学) Yinwang Intelligent Technology Co., Ltd.(银望智能科技有限公司)

专题命中 机器人数据与评测 :navigation(title,abstract);分类 cs.RO

AI总结 研究针对自主代客泊车依赖预建地图限制可扩展性问题,提出VLN-AVP零样本导航框架,结合BEV模型与VLM,引入混合记忆系统,构建数据集和基准,实验证明该方法在模拟和实际车辆实验中均有良好效果,提升了成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15642 2026-07-20 cs.RO 新提交 79%

Difference-Based Relational Learning for Zero-Shot Object-Goal Visual Navigation With Direct Sim-to-Real Transfer

基于差异的关系学习用于零样本目标视觉导航及直接模拟到现实的迁移

Guolei Qi, Feitian Zhang

专题命中 机器人数据与评测 :navigation(title,abstract);分类 cs.RO

AI总结 针对零样本目标视觉导航中模拟到现实差距的挑战,提出T-DRN,结合基于暹罗差异的特征提取器和双帧时间缓冲区,经实验验证其在AI2-THOR及物理轮式机器人上能提高零样本泛化能力,支持直接模拟到现实迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07403 2026-07-09 cs.MA cs.RO 新提交 79%

Multi-Agent Robotic Control with Onboard Vision-Language Models

基于机载视觉语言模型的多智能体机器人控制

Kajetan Rachwał, Maciej Majek, Bartłomiej Boczek, Jakub Matejczyk, Dominik Matejkowski, Adam Dąbrowski, Tim Seyde, Alexander Amini, Maria Ganzha

机构 * Faculty of Mathematics and Information Science, Warsaw University of Technology(华沙技术大学数学与信息科学学院)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 研究针对视觉语言模型用于机器人控制的挑战,提出多智能体系统架构,在机载硬件部署智能体,用紧凑型VLMs并经微调及新型编排智能体,经硬件在环模拟验证,证明该机载架构可行高效,有实际应用潜力且模拟环境已开源。

Comments 6 pages, 2 figures, accepted to 24th International Conference on Practical applications of Agents and Multi-Agent Systems (PAAMS'26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02474 2026-07-03 cs.RO cs.SY eess.SY 新提交 79%

QuadRocket: An Aerial Robotic Testbed for Adaptive Thrust-Vector Control of Rocket-Like Vehicles

QuadRocket:用于火箭类飞行器自适应推力矢量控制的空中机器人试验台

Pedro Santos, Joel Reis, Paulo Oliveira, Carlos Silvestre

机构 * ISR, Instituto Superior Técnico, Universidade de Lisboa(里斯本大学高等技术学院ISR) LAETA LARSyS

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 提出QuadRocket四旋翼火箭原型,通过自适应反步控制器实现未知扰动下的轨迹跟踪,并验证其作为推力矢量控制试验台的适用性。

Comments Paper accepted for publication in IEEE Transactions on Aerospace and Electronic Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27406 2026-06-29 cs.SE cs.AI 新提交 79%

Towards Evaluation of Implicit Software World Models in Coding LLMs

面向编码大语言模型中隐式软件世界模型的评估

Egor Bogomolov, Yaroslav Zharov

机构 * JetBrains Research(JetBrains研究)

专题命中 机器人数据与评测 :world model(title,abstract);分类 cs.AI

AI总结 本文通过预测执行资源(峰值内存、墙钟时间、分析器输出)扩展软件世界模型评估,发现前沿模型表现有限,表明对软件执行理解不足。

Comments Accepted to DL4Code workshop at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24256 2026-06-24 cs.CV 新提交 79%

Trimming the Long-Tail of Visual World Modeling Evaluation

修剪视觉世界建模评估的长尾

Bingxuan Li, Yining Hong, Cheng Qian, Hyeonjeong Ha, Jiateng Liu, Zhenhailong Wang, Yue Guo, Yunzhu Li, Heng Ji

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Stanford University(斯坦福大学) Columbia University(哥伦比亚大学)

专题命中 机器人数据与评测 :world model(title,abstract);分类 cs.CV

AI总结 针对视觉世界模型在罕见物理交互上泛化不足的问题,提出Tailor-Bench基准,通过常规、非常规和不可能三种场景模式系统评估模型推理能力,揭示长尾性能差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18847 2026-06-18 cs.AI 新提交 79%

WorldLines: Benchmarking and Modeling Long-Horizon Stateful Embodied Agents

WorldLines: 对长时域有状态具身智能体进行基准测试与建模

Yehang Zhang, Jianchong Su, Haojian Huang, Yifan Chang, Tianhao Zhou, Xinli Xu, Yingjie Xu, Yinchuan Li, Zexi Li, Ying-Cong Chen

机构 * HKUST(GZ)(香港科技大学(广州)) HKUST(香港科技大学) Knowin

专题命中 机器人数据与评测 :embodied agent(title,abstract);分类 cs.AI

AI总结 提出WorldLines基准,通过构建带时间跨度的家庭轨迹(含对话、动作、状态变化等)评估具身智能体的长时记忆与任务规划能力,并设计ObsMem记忆框架提升状态感知决策。

Comments 27 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18628 2026-06-18 cs.RO 新提交 79%

Self-Supervised Mask-Aware Transformers for Fault-Tolerant FBG Force Sensing in Minimally Invasive Surgical Robotics

自监督掩码感知Transformer用于微创手术机器人中容错FBG力传感

Peibo Sun, Shiyuan Dong, Shucheng Ye, Jianrong Cai, Yushan Liu, Hongen Liao, Tianqi Huang, Fang Chen

机构 * Shanghai Jiao Tong University(上海交通大学) Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

专题命中 机器人数据与评测 :robotics(title,abstract);分类 cs.RO

AI总结 针对微创手术机器人中FBG传感器因通道耦合和断裂导致的力估计退化问题,提出统一的自监督掩码感知Transformer,通过掩码通道重建预训练和动态损坏课程微调,实现多通道故障下的优雅降级,在8通道数据集上达到0.0066 N均方根误差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18097 2026-06-17 cs.RO 新提交 79%

WireCraft: A Simulation Benchmark for Industrial DLO Manipulation

WireCraft:工业DLO操作仿真基准

Chongyu Zhu, Ramy ElMallah, Hyegang Kim, Zachary Tang, Jiachen Rao, Artem Arutyunov, Seungyeon Ha, Chi-Guhn Lee

机构 * Department of Mechanical and Industrial Engineering, University of Toronto(多伦多大学机械与工业工程系) Department of Computer Science, University of Toronto(多伦多大学计算机科学系) CREFLE Inc.(CREFLE公司)

专题命中 机器人数据与评测 :manipulation(title,abstract);分类 cs.RO

AI总结 针对工业中可变形线性物体(DLO)操作缺乏统一基准的问题,提出WireCraft仿真基准,支持可配置难度和资产,涵盖三种任务族,并评估强化学习、模仿学习和视觉-语言-动作策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16953 2026-06-16 cs.RO 新提交 79%

SidewalkBench: Benchmarking Visual Navigation on Urban Sidewalks

SidewalkBench: 城市人行道视觉导航基准

Zhizheng Liu, Honglin He, Vivek Alumootil, Akshat Pandya, Brad Squicciarini, Wayne Wu, Bolei Zhou

机构 * University of California, Los Angeles(加利福尼亚大学洛杉矶分校) Coco Robotics

专题命中 机器人数据与评测 :navigation(title,abstract);分类 cs.RO

AI总结 针对城市人行道视觉导航缺乏统一基准的问题,提出SidewalkBench,基于NVIDIA Isaac Sim构建高保真仿真环境,评估9种模型,发现行人交互和长距离鲁棒性是关键瓶颈。

Comments Project Page: https://vail-ucla.github.io/SidewalkBench/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15469 2026-06-16 cs.RO 新提交 79%

Learning Context-Aware Neural ODE Dynamics for Adaptive Robotic Control

学习上下文感知的神经ODE动力学用于自适应机器人控制

Shao-Yi Yu, Jen-Wei Wang, Maya Horii, Masayoshi Tomizuka, Vikas Garg

机构 * University of California, Berkeley(加州大学伯克利分校) Aalto University(阿尔托大学) YaiYai Ltd(YaiYai有限公司)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 提出基于神经ODE的上下文感知动力学模型,通过两阶段训练从状态-动作历史推断环境因素,实现模型预测控制下的自适应,在四旋翼、Sphero BOLT和Fanuc机械臂上验证了时空变化环境下的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11381 2026-06-16 cs.CV 新提交 79%

From Simulation to the Real-World: An In-Field 6D Pose Dataset and Baseline for Robotic Strawberry Harvesting

从仿真到现实:面向机器人草莓采摘的实地6D位姿数据集与基线

Woojung Son, Won Suk Lee, Zijing Huang, Daeun Choi, Catia Silva, Yu She, Yan Gu

机构 * Department of Agricultural and Biological Engineering, University of Florida(佛罗里达大学农业与生物工程系) Department of Electrical and Computer Engineering, University of Florida(佛罗里达大学电气与计算机工程系) Edwardson School of Industrial Engineering, Purdue University(普渡大学爱德华森工业工程学院) School of Mechanical Engineering, Purdue University(普渡大学机械工程学院)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.CV

AI总结 针对机器人草莓采摘中6D位姿估计的仿真到现实差距问题,首次构建了实地草莓6D位姿真值数据集(12,040张图像),并基于NVIDIA Isaac Sim生成具有场景级真实感的合成数据集,通过基线实验量化了差距。

Comments 7 pages, 6 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14058 2026-06-15 cs.RO 新提交 79%

ReactSim-Bench: Benchmarking Reactive Behavior World Model Simulation in Autonomous Driving

ReactSim-Bench:自动驾驶中反应性行为世界模型模拟的基准测试

Zhiyuan Zhang, Yanlun Peng, Jianing Zhang, Xianda Guo, Zehan Huang, Haoran Liu, Qifeng Li, Shaofeng Zhang, Xiaosong Jia, Junchi Yan

机构 * School of Computer Science & School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学计算机科学与技术学院、人工智能学院) Great Wall Motor(长城汽车) Institute of Trustworthy Embodied AI (TEAI), Fudan University(复旦大学可信具身人工智能研究所) School of Computer Science, Wuhan University(武汉大学计算机学院) University of Science and Technology of China(中国科学技术大学)

专题命中 机器人数据与评测 :world model(title,abstract);分类 cs.RO

AI总结 提出ReactSim-Bench,通过解耦自车与周围智能体控制,使用偏离日志的自车行为作为输入,评估行为世界模型模拟的反应性能力,并基于碰撞、地图和运动学指标系统评测多种模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12042 2026-06-11 cs.RO 新提交 79%

KinematicRL: A Sim-to-Real Reinforcement Learning Framework For Social Navigation With Kinodynamic Feasibility

KinematicRL: 一种面向社交导航的具有运动学可行性的仿真到现实强化学习框架

Zhiming Xu, Haodong Yang, Chengju Liu, Qijun Chen, Chenpeng Yao

机构 * School of Computer Science and Technology, Tongji University(同济大学计算机科学与技术学院) Department of Electronics and Information Engineering, Tongji University(同济大学电子与信息工程学院) Shanghai Institute of Intelligent Science and Technology, Tongji University(同济大学上海智能科学与技术研究院)

专题命中 机器人数据与评测 :navigation(title,abstract);分类 cs.RO

AI总结 提出KinematicRL框架,通过二阶控制动作空间、基于2D LiDAR的聚类人体追踪和无偏残差门控模块,解决社交导航中仿真到现实的动态可行性问题。

Comments Accepted by IEEE Transactions on Automation Science and Engineering (T-ASE)

详情

展开后加载摘要…

URL PDF HTML 收藏