arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-03-26 至 2026-03-26 共收录 13 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 13 篇

2603.23886 2026-03-26 cs.RO cs.AI 81%

AgentChemist: A Multi-Agent Experimental Robotic Platform Integrating Chemical Perception and Precise Control

AgentChemist: 一种集成化学感知与精确控制的多智能体实验机器人平台

Xiangyi Wei, Fei Wang, Haotian Zhang, Xin An, Haitian Zhu, Lianrui Hu, Yang Li, Changbo Wang, Xiao He

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO、cs.AI

AI总结 本文提出AgentChemist平台,通过协作任务分解、动态调度和自适应控制,解决实验室中多样、罕见和演变的操作问题,提升自动化系统的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23374 2026-03-26 cs.CV 79%

NeXT-IMDL: Build Benchmark for NeXT-Generation Image Manipulation Detection & Localization

NeXT-IMDL:构建下一代图像篡改检测与定位的基准测试

Yifei Li, Haoyuan He, Yu Zheng, Bingyao Yu, Wenzhao Zheng, Lei Chen, Jie Zhou, Jiwen Lu

专题命中 机器人数据与评测 :manipulation(title,abstract);分类 cs.CV

AI总结 本文提出NeXT-IMDL基准测试,通过系统性评估揭示现有图像篡改检测模型在多样化的现实场景中的局限性,推动构建更稳健的下一代检测模型。

Comments Duplicate experiment results in Table 3 (Set-1 & Set-2)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23903 2026-03-26 cs.CV cs.AI 76%

Latent Bias Alignment for High-Fidelity Diffusion Inversion in Real-World Image Reconstruction and Manipulation

潜在偏置对齐用于高保真扩散倒置在现实世界图像重建与操控中的应用

Weiming Chen, Qifan Liu, Siyi Liu, Yushun Tang, Yijia Wang, Zhihan Zhu, Zhihai He

机构 * Department of Electrical and Electronic Engineering, Southern University of Science and Technology(南方科技大学电子与电气工程系) Undergraduate School of Artificial Intelligence, Shenzhen Polytechnic University(深圳理工大学人工智能本科生学院) Huawei Technologies Co., Ltd.(华为技术有限公司) Pengcheng Lab(鹏城实验室)

专题命中 机器人数据与评测 :manipulation(title);分类 cs.AI、cs.CV

AI总结 本文提出Latent Bias Optimization和Image Latent Boosting方法,解决扩散模型与现实场景衔接中的重建质量与鲁棒性问题,提升图像编辑和稀有概念生成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09622 2026-03-26 cs.RO cs.AI 73%

DIDLM: A SLAM Dataset for Difficult Scenarios Featuring Infrared, Depth Cameras, LIDAR, 4D Radar, and Others under Adverse Weather, Low Light Conditions, and Rough Roads

DIDLM:一种针对困难场景的SLAM数据集,包含红外、深度相机、LIDAR、4D雷达等,在恶劣天气、低光条件和粗糙路面下

Weisheng Gong, Chen He, Kaijie Su, Qingyong Li, Tong Wu, Z. Jane Wang

机构 * School of Information Science and Technology, Northwest University(信息科学与技术学院,西北大学) Department of Electrical and Computer Engineering, The University of British Columbia(电气与计算机工程系,不列颠哥伦比亚大学)

专题命中 机器人数据与评测 :navigation(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 本文提出DIDLM数据集,包含红外、深度相机、LIDAR、4D雷达等多传感器数据,用于解决恶劣天气、低光和粗糙路面下的SLAM问题,提供GPS/INS地面真实数据,支持自动驾驶和地面机器人应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20150 2026-03-26 cs.RO 70%

HortiMulti: A Multi-Sensor Dataset for Localisation and Mapping in Horticultural Polytunnels

HortiMulti:一种用于温室局部化与建图的多传感器数据集

Shuoyuan Xu, Zhipeng Zhong, Tiago Barros, Matthew Coombes, Cristiano Premebida, Hao Wu, Cunjia Liu

机构 * Department of Aeronautical and Automotive Engineering, Loughborough University(航空航天与汽车工程系,洛桑大学) Department of Electrical and Computer Engineering, Institute of Systems and Robotics, University of Coimbra(电气与计算机工程系,系统与机器人研究所,科英布拉大学) Antobot Ltd, Arise Innovation Hub(Antobot公司,Arise创新中心)

专题命中 机器人数据与评测 :robotics(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出HortiMulti数据集,用于解决温室环境中局部化与建图的挑战,通过多传感器数据验证现有方法的不足,为农业机器人提供可靠资源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24440 2026-03-26 cs.LG cs.AI cs.CV 67%

CUA-Suite: Massive Human-annotated Video Demonstrations for Computer-Use Agents

CUA-Suite:大规模人工标注的视频演示用于计算机使用代理

Xiangru Jian, Shravan Nayak, Kevin Qinghong Lin, Aarash Feizi, Kaixin Li, Patrice Bechard, Spandana Gella, Sai Rajeswar

机构 * ServiceNow University of Waterloo(多伦多大学) Mila Université de Montréal(蒙特利尔大学) McGill University(麦吉尔大学) University of Oxford(牛津大学) National University of Singapore(新加坡国立大学)

专题命中 机器人数据与评测 :world model(abstract);分类 cs.AI、cs.CV、cs.LG

AI总结 CUA-Suite通过提供连续高质量视频演示和密集标注,解决计算机使用代理训练中视频数据不足的问题,包含约55小时的专家视频和600万帧数据,支持多模态研究。

Comments Project Page: https://cua-suite.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23973 2026-03-26 cs.CV cs.GR cs.RO 62%

SLAT-Phys: Fast Material Property Field Prediction from Structured 3D Latents

SLAT-Phys:从结构化3D潜在特征快速预测材料属性场

Rocktim Jyoti Das, Dinesh Manocha

机构 * University of Maryland, College Park(马里兰大学学院公园分校)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO、cs.CV

AI总结 SLAT-Phys通过单张RGB图像直接预测3D资产的空间变化材料属性场,利用预训练的3D资产生成模型的结构化潜在特征,结合轻量级神经解码器,高效估计杨氏模量、密度和泊松比,实现比传统方法更快的材料属性预测。

Comments 8 page, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24461 2026-03-26 cs.RO 57%

Design, Modelling and Characterisation of a Miniature Fibre-Reinforced Soft Bending Actuator for Endoluminal Interventions

微型纤维增强软弯曲执行器的设计、建模与表征用于内镜干预

Xiangyi Tan, Aoife McDonald-Bowyer, Danail Stoyanov, Agostino Stilli

机构 * UCL Hawkes Institute, University College London(UCL霍克斯研究所,伦敦大学学院)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 本文设计并验证了用于内镜机器人平台的厘米级纤维增强软执行器,通过多阶段多刚度硅胶铸造工艺制造,实现了弯曲角度的优化与结构稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24401 2026-03-26 cs.RO 57%

Enhancing Drone Light Shows Performances: Optimal Allocation and Trajectories for Swarm Drone Formations

提升无人机灯光表演性能:蜂群无人机编队的最优分配与轨迹

Yunes Alqudsi

机构 * Aerospace Engineering Department, Faculty of Aeronautics and Astronautics, Kocaeli University(航空航天工程系,航空航天学院,科伊亚利大学) Interdisciplinary Research Centre for Aviation and Space Exploration (IRC-ASE), KFUPM(航空与航天探索交叉研究中心(IRC-ASE),国王费萨尔大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 本文提出统一分配与轨迹生成框架,解决大规模无人机编队的最优分配与无碰撞轨迹生成问题,实现高效、流畅的灯光表演。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24166 2026-03-26 cs.CV 57%

Heuristic-inspired Reasoning Priors Facilitate Data-Efficient Referring Object Detection

启发式推理先验促进数据高效的指代物体检测

Xu Zhang, Zhe Chen, Jing Zhang, Dacheng Tao

机构 * The University of Sydney(悉尼大学) La Trobe University(拉特罗布大学) Wuhan University(武汉大学) Nanyang Technological University(南洋理工大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 本文提出HeROD框架,通过注入启发式推理先验提升数据稀缺条件下的指代物体检测性能,实验表明其在低数据和少样本场景下优于现有基线。

Comments CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24021 2026-03-26 cs.RO 57%

QuadFM: Foundational Text-Driven Quadruped Motion Dataset for Generation and Control

QuadFM: 用于生成与控制的四足运动基础数据集

Li Gao, Fuzhi Yang, Jianhui Chen, Liu Liu, Yao Zheng, Yang Cai, Ziqiao Li

机构 * Alibaba Group(阿里巴巴集团)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 QuadFM 是首个大规模高保真四足运动数据集,包含11784个运动片段,涵盖多种运动、交互和情绪表达行为,支持语言驱动的运动生成与控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23864 2026-03-26 cs.CV 57%

See, Remember, Explore: A Benchmark and Baselines for Streaming Spatial Reasoning

看见、记忆、探索:面向流式空间推理的基准与基线

Yuxi Wei, Wei Huang, Qirui Chen, Lu Hou, Xiaojuan Qi

机构 * The University of Hong Kong(香港大学) Yinwang Intelligent Technology Co. Ltd.(云网智能技术有限公司) Shanghai Jiao Tong University(上海交通大学)

专题命中 机器人数据与评测 :embodied agent(abstract);分类 cs.CV

AI总结 本文提出S3-Bench基准,通过流式空间问答与主动探索解决传统方法在长时序推理和主动感知方面的不足,并提出AMF-VLM模型在压缩内存与主动探索方面实现性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23812 2026-03-26 cs.HC 50%

A Reproducible Reality-to-VR Pipeline for Ecologically Valid Aging-in-Place Research

一种可重复的现实到VR流程用于生态效度的在地衰老研究

Ibrahim Bilau, Stacie Smith, Abdurrahman Baru, Marwan Shagar, Brian Jones, Eunhwa Yang

专题命中 机器人数据与评测 :manipulation(abstract)

AI总结 本文提出一种可重复的现实到VR流程,用于创建高保真的环境模拟,支持对在地衰老的认知研究。通过TLS扫描、点云处理、几何建模和Unreal Engine 5集成,实现高视觉保真度和稳定的90Hz帧率,降低老年人眩晕风险。

Comments 28 pages, 5 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏