arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-04-22 至 2026-04-22 共收录 8 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 8 篇

2604.19734 2026-04-22 cs.RO cs.AI 84%

UniT: Toward a Unified Physical Language for Human-to-Humanoid Policy Learning and World Modeling

UniT:迈向人类到人形机器人政策学习和世界建模的统一物理语言

Boyu Chen, Yi Chen, Lu Qiu, Jerry Bai, Yuying Ge, Yixiao Ge

机构 * XPENG Robotics(小鹏机器人) Tsinghua University(清华大学) The University of Hong Kong(香港大学)

专题命中 机器人数据与评测 :world model(title,abstract);robotic(abstract);分类 cs.RO、cs.AI;robotics(comments)

AI总结 UniT通过三分支交叉重建机制建立统一物理语言,实现人类到人形机器人的跨身体迁移,提升政策学习和世界建模的效率与鲁棒性。

Comments Project page: https://xpeng-robotics.github.io/unit/

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11107 2026-04-22 cs.RO cs.LG 81%

Latent Linear Quadratic Regulator for Robotic Control Tasks

隐式线性二次调节器用于机器人控制任务

Yuan Zhang, Shaohui Yang, Toshiyuki Ohtsuka, Colin Jones, Joschka Boedecker

机构 * University of Freiburg(弗赖堡大学) EPFL(苏黎世联邦理工学院) Kyoto University(京都大学)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO、cs.LG

AI总结 本文提出隐式线性二次调节器(LaLQR),通过将状态空间映射到隐空间,使动态模型线性化并使成本函数二次化,从而高效应用LQR。实验表明其在效率和泛化能力上优于其他基线方法。

Comments Accepted at L4DC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19643 2026-04-22 cs.RO 61%

A Gesture-Based Visual Learning Model for Acoustophoretic Interactions using a Swarm of AcoustoBots

基于手势的视觉学习模型用于声学聚沉交互的声学机器人群

Alex Lin, Lei Gao, Narsimlu Kemsaram, Sriram Subramanian

机构 * Department of Computer Science University College London London United Kingdom(计算机科学系伦敦大学学院伦敦英国) Department of Artificial Intelligence University of Malaya Kuala Lumpur Malaysia(人工智能系马来大学吉隆坡马来西亚) University College London(伦敦大学学院) University of Malaya(马来大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO;robotics(comments)

AI总结 本文提出基于手势的视觉学习框架,实现无接触人-机器人群交互,通过多模态AcoustoBot平台实现手势识别与触觉、音频、悬浮等模态映射,验证准确率提升至98%。

Comments This paper has been accepted for publication in the Proceedings of the 2026 4th International Conference on Robotics, Control and Vision Engineering (RCVE 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19567 2026-04-22 cs.AI 57%

Multi-modal Reasoning with LLMs for Visual Semantic Arithmetic

基于LLM的多模态推理用于视觉语义算术

Chuou Xu, Liya Ji, Qifeng Chen

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.AI

AI总结 本文提出两种新型任务和IRPD数据集,通过SAri-RFT方法提升大视觉语言模型的跨模态关系推理能力,实现视觉语义算术的突破。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16662 2026-04-22 cs.RO eess.SP 57%

Joint Magnetometer-IMU Calibration via Maximum A Posteriori Estimation

通过最大后验估计联合磁力计-IMU校准

Chuan Huang, Gustaf Hendeby, Isaac Skog

机构 * Dept. of Electrical Engineering and Computer Science, KTH Royal Institute of Technology(电子工程与计算机科学系,皇家理工学院) Dept. of Electrical Engineering, Linköping University(电子工程系,利尔贝里大学) Dept. of Electrical Engineering and Computer Science, KTH Royal Institute of Technology, and the Div. of Underwater Technology, Swedish Defence Research Agency (FOI)(电子工程与计算机科学系,皇家理工学院,以及瑞典国防研究机构(FOI)的水下技术系)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO

AI总结 本文提出一种联合校准磁力计和惯性测量单元的方法,通过最大后验估计框架优化校准参数,提升精度与效率,实验证明其校准精度提高20-30%,且计算效率高。

Comments Accepted version

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18790 2026-04-22 cs.CV 57%

EfficientPENet: Real-Time Depth Completion from Sparse LiDAR via Lightweight Multi-Modal Fusion

EfficientPENet:通过轻量多模态融合实现稀疏LiDAR的实时深度补全

Johny J. Lopez, Md Meftahul Ferdaus, Mahdi Abdelguerfi, Anton Netchaev, Steven Sloan, Ken Pathak, Kendall N. Niles

机构 * Canizaro Livingston Gulf States Center for Environmental Informatics, the University of New Orleans, New Orleans, USA(Canizaro Livingston Gulf States环境信息中心,新奥尔良大学,美国新奥尔良) US Army Corps of Engineers, Engineer Research and Development Center, Vicksburg, Mississippi, USA(美国陆军工程兵团,工程师研究与发展中心,密西西比州维克斯堡,美国)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.CV

AI总结 本文提出EfficientPENet,通过轻量级多模态融合网络,在稀疏LiDAR和RGB图像上实现实时深度补全,具有更少的参数和更高的速度,同时保持竞争力的精度。

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19626 2026-04-22 eess.SP 50%

Odour sensing in turbulent plumes with high-speed electronic nose and non-invasive ground truth

湍流中高灵敏度电子鼻的气味传感

Nik Dennler, Elle Stark, Saimon Collaku, Lars Larson, André van Schaik, Michael Schmuker, John Crimaldi, Andreas T. Güntner, Aaron True

专题命中 机器人数据与评测 :robotics(abstract)

AI总结 本文提出结合平面激光诱导荧光与定制MEMS电子鼻的实验数据集,用于评估传感器动态特性及开发重建算法,支持高灵敏度气味传感系统的设计与评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04925 2026-04-22 cs.CL 50%

Can AI-Generated Persuasion Be Detected? Persuaficial Benchmark and AI vs. Human Linguistic Differences

AI生成的说服能否被检测?Persuaficial基准与AI与人类语言差异

Arkadiusz Modzelewski, Paweł Golik, Anna Kołos, Giovanni Da San Martino

机构 * NASK National Research Institute(波兰国家科研 institute) University of Padua(意大利帕多瓦大学) Polish-Japanese Academy of Information Technology(波兰-日本信息科技学院)

专题命中 机器人数据与评测 :manipulation(abstract)

AI总结 本文探讨LLM生成的说服内容是否更难自动检测,通过Persuaficial基准对比人类与AI生成文本的语言差异,揭示细微说服策略对检测性能的影响。

Comments Accepted to ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏