arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-05-27 至 2026-05-27 共收录 82 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 10 篇

2509.04310 2026-05-27 cs.AI 57%

EvoEmo: Towards Evolved Emotional Policies for Adversarial LLM Agents in Multi-Turn Price Negotiation

EvoEmo:面向多轮价格谈判中对抗性LLM智能体的进化情感策略

Yunbo Long, Liming Xu, Lukas Beckenbauer, Yuhan Liu, Alexandra Brintrup

机构 * Department of Engineering, University of Cambridge(剑桥大学工程系) Rotman School of Management, University of Toronto(多伦多大学罗特曼管理学院) TUM School of Management, Technical University of Munich(慕尼黑技术大学管理学院) The Alan Turing Institute, London, UK(伦敦阿尔安·图灵研究院)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.AI

AI总结 提出EvoEmo进化强化学习框架,通过将情感状态转移建模为马尔可夫决策过程并采用种群遗传优化,动态优化多轮谈判中的情感表达,显著提升LLM智能体的谈判成功率、效率和买家节省。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 人机交互与遥操作 3 篇

2504.00167 2026-05-27 cs.RO 77%

Enhancing Physical Human-Robot Interaction: Recognizing Digits via Intrinsic Robot Tactile Sensing

增强物理人机交互:通过机器人本体触觉感知识别数字

Teresa Sinico, Giovanni Boschetti, Pedro Neto

机构 * Dep. Management and Engineering University of Padua(管理与工程系帕多瓦大学) CEMMPRE, Dep. Mechanical Engineering University of Coimbra(CEMMPRE,机械工程系科英布拉大学)

专题命中 人机交互与遥操作 :robotics(abstract,abstract_cn);robotic(abstract);分类 cs.RO

AI总结 利用协作机器人内置扭矩传感器采集人手在触控板上书写数字时的关节力矩和末端力数据,通过双向LSTM网络实现94%准确率的在线数字识别,并在水果递送任务中验证其应用潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26991 2026-05-27 cs.RO 57%

Towards Shared Embodied Intelligence in Humanoid Robots through Optimization Development and Testing of the Human Aware ergoCub Robot

通过优化开发与测试人类感知的ergoCub机器人迈向人形机器人的共享具身智能

Carlotta Sartore, Mohamed Elobaid, Lorenzo Rapetti, Giulio Romualdi, Stefano Dafarra, Nicola A. Piga, Ines Sorrentino, Paolo Maria Vicecone, Silvio Traversaro, Ugo Pattacini, Luca Fiorio, Francesco Draicchio, Giovanna Tranfo, Lorenzo Natale, Marco Maggiali, Daniele Pucci

机构 * GenerativeBionics(生成生物技术) Artificial and Mechanical Intelligence(人工与机械智能) School of Computer Science, University of Manchester(曼彻斯特大学计算机科学学院) Humanoid Sensing and Perception(人形感知与感知) iCub Tech Facility(iCub技术设施) DiMEILA, Istituto Nazionale Assicurazione Infortuni sul Lavoro (INAIL)(DiMEILA,意大利国家职业伤害保险机构(INAIL))

专题命中 人机交互与遥操作 :robotics(abstract);分类 cs.RO

AI总结 提出一种融合共享智能与具身认知的架构,通过优化机器人硬件与控制以符合人体工学指标,实现人机物理协作,并以ergoCub人形机器人为具体实现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26349 2026-05-27 cs.RO 57%

Closing the Loop in Teleoperation: Episode-Level Data Quality Assessment and Feedback for High-Quality Demonstration Collection

在遥操作中闭环:面向高质量演示收集的片段级数据质量评估与反馈

Gokul Narayanan, Yash Shahapurkar, Melih Erdogan, Brian Zhu, Eugen Solowjow

机构 * Siemens Corporation(西门子公司)

专题命中 人机交互与遥操作 :manipulation(abstract);分类 cs.RO

AI总结 提出数据质量评估与反馈框架,通过语义任务进度和机器人遥测数据提供即时后片段反馈,帮助新手操作员提升演示质量。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 机器人数据与评测 10 篇

2605.27134 2026-05-27 cs.AI 79%

Scaling, Benchmarking, and Reasoning of Vision-Language Agents for Mobile GUI Navigation

面向移动GUI导航的视觉语言模型:缩放、基准测试与推理

Heng Qu, Yike Liu, Renren Jin, Wenzong Zhang, Pengzhi Gao, Wei Liu, Jian Luan

机构 * Wuhan University(武汉大学)

专题命中 机器人数据与评测 :navigation(title,abstract);分类 cs.AI

AI总结 本文系统研究了视觉语言模型在移动GUI导航中的数据缩放、基准测试与推理,提出了大规模数据集HyperTrack和开源工具包GUIEvalKit,并发现基于强化学习的微调优于监督微调,尤其在域外场景中表现更佳。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26576 2026-05-27 cs.CV cs.LG 62%

TrackRef3D: Multi-View Consistent Track-then-Label for Open-World Referring Segmentation in 3D Gaussian Splatting

TrackRef3D: 面向开放世界3D高斯泼溅分割的多视角一致跟踪-标注方法

Yuyang Tan, Renhe Zhang, Hang Zhang, Ao Li, Xin Tan

机构 * East China Normal University, Shanghai, China(华东师范大学,上海,中国) Shanghai AI Laboratory(上海人工智能实验室) University of Electronic Science and Technology of China, Chengdu, China(电子科技大学,成都,中国)

专题命中 机器人数据与评测 :embodied AI(abstract);分类 cs.CV、cs.LG

AI总结 提出TrackRef3D全自动流水线,通过多视角一致跟踪-标注范式解耦目标发现与语义定位,无需人工标注实现开放世界3D高斯泼溅分割。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26629 2026-05-27 cs.CV 57%

DelowlightSplat: Feed-Forward Gaussian Splatting for Lowlight 3D Scene Reconstruction

DelowlightSplat: 面向低光照3D场景重建的前馈高斯泼溅

Fuzhen Jiang, Zengtian Xie, Zhuoran Li

机构 * Hangzhou Dianzi University(杭州电子科技大学) Zhuhai College of Science(珠海科技学院)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 提出DelowlightSplat,一种低光照感知的前馈高斯泼溅框架,通过轻量级低光照适配器和成本体积多视图推理,从稀疏有噪声图像中直接预测干净3D高斯,实现高质量新视角合成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26256 2026-05-27 cs.AI 57%

Personalizing Embodied Multimodal Large Language Model Agents over Long-term User Interactions

个性化具身多模态大语言模型代理在长期用户交互中的应用

Jeongeun Lee, Chanyoung Park, Dongha Lee

机构 * Yonsei University(延世大学) KAIST(韩国科学技术院)

专题命中 机器人数据与评测 :embodied agent(abstract);分类 cs.AI

AI总结 提出POLAR框架,通过多模态知识图谱记忆机制增强具身代理在长期交互中的个性化能力,显著提升多步推理和用户上下文跟踪性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19673 2026-05-27 cs.CV 57%

InHabit: Leveraging Image Foundation Models for Scalable 3D Human Placement

InHabit: 利用图像基础模型实现可扩展的3D人体放置

Nikita Kister, Pradyumna YM, István Sárándi, Jiayi Wang, Anna Khoreva, Gerard Pons-Moll

机构 * Bosch Center of Artificial Intelligence(博世人工智能中心) Max Planck Institute for Informatics(马克斯·普朗克信息学院)

专题命中 机器人数据与评测 :embodied agent(abstract);分类 cs.CV

AI总结 提出InHabit方法,通过渲染-生成-提升流程利用2D基础模型知识自动生成3D场景中与几何一致的人体交互数据,并构建大规模数据集InHabitants,显著提升3D人体-场景重建和接触估计性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14640 2026-05-27 cs.CL cs.AI 57%

Fact4ac at the Financial Misinformation Detection Challenge Task: Reference-Free Financial Misinformation Detection via Fine-Tuning and Few-Shot Prompting of Large Language Models

Fact4ac在金融虚假信息检测挑战赛中的方法:通过微调和少样本提示的大语言模型实现无参考金融虚假信息检测

Cuong Hoang, Le-Minh Nguyen

机构 * KaiNKaiho

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI

AI总结 本文提出一种结合零样本/少样本提示和LoRA参数高效微调的大语言模型框架,用于无外部证据的金融虚假信息检测,在公开和私有测试集上分别达到95.4%和96.3%的准确率,获得竞赛第一名。

Journal ref Proceedings of the 2nd Workshop on Misinformation Detection in the Era of LLMs (MisD 2026), 20th International AAAI Conference on Web and Social Media

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07284 2026-05-27 cs.RO 57%

AdaMorph: Unified Motion Retargeting via Embodiment-Aware Adaptive Transformers

AdaMorph: 通过具身感知自适应变换器实现统一运动重定向

Haoyu Zhang, Shibo Jin, Lusong Li, Jun Li, Liang Lin, Xiaodong He, Zecui Zeng

机构 * JD Explore Academy(京东探索学院)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 提出AdaMorph统一框架,利用具身感知自适应变换器将人体运动重定向到多种机器人形态,实现零样本泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09606 2026-05-27 cs.CV 57%

SpaceVista: All-Scale Visual Spatial Reasoning from mm to km

SpaceVista:从毫米到公里的全尺度视觉空间推理

Peiwen Sun, Shiqiang Lang, Dongming Wu, Yi Ding, Kaituo Feng, Huadai Liu, Zhen Ye, Rui Liu, Yun-Hui Liu, Jianan Wang, Xiangyu Yue

机构 * Multimedia Laboratory, The Chinese University of Hong Kong(香港中文大学多媒体实验室) Beijing University of Posts(北京邮电大学) Hong Kong University of Science(香港理工大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 本文提出全尺度空间推理解决方案,通过结构化知识系统、尺度感知建模和渐进训练范式,构建SpaceVista-1M数据集(38K视频场景、约1M空间QA对)和SpaceVista-7B模型,在5个基准上展现强泛化能力。

Comments Project Page: https://peiwensun2000.github.io/mm2km/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02974 2026-05-27 cs.LG 57%

PLAID: A Unified Data Model for Machine Learning on Heterogeneous Physics Simulations

PLAID:面向异构物理模拟的机器学习统一数据模型

Fabien Casenave, Xavier Roynard, Brian Staber, Alexandre Devaux-Rivière, William Piat, Michele Alessandro Bucci, Nissrine Akkari, Abbas Kabalan, Xuan Minh Vuong Nguyen, Luca Saverio, Raphaël Carpintero Perez, Anthony Kalaydjian, Samy Fouché, Thierry Gonon, Ghassan Najjar, Thomas Daniel, Emmanuel Menier, Matthieu Nastorg, Giovanni Catalani, Christian Rey

机构 * EPFL(苏黎世联邦理工学院) Inria(法国国家信息与自动化技术研究院)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.LG

AI总结 提出PLAID统一数据层,通过标准化异构物理模拟数据并发布六个基准数据集,解决机器学习代理模型缺乏大规模多样化数据集的问题。

Comments Presented at EuRIPS 2025 and accepted at the AI4Physics Workshop @ ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08540 2026-05-27 cs.CV 57%

Datasets for Lane Detection in Autonomous Driving: A Comprehensive Review

自动驾驶中车道检测数据集:全面综述

Jörg Gamerdinger, Sven Teufel, Oliver Bringmann

机构 * University of Tübingen, Faculty of Science, Department of Computer Science, Embedded Systems Group(图宾根大学,科学学院,计算机科学系,嵌入式系统小组)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.CV

AI总结 本文全面综述了20个公开车道检测数据集,通过多维质量指标分析其特性、优势和局限,并指出未来改进方向以推动鲁棒车道检测创新。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 其他机器人 8 篇

2602.17822 2026-05-27 cs.RO 83%

Evolution of Safety Requirements in Industrial Robotics: Comparative Analysis of ISO 10218-1/2 (2011 vs. 2025) and Integration of ISO/TS 15066

工业机器人安全要求的演进:ISO 10218-1/2(2011 与 2025 版)比较分析及 ISO/TS 15066 的整合

Daniel Hartmann, Kristýna Hamříková, Aleš Vysocký, Vendula Laciok, Aleš Bernatík

机构 * Faculty of Mechanical Engineering, VSB—Technical University of Ostrava(机械工程学院,奥斯特拉瓦技术大学) Faculty of Safety Engineering, VSB—Technical University of Ostrava(安全工程学院,奥斯特拉瓦技术大学)

专题命中 其他机器人 :robotics(title,abstract);robotic(abstract);分类 cs.RO

AI总结 本文通过比较 ISO 10218:2011 与 ISO 10218:2025 标准,分析工业机器人安全要求在功能安全、网络安全、机器人分类及协作应用等方面的演进,并整合 ISO/TS 15066,建立现代机器人系统设计与运行的全面框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21450 2026-05-27 cs.RO cs.SY eess.SY 72%

Vector Fields for Path Following on Lie Groups with Application in Robot Control

李群上的路径跟随向量场及其在机器人控制中的应用

Felipe Bartelt, Luciano C. A. Pimenta, Weijia Yao, Vinicius M. Gonçalves

专题命中 其他机器人 :robotics(abstract,comments);robotic(abstract);分类 cs.RO

AI总结 针对李群上的路径跟随问题,提出一种通用向量场框架,保证从几乎所有初始条件收敛到期望参数曲线并连续运动,在SE(3)上给出最小表示的控制输入,通过机械臂实验验证有效性。

Comments Manuscript revised: new title, reframed abstract and introduction for robotics, and added a coauthor

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26648 2026-05-27 cs.RO 70%

L-Learning : A Lyapunov-Based Approach Leveraging Lagrangian Mechanics for Efficient and Stable Robot Tracking

L-Learning:一种基于李雅普诺夫与拉格朗日力学的机器人高效稳定跟踪方法

Quan Quan, Hao Li

机构 * School of Automation Science and Electrical Engineering, Beihang University(北京航空航天大学自动化科学与电气工程学院)

专题命中 其他机器人 :robotics(abstract);robotic(abstract);分类 cs.RO

AI总结 提出L-Learning框架,结合李雅普诺夫稳定性理论与拉格朗日力学,从数据中学习系统能量函数,实现高效、稳定且样本效率高的机器人轨迹跟踪。

Comments 9 pages, 4 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26577 2026-05-27 eess.SY cs.AI cs.LG cs.SY math.OC 62%

Bridging Control with Neural Network Verifier alpha-beta-CROWN: A Tutorial

桥接控制与神经网络验证器 alpha-beta-CROWN:教程

Haoyu Li, Xiangru Zhong, Hao Cheng, Bin Hu, Huan Zhang

机构 * Department of Computer Science(计算机科学系) Department of Electrical and Computer Engineering(电气与计算机工程系)

专题命中 其他机器人 :robotics(abstract);分类 cs.AI、cs.LG

AI总结 本教程提出一个统一框架,通过将控制问题与神经网络验证器 α,β-CROWN 桥接,实现控制器属性的可扩展形式验证。

Comments ACC 2026 Tutorial

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26316 2026-05-27 cs.CV cs.AI 62%

E$^3$C: Video Generation with 3D Environmental Memory and Ego-Exo Human Pose Control

E$^3$C: 具有3D环境记忆和自我-外部人体姿态控制的视频生成

Qiao Gu, Lingni Ma, Adam W Harley, Richard Newcombe, Florian Shkurti, Julian Straub

机构 * Meta Reality Labs(Meta现实实验室) University of Toronto(多伦多大学)

专题命中 其他机器人 :embodied agent(abstract);分类 cs.AI、cs.CV

AI总结 提出E$^3$C可控视频扩散框架,通过3D点云记忆和双通道人体控制(自我与外骨骼),实现物理一致的自我中心视频生成。

Comments Preprint. Project Page: https://e3c-videogen.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11790 2026-05-27 cs.LG 57%

Disentangled Representation Learning through Unsupervised Symmetry Group Discovery

通过无监督对称群发现实现解缠表示学习

Barthélémy Dang-Nhu, Louis Annabi, Sylvain Argentieri

机构 * Sorbonne Université, CNRS, Institut des Systèmes Intelligents et de Robotique, ISIR(索邦大学,国家科学研究中心,智能系统与机器人研究所,ISIR)

专题命中 其他机器人 :embodied agent(abstract);分类 cs.LG

AI总结 提出一种具身智能体通过与环境的无监督交互自主发现动作空间的群结构的方法,证明了在最小假设下真实对称群分解的可识别性,并推导出两种算法以学习线性对称基解缠表示。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26473 2026-05-27 eess.SY cs.SY 50%

Orion: Enabling Self-adaptive Memory Management for On-device Online Continual Learning

Orion:为设备端在线持续学习实现自适应内存管理

Zexin Li, Nikil Dutt, Cong Liu

专题命中 其他机器人 :robotic(abstract)

AI总结 针对资源受限系统中在线持续学习的内存压力与工作负载动态变化,提出Orion框架,通过统一运行时指标URGE协同优化批处理、回放缓冲区和优化策略,实现训练延迟、可塑性与稳定性的联合优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05608 2026-05-27 astro-ph.HE 50%

Thermal Electrons in an Ultra-Relativistic Shock Shape the Optical Afterglow of GRB 250702F

超相对论激波中的热电子塑造GRB 250702F的光学余辉

Martin Jelínek, Annarita Ierardi, Filip Novotný, Gor Oganesyan, Biswajit Banerjee, Dimitrios Giannios, Sergey Karpov, Martin Topinka, Elias Kammoun, Jan Štrobl, Alberto J. Castro-Tirado

专题命中 其他机器人 :robotic(abstract)

AI总结 本文通过GRB 250702F的高时间分辨率光学观测,发现一个由热电子同步辐射导致的陡峭衰减阶段,揭示了超相对论激波中热电子存在的证据。

Comments 8 pages, 4 figures

Journal ref A&A 710, L1 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏