arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-04-29 至 2026-04-29 共收录 62 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 1 篇

2604.25788 2026-04-29 cs.RO 88%

KinDER: A Physical Reasoning Benchmark for Robot Learning and Planning

KinDER:机器人学习与规划的运动学与动力学推理基准

Yixuan Huang, Bowen Li, Vaibhav Saxena, Yichao Liang, Utkarsh Aashu Mishra, Liang Ji, Lihan Zha, Jimmy Wu, Nishanth Kumar, Sebastian Scherer, Danfei Xu, Tom Silver

机构 * Princeton University(普林斯顿大学) Carnegie Mellon University(卡内基梅隆大学) Georgia Tech(佐治亚理工学院) University of Cambridge(剑桥大学) NVIDIA(英伟达) MIT(麻省理工学院)

专题命中 机器人学习 :robot learning(title,abstract);robotics(abstract,comments);manipulation(abstract);robotic(abstract)

AI总结 KinDER基准针对机器人学习与规划中的物理推理挑战,包含25个生成环境、Python库和评估套件,旨在通过系统比较不同方法提升机器人物理推理能力。

Comments Project website: https://prpl-group.com/kinder-site/. 21 pages, 8 figures. Accepted to Robotics Science and Systems (RSS), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 19 篇

2206.06282 2026-04-29 cs.RO cs.AI 88%

Analysis of Randomization Effects on Sim2Real Transfer in Reinforcement Learning for Robotic Manipulation Tasks

随机化对机器人操作任务中仿真到现实转移的影响分析

Josip Josifovski, Mohammadhossein Malmir, Noah Klarmann, Bare Luka Žagar, Nicolás Navarro-Guerrero, Alois Knoll

机构 * Department of Informatics, Technical University of Munich(慕尼黑技术大学信息学院) Rosenheim University of Applied Sciences(罗森海姆应用技术大学)

专题命中 机器人操作 :robotic(title,abstract);manipulation(title);robotics(abstract);分类 cs.RO、cs.AI

AI总结 本文提出一个可复现的实验框架,比较四种随机化策略在仿真和现实中的表现,发现更多随机化有助于仿真到现实转移,但可能影响仿真中策略的学习能力。

Comments Accepted to IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25323 2026-04-29 cs.RO 83%

ANCHOR: A Physically Grounded Closed-Loop Framework for Robust Home-Service Mobile Manipulation

ANCHOR:一种基于物理的闭环框架,用于鲁棒的家庭服务移动操作

Jinhao Jiang, Shengyu Fang, Sibo Zuo, Yujie Tang, Yirui Li

机构 * Beijing Institute of Technology(北京理工大学)

专题命中 机器人操作 :manipulation(title,abstract);navigation(abstract);分类 cs.RO

AI总结 ANCHOR通过物理 grounding 和结构化故障处理,提升家庭服务机器人在动态环境中的任务成功率和扰动恢复能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04182 2026-04-29 cs.CV 79%

PortraVec: Image-Based Portrait Vectorization with Text-Guided Manipulation

PortraVec: 基于图像的肖像向量化与文本引导的操控

Yiqi Liang, Ying Liu, Dandan Long, Ruihui Li

机构 * Yuelushan Center for Industrial Innovation(岳麓山创新中心)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.CV

AI总结 PortraVec通过文本引导操控模块和图像引导生成模块,实现像素图像到向量草图的转换,提升面部结构一致性、视觉保真度和语义可控性。

Comments 6 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25255 2026-04-29 cs.CV 79%

Personalized Cross-Modal Emotional Correlation Learning for Speech-Preserving Facial Expression Manipulation

面向语音保留的面部表情操控的个性化跨模态情感相关学习

Tianshui Chen, Yujie Zhu, Jianman Lin, Zhijing Yang, Chunmei Qing, Feng Gao, Liang Lin

机构 * Guangdong University of Technology(广东工业大学) South China University of Technology(华南理工大学) Peking University(北京大学) Sun Yat-Sen University(中山大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.CV

AI总结 本文提出PCMECL算法,通过个性化提示和特征差分提升跨模态对齐,解决面部表情操控中情感操控的监督问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.00937 2026-04-29 cs.RO 76%

A Biomimetic Fingerprint for Robotic Tactile Sensing

仿生指纹用于机器人触觉感知

Oscar Alberto Juiña Quilachamín, Nicolás Navarro-Guerrero

机构 * Faculty of Mechatronic \& Micro-Mechatronic Systems Hochschule Karlsruhe (HKA) Karlsruhe, Germany Deutsches Forschungszentrum für Künstliche Intelligenz GmbH L3S Research Center, Leibniz Universität Hannover Hannover, Germany

专题命中 机器人操作 :robotic(title);分类 cs.RO;robotics(comments)

AI总结 本文提出一种3D打印指纹模式,提升机器人触觉反馈信号强度,实现动态触觉感知,展示了在不同材料物体上的应用效果。

Comments 56th International Symposium on Robotics (ISR Europe) | September 26-27, 2023, Stuttgart, Germany

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.11544 2026-04-29 cs.RO cs.AI 73%

Visuo-Haptic Object Perception for Robots: An Overview

机器人视觉-触觉物体感知综述

Nicolás Navarro-Guerrero, Sibel Toprak, Josip Josifovski, Lorenzo Jamone

机构 * Advanced Robotics at Queen Mary (ARQ), School of Engineering and Materials Science, Queen Mary University of London(伦敦女王大学工程与材料科学学院先进机器人研究中心)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 本文综述了机器人视觉-触觉物体感知的现状,探讨了生物基础、传感技术、计算方法及未来研究方向,强调多模态学习的挑战与应用进展。

Comments published in Autonomous Robots

Journal ref Autonomous Robots, 27 (2023) https://link.springer.com/article/10.1007/s10514-023-10091-y

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07105 2026-04-29 cs.RO 70%

Genie Sim PanoRecon: Fast Immersive Scene Generation from Single-View Panorama

Genie Sim PanoRecon:从单视角全景快速生成沉浸式场景

Zhijun Li, Yongxin Su, Di Yang, Jichao Wang, Zheyuan Xing, Qian Wang, Maoqing Yao

机构 * AgibotTech

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出Genie Sim PanoRecon,通过高斯点散布管道快速生成高质量3D场景,用于机器人操作模拟,实现全景分解、并行处理和无缝重建,提升仿真实景生成效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25160 2026-04-29 physics.optics 67%

Target-depth sensing with metasurface-encoder integrated optoelectronic neural network

基于元表面编码器的光学电子神经网络深度传感

Shuo Wang, Deyu Zhu, Chenjie Xiong, Bin Hu, Chunqi Jin, Yu Wang, Chengjun Zou

专题命中 机器人操作 :manipulation(abstract);robotic(abstract)

AI总结 本文提出一种集成元表面编码器的光学电子神经网络,通过双螺旋点扩散函数将3D信息压缩为2D图像,利用轻量级阴影ResNet网络实现目标分类和深度估计,实现实时目标跟踪。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25639 2026-04-29 cs.CY cs.AI 57%

Large language models eroding science understanding: an experimental study

大语言模型侵蚀科学理解:一项实验研究

Harry Collins, Hartmut Grote, Paul Newbury, Patrick Sutton, Simon Thorne

机构 * Springer Nature

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 本文研究大语言模型是否能可靠回答科学问题,并展示其易受边缘科学材料影响。通过修改模型优先考虑特定边缘论文,发现其回答与专家和标准模型相比存在矛盾,凸显模型易受操控的风险。

Comments Under review in AI and Ethics

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25512 2026-04-29 cs.AI 57%

PHISHREV: A Hybrid Machine Learning and Post-Hoc Non-monotonic Reasoning Framework for Context-Aware Phishing Website Classification

PHISHREV: 一种结合机器学习与事后非单调推理的上下文感知钓鱼网站分类框架

Mainak Sen, Kumar Sankar Ray, Amlan Chakrabarti

机构 * Techno India University(Techno India大学) University of Calcutta(Calcutta大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 本文提出PHISHREV框架,结合机器学习与非单调推理,通过专家知识修正分类器预测,提升决策一致性,支持领域知识快速更新。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16558 2026-04-29 cs.CR cs.AI 57%

A First Look at the Security Issues in the Model Context Protocol Ecosystem

对模型上下文协议生态系统安全问题的首次观察

Xiaofan Li, Xing Gao

机构 * University of Delaware, USA(德克萨斯大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 本文首次研究了模型上下文协议生态系统中的跨实体安全问题,揭示了注册表层面的漏洞和代码层面的攻击风险,提出了MCPInspect工具检测漏洞和可疑元数据。

Comments This paper has been accepted to DSN 2026. The title has been updated from the anonymous submission version used during double-blind review

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25695 2026-04-29 cs.CG 50%

Point Group Symmetry of Polyhedral Diagrams in Graphic Statics

多面体图在图形静力学中的点群对称性

Yefan Zhi, Yao Lu, Masoud Akbarzadeh

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文研究多面体图在三维图形静力学中的对称性,通过点群约束保持对称性,提出基于边长的对称性约束方法,提升设计效率与实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25638 2026-04-29 cond-mat.str-el cond-mat.mtrl-sci 50%

Collective and separate metal-insulator transitions in correlated vanadium dioxide

关联与独立金属-绝缘体转变在相关钒氧化物中

Xuanchi Zhou, Xiaohui Yao, Wentian Lu, Chunwei Yao, Xiaomei Qiao

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究通过调控钒氧化物中的氧缺陷和氢离子,实现对金属-绝缘体转变的动态控制,揭示了电子相变的多态调控机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24739 2026-04-29 quant-ph cs.ET 50%

CAbLECAR: efficiently scheduling QLDPC codes on a tileable spin qubit chip with shuttling

CAbLECAR: 在可拼接的自旋量子比特芯片上高效调度QLDPC码

Jason D. Chadwick, Frederic T. Chong

专题命中 机器人操作 :robotics(abstract)

AI总结 本文提出一种基于自旋量子比特芯片的QLDPC码调度方法,通过优化射频脉冲序列提升编码效率,并通过协调穿梭算法实现复杂码的高效实现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14190 2026-04-29 cs.DS cs.DB cs.IT math.IT 50%

Sublime: Sublinear Error & Space for Unbounded Skewed Streams

Sublime: 亚线性误差与空间用于无界偏斜流

Navid Eslami, Ioana O. Bercea, Rasmus Pagh, Niv Dayan

专题命中 机器人操作 :manipulation(abstract)

AI总结 Sublime框架通过动态扩展计数器和优化内存使用,提升频率估计精度与效率,适用于处理偏斜数据流的场景。

Comments 27 pages. 16 figures. 3 tables. Accepted to SIGMOD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08930 2026-04-29 quant-ph cond-mat.dis-nn 50%

Variational subspace methods and application to improving variational Monte Carlo dynamics

变分子空间方法及其在改进变分蒙特卡洛动力学中的应用

Adrien Kahn, Luca Gravina, Filippo Vicentini

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出一种可直接操控和优化子空间的框架,通过行列式态映射扩展距离和能量概念,提出Bridge方法以提升变分动力学性能,通过线性组合变分时间演化态减少离散化误差。

Comments 35 pages, 7 figures

Journal ref Quantum 10, 2082 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25115 2026-04-29 cond-mat.str-el 50%

Tunable thermal conductivity through dual spin-phonon coupling in van der Waals ferromagnetic insulator Cr2Ge2Te6

通过双自旋-声子耦合在范德瓦尔斯铁磁绝缘体Cr₂Ge₂Te₆中实现可调热导性

Zhongbin Wang, Wenlong Tang, Simin Pang, Hongxing Zhu, Renkang Fan, Baohai Jia, Junxue Li, Ben Xu, Jun Zhang, Lin Xie, Jiaqing He

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究通过双自旋-声子耦合在Cr₂Ge₂Te₆中调控热输运,揭示了磁场对声子输运的双重影响,为动态声子工程提供了实验依据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25070 2026-04-29 cs.GT cs.MA cs.SY eess.SY 50%

Asymmetric-Information Resource Allocation Games: An LP Approach to Purposeful Deception

不对称信息资源分配博弈:一种线性规划方法用于有目的的欺骗

Longxu Pan, Yue Guan, Daigo Shishika, Panagiotis Tsiotras

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出了一种在贝叶斯博弈框架下研究有目的欺骗的欺骗资源分配博弈(DRAG),通过线性规划方法高效求解完美贝叶斯纳什均衡,实现资源分配与信念操控的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00167 2026-04-29 physics.ins-det 50%

Development and extension of a monochromatic neutron beamline for neutron polarimetry device characterization at the Spallation Neutron Source

中子偏振仪装置表征用单色中子束线的开发与扩展

Kavish Imam, Vince Cianciolo, Brad Filippone, Nadia Fomin, Geoffrey Greene, Chenyang Jiang, Jordan O'Kronley, Seppo Penttila, Josh Pierce, John Ramsey, Isaiah Wallace

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文介绍了在Spallation Neutron Source建设并扩展单色中子束线,用于系统表征中子偏振仪装置,通过三种设备验证了束线的性能和应用价值。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身导航 9 篇

2604.25161 2026-04-29 cs.MA cs.AI 83%

Where Did It Go Wrong? Capability-Oriented Failure Attribution for Vision-and-Language Navigation Agents

哪里出错了?面向视觉-语言导航代理的能力导向故障归因

Jianming Chen, Yawen Wang, Junjie Wang, Xiaofei Xie, Shoubin Li, Qing Wang, Fanjiang Xu

机构 * Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) Science & Technology on Integrated Information System Laboratory(信息集成信息系统实验室) State Key Laboratory of Complex System Modeling and Simulation Technology(复杂系统建模与仿真技术国家重点实验室) University of Chinese Academy of Sciences(中国科学院大学) Singapore Management University(新加坡管理大学)

专题命中 具身导航 :navigation(title,abstract);embodied agent(abstract);分类 cs.AI

AI总结 本文提出一种能力导向的测试方法,通过自适应测试用例生成、能力 oracle 和反馈机制,准确归因视觉-语言导航代理的故障原因,提升系统可解释性和改进效果。

Journal ref ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25541 2026-04-29 eess.SP cs.RO 74%

Bridging the Indoor-Outdoor Gap: Cross-Technology Ranging for Seamless Robot Navigation

弥合室内外差距:跨技术测距以实现无缝机器人导航

Paul Schwarzbach

机构 * Institute of Traffic Telematics, TUD Dresden University of Technology(交通遥感研究所,德累斯顿技术大学)

专题命中 具身导航 :navigation(title);分类 cs.RO

AI总结 本文研究了室内外机器人定位问题,通过融合GNSS、UWB、FTM和BLE等技术实现无缝导航,揭示了不同技术在室内外环境中的互补性及过渡区域的挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05310 2026-04-29 cs.RO 74%

Instantaneous Planning, Control and Safety for Navigation in Unknown Underwater Spaces

未知水下空间导航中的即时规划、控制与安全性

Veejay Karthik, Udit Ekansh, Tejal Bedmutha, Shivam Vishwakarma, Rohan Deshpande, Leena Vachhani

专题命中 具身导航 :navigation(title);分类 cs.RO

AI总结 本文提出一种集成规划与控制框架,利用实时传感器数据动态生成闭环AUV轨迹,提升水下复杂环境中的避障能力和机动性。

Comments Uploaded by mistake. A different version of the study is under process

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25267 2026-04-29 cs.RO cs.AI 66%

Dynamic UGV-UAV Cooperative Path Planning in Uncertain Environments

动态不确定环境中UGV-UAV协同路径规划

Ninh Nguyen, Srinivas Akella

机构 * Department of Computer Science, University of North Carolina at Charlotte(北卡罗来纳大学夏洛特分校计算机科学系)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI;robotics(comments)

AI总结 本文提出动态UGV-UAV协同路径规划方法,通过无人机动态检测道路以提高地面车辆路径安全性与效率,实验表明双向策略在多数情况下表现最佳,多无人机可减少地面车辆行驶时间但增加计算时间。

Comments Accepted to IEEE International Conference on Robotics and Automation (ICRA) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22875 2026-04-29 cs.CV cs.AI 62%

SketchVLM: Vision language models can annotate images to explain thoughts and guide users

SketchVLM:视觉语言模型可以注释图像以解释思路并引导用户

Brandon Collins, Logan Bolton, Hung Huy Nguyen, Mohammad Reza Taesiri, Trung Bui, Anh Totti Nguyen

机构 * Auburn University(阿伯拉罕大学) Adobe Research(Adobe研究)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.CV

AI总结 SketchVLM通过生成可编辑的SVG叠加图提升视觉推理和绘图任务的准确性与注释质量,实现高达28.5%的精度提升和1.48倍的注释质量提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25526 2026-04-29 cs.SE cs.AI 57%

AI as Consumer and Participant: A Co-Design Agenda for MBSE Substrates and Methodology

AI作为消费者和参与者:MBSE子系统与方法论的协同设计议程

Siyuan Ji

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 本文探讨了AI在MBSE模型中的应用问题,指出现有模型未为AI消费设计,提出需协同设计模型与方法论,使其成为可查询的知识子系统,而非仅为人导航的结构化 artifacts。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14248 2026-04-29 cs.AI cs.CL 57%

Why Do LLM-based Web Agents Fail? A Hierarchical Planning Perspective

为什么基于大语言模型的网络代理会失败?一种分层规划视角

Mohamed Aghzal, Gregory J. Stein, Ziyu Yao

机构 * Department of Computer Science, George Mason University(乔治·马歇尔大学计算机科学系)

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 本文从分层规划角度分析了LLM网络代理失败原因,发现低层执行是主要瓶颈,改进感知接地和自适应控制对实现人类可靠性至关重要。

Comments Accepted to The 64th Annual Meeting of the Association for Computational Linguistics (ACL) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25906 2026-04-29 cs.IR 50%

Make Any Collection Navigable: Methods for Constructing and Evaluating Hypergraph of Text

使任意集合可导航:构建和评估文本超图的方法

Dean E. Alvarez, ChengXiang Zhai

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出构建和评估文本超图的方法,引入了努力比率指标,实验表明简单TF-IDF基线在该指标上可与基于LLM的方法相当。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05454 2026-04-29 eess.SY cs.SY 50%

Risk-Aware Aerocapture Guidance Through a Probabilistic Indicator Function

考虑风险的气动捕获引导通过概率指示函数

Grace E. Calkins, Jay W. McMahon, Alireza Doostan, David C. Woffinden

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出一种考虑风险的气动捕获引导算法,利用生成模型基于的概率指示函数估计逃逸、撞击或捕获概率,以提高捕获成功率。

Comments Currently under revision for the AIAA Journal of Guidance Control and Dynamics

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 具身推理 3 篇

2602.11075 2026-04-29 cs.RO 89%

RISE: Self-Improving Robot Policy with Compositional World Model

RISE:具有组合世界模型的自改进机器人策略

Jiazhi Yang, Kunyang Lin, Jinwei Li, Wencong Zhang, Tianwei Lin, Longyan Wu, Zhizhong Su, Hao Zhao, Ya-Qin Zhang, Li Chen, Ping Luo, Xiangyu Yue, Hongyang Li

机构 * The Chinese University of Hong Kong(香港中文大学) Kinetix AI The University of Hong Kong(香港大学) Shanghai Innovation Institute(上海创新研究院) Horizon Robotics Tsinghua University(清华大学)

专题命中 具身推理 :world model(title,abstract);robot policy(title);manipulation(abstract);robotic(abstract)

AI总结 本文提出RISE框架,通过组合世界模型提升机器人策略鲁棒性,在动态砖块排序、背包打包和箱盖闭合任务中分别取得+35%、+45%和+35%的性能提升。

Comments RSS 2026. Project page: https://opendrivelab.com/RISE/

详情

展开后加载摘要…

URL PDF HTML 收藏