arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-08-04 至 2026-08-04 共收录 102 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 2 篇

2608.00725 2026-08-04 cs.RO 新提交 70%

SelfWAM: A Self-Grounded Unified World Action Model for Fast Robot Control

SelfWAM:一种用于快速机器人控制的自 grounded 统一世界动作模型

Bikang Pan, Fan Liu, Haotao Lu, Jingya Wang, Ye Shi

专题命中 机器人学习 :manipulation(abstract);robot policy(abstract);分类 cs.RO

AI总结 SelfWAM是一种基于MoT架构的统一自 grounded WAM,通过联合预测动作等改进机器人控制,在RoboTwin 2.0等实验中提升了策略性能与推理速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01851 2026-08-04 cs.RO cs.AI 新提交 62%

Weights or Skills? A Survey of Robot-Learning Techniques: from Action-Predicting Weights to Robots that Write their Own Skills

权重还是技能?机器人学习技术综述:从动作预测权重到自主编写技能的机器人

Gaytri Jena, Kapil Wanaskar, Vinija Jain, Aman Chadha, Vasu Sharma, Amitava Das

专题命中 机器人学习 :robot learning(abstract);分类 cs.RO、cs.AI

AI总结 本综述围绕机器人学习的“权重vs技能”轴,梳理两类技术的分类、自我提升机制与开放问题,考察77个代表性系统,为机器人学习领域提供分析框架。

Comments 40 pages, 11 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 34 篇

2608.01381 2026-08-04 cs.RO 新提交 88%

DreamTrajectory: Trajectory-Guided Action Generation with World Model Alignment for Mobile Manipulation

DreamTrajectory:面向移动操作的、结合世界模型对齐的轨迹引导动作生成方法

Zheng Yang, Wenjie Zhang, Xiangyu Chen, Wenxuan Song, Xianpeng Wang, Yihang Kang, Wen Chen, Lujia Wang, Renjing Xu, Xiaowen Chu

专题命中 机器人操作 :manipulation(title,abstract);world model(title,abstract);分类 cs.RO

AI总结 DreamTrajectory是面向移动操作的轨迹引导框架,通过联合预测末端执行器轨迹与全身动作块、结合轨迹世界模型的测试时细化,在MS-HAB及真实任务中大幅提升操作成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01083 2026-08-04 cs.RO 新提交 86%

Sparse Meets Dense: Correspondence Guided Robotic Manipulation with Rigid-Deformable Interactions

稀疏与稠密结合:基于对应关系的刚-柔交互机器人操纵方法

Ziyu Zhu, Yue Chen, Xirui Liang, Hojin Bae, Yuran Wang, Zhen Yuan, Ruihai Wu, Hao Dong

机构 * School of Computer Science, PKU(北京大学计算机学院) School of EECS, PKU(北京大学电子工程与计算机科学学院) CFCS(计算与数字科学中心)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title);分类 cs.RO

AI总结 针对刚-柔交互操纵任务,提出混合对应关系表征方法,结合稀疏关键点与稠密对应关系,实现少量演示下的新任务一次性迁移,实验验证其有效性与适用性。

Comments ICRA 2026 conference paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01733 2026-08-04 cs.RO 新提交 85%

TWINS: A Tactile Wearable Isomorphic Arm Networked System for Contact-Rich Manipulation Learning

TWINS:用于接触丰富操作学习的触觉可穿戴同构臂联网系统

Takahide Kitamura, Masaki Murooka, Natsuki Yamanobe, Yukiyasu Domae

机构 * National Institute of Advanced Industrial Science and Technology (AIST)(独立行政法人产业技术综合研究所(AIST))

专题命中 机器人操作 :manipulation(title,abstract);robot learning(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出TWINS触觉可穿戴同构臂联网系统,用于解决现有机器人难以完成身体表面接触操作的问题,通过采集演示数据训练模仿学习策略,实现了身体表面触觉引导的接触丰富操作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01452 2026-08-04 cs.RO cs.CV cs.LG 新提交 82%

DynamicManip: Enabling Dynamic Manipulation from a Single Static Demonstration

DynamicManip:基于单个静态演示实现动态操作

Haoran Liao, Pengyue Wang, Shuoyu Chen, Kehan Cheng, Xuhang Chen, Yuhao Lin, Mu Lin, Zhizhao Liang, Xiaoyi Fan, Chengyi Xing, Dan Niu, Yi-Lin Wei, Wei-Shi Zheng

机构 * Sun Yat-sen University(中山大学) Stanford University(斯坦福大学) Southeast University(东南大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO、cs.CV、cs.LG

AI总结 本文提出DynamicManip,通过静态转动态数据增强流水线、动态感知自适应策略及动态操作基准,解决机器人动态操作的数据效率与实时性问题,实验显示其性能显著优于现有方法。

Comments Project page: https://liaohr9.github.io/DynamicManip/ Code: https://github.com/liaohr9/DynamicManip

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00568 2026-08-04 cs.LG cs.AI 新提交 81%

Fairness Auditing: Lower Bounds on Company Manipulation

公平性审计:公司操纵的下界

Rachit Verma, Padala Manisha, Sujit Gujar

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.AI、cs.LG

AI总结 该研究将公平性审计建模为公司与审计员的极小极大优化,推导了两种审计机制下审计后人口统计 parity 偏差的下界,实证显示增加审计资源无法消除审计后操纵。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01824 2026-08-04 cs.RO 新提交 79%

ReTouch: Empowering Contact-Rich Dexterous Manipulation with Online-Refined Tactile Prediction

ReTouch:利用在线优化的触觉预测实现接触丰富的灵巧操作

Shiqi Zhang, Xin Zhang, Yedong Shen, Jiajun Deng, Yuxuan Gao, Sha Zhang, Yuan Zhang, Kaixue Long, Jiajia Wu, Jia Pan, Yao Li, Yanyong Zhang

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 本研究提出视觉-语言-动作模型ReTouch,通过在线优化触觉预测实现接触丰富的灵巧操作,在真实机器人实验中,其平均成功率较最强基线提升18.4至23.8个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01102 2026-08-04 cs.RO 新提交 79%

CAAT: Contact-Aware Attention Scaling and Tactile Masking for Data-Efficient Contact-Rich Manipulation

CAAT:用于数据高效接触丰富型操作的接触感知注意力缩放与触觉掩码方法

Jiaming Jiang, Yuzhe Huang, Hao Liang, Pei Lin, Shengcheng Luo, Fanrong Dong, Jiaping Wu, Chenxi Xiao, Wanlin Li, Ziyuan Jiao

机构 * ShanghaiTech University(上海科技大学) Beihang University(北京航空航天大学) Beijing Institute for General Artificial Intelligence(北京通用人工智能研究院) Zhejiang University(浙江大学) BUPT(北京邮电大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 该研究针对接触丰富型操作中视觉-触觉策略缺乏接触感知先验的问题,提出CAAT框架,通过注意力缩放和动态触觉掩码提升策略性能,在仿真和真实实验中均显著优于现有方法。

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00208 2026-08-04 cs.RO 新提交 79%

Developing Combined Manipulation and Locomotion Skills with Interaction Representation and Skill Composition

基于交互表征与技能组合开发操作与运动技能

Fanxing Meng, Jing Xiao

机构 * Worcester Polytechnic Institute(伍斯特理工学院)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 本文提出方法使人形机器人基于发育原理学习抓取、起身等策略,通过手-物交互得分组合策略,实现抓取未见过物体零样本成功率93%、持物起身成功率96%-100%。

Comments 8 pages, 5 figures. Submitted to Humanoids 2026. Video available at https://youtu.be/x-7x89fSJWY

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02242 2026-08-04 cs.NI 新提交 71%

When Discovery Becomes a Storm: A ROS 2 Discovery Model for Wireless Robotic Networks

当发现成为风暴:面向无线机器人网络的ROS 2发现模型

Yeonwoo Choi, Sanghoon Lee, Kyung-Joon Park

专题命中 机器人操作 :robotic(title)

AI总结 针对无线机器人网络中ROS 2的发现风暴问题,提出闭环分析模型并验证,设计响应感知策略将平均发现完成时间降低25.3%至39.7%。

Comments 10 pages, 7 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00618 2026-08-04 physics.optics 新提交 71%

Generation and manipulation of multipole and vortex events in (1+1)-dimensional spacetime

(1+1)维时空中多极与涡旋事件的产生与操控

Yiming Pan, Guowei Chen

专题命中 机器人操作 :manipulation(title)

AI总结 该研究在非线性光子时空晶体中,通过能量-动量隙与克尔自陷效应,产生并操控出具有可控内部自由度的多极与涡旋事件,为非线性介质的波操控提供了新途径。

Comments 22 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02197 2026-08-04 cs.RO 新提交 70%

Look Where It Matters: Adaptive Visual Refinement for Vision-Language-Action Models

关注关键区域:面向视觉-语言-动作模型的自适应视觉细化

Jin Cui, Yanbin Hu, Xinyue Long, Linkai Li, Boran Zhao, Pengju Ren

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 针对VLA模型视觉表示不可靠的问题,提出AtVLA框架,结合注意力校正与不确定性门控局部细化,在多基准测试中显著提升机器人操作成功率且计算开销可控。

Comments 13 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00554 2026-08-04 cs.RO cs.AI cs.CV 新提交 67%

DexMani: Human-Derived Manipulability Guidance for Dexterous Rotation

DexMani:用于灵巧旋转的人类衍生可操作度引导

Xiaoyang Chen, Shengcheng Luo, Haoran Guo, Jiaming Jiang, Wanlin Li, Ziyuan Jiao, Chenxi Xiao

专题命中 机器人操作 :robotic(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 DexMani框架通过迁移人类演示的接触条件可操作度演化引导强化学习,在多款机器人手上实现了更高的物体旋转成功率与更平稳的运动,且可跨本体迁移技能。

Comments 16 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01899 2026-08-04 cs.CV cs.CL cs.LG 新提交 62%

SpatioLM: Towards General Physical Spatial Intelligence in Vision-Language Models

SpatioLM:面向视觉-语言模型的通用物理空间智能

Jing Wu, Jianhua Wu, Jiayi Guan, Jiahong Chen, Jinghui Lu, Hangjun Ye, Bingzhao Gao, Long Chen

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV、cs.LG

AI总结 SpatioLM是一种参数高效的视觉-语言模型,通过内置空间视觉模块和伪深度、相机监督提升空间智能,在VSI-Bench获71.6分,还可迁移至具身操纵任务,同时保留通用能力。

Comments 27 pages,13 figures,16 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00931 2026-08-04 cs.RO cs.CV 新提交 62%

Stipple: Real-Time Incremental Gaussian Splatting with Visual-Inertial Tracking

Stipple:基于视觉-惯性跟踪的实时增量高斯溅射技术

Kilian Northoff, Mateo de Mayo, Daniel Cremers

机构 * Technical University of Munich(慕尼黑工业大学) Munich Center for Machine Learning(慕尼黑机器学习中心)

专题命中 机器人操作 :robotics(abstract);分类 cs.RO、cs.CV

AI总结 本文提出Stipple方法,结合Basalt视觉-惯性跟踪系统与Brush增量3D高斯溅射技术,实现实时同步跟踪重建,替代3DGS繁重步骤,为机器人与XR的实时3D重建提供解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00822 2026-08-04 cs.RO 新提交 61%

RIT*: Riemannian Informed Trees for Cost-Adaptive Optimal Motion Planning

RIT*:适用于成本自适应最优运动规划的黎曼知情树

Muhayy Ud Din, Ahmed Nadar, Jan Rosell, Irfan Hussain

机构 * Center for Autonomous Robotic Systems, Khalifa University(哈利法大学自主机器人系统中心) Institute of Industrial and Control Engineering, Universitat Politècnica de Catalunya(加泰罗尼亚理工大学工业与控制工程研究所)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO;robotics(comments)

AI总结 该研究提出RIT*规划框架,以黎曼原语替代批量知情搜索的欧几里得原语,结合CARM优化度量,在高维各向异性运动规划中显著降低成本,性能优于BIT*等基准方法。

Comments Accepted in Robotics and Automation Letters

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02580 2026-08-04 cs.RO 新提交 57%

Ego2Robot: Scalable Robot Data Synthesis from Egocentric Human Data

Ego2Robot:从第一视角人类数据生成可扩展机器人数据

Ye Wang, Pei Lin, Xiong-Hui Chen, Haoqi Yuan, Zhixuan Liang, Yiyang Huang, Anzhe Chen, Zixing Lei, Jie Zhang, Tao Zhang, Haoyang Li, Tong Zhang, Chenxi Xiao, Ziyuan Jiao, Qin Jin

机构 * AIM3 Lab, Renmin University of China(中国人民大学AIM3实验室) Qwen Team, Alibaba Inc.(阿里巴巴通义千问团队) ShanghaiTech University(上海科技大学) Beijing Institute for General Artificial Intelligence (BIGAI)(北京通用人工智能研究院) Beijing University of Aeronautics and Astronautics(北京航空航天大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 Ego2Robot提出将第一视角人类操控视频转换为机器人训练数据的可扩展流水线,生成18561小时机器人数据,扩展RoboTwin2.0验证其联合预训练可提升机器人分布外泛化能力并经真实部署验证

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02545 2026-08-04 cs.RO 新提交 57%

Probabilistic Reachable-Action Verification of Visuomotor Policies via Set-Based Training

基于集合训练的视觉运动策略的概率可达动作验证

Yanliang Huang, Zhuocheng Zhang, Peng Xie, Zhen Zhang, Wenyuan Wu, Majid Khadiv, Zhuoqi Zeng, Amr Alanwar

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 本文针对视觉运动策略可达性分析的高成本与保守性问题,提出冻结视觉编码器、在低维接口做集合传播的集合训练方法,经实验验证该方法可减小概率可达动作半径并保留任务能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01800 2026-08-04 cs.RO cs.SY eess.SY 新提交 57%

Hybrid Impedance-Admittance Control with Multi-Link Aerial Robot for Contact-Rich Surface Sliding Task

多旋翼空中机器人的混合阻抗-导纳控制用于接触丰富的表面滑动任务

Zicheng Luo, Maolin Lei, Jinjie Li, Yicheng Chen, Zicen Xiong, Moju Zhao

机构 * The University of Tokyo(东京大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 该研究针对多旋翼空中机器人,提出混合阻抗-导纳控制策略,利用其铰接形态分离力与运动调节,实现未知表面上稳健柔顺的接触丰富表面滑动任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01558 2026-08-04 cs.AI cs.CR cs.MA 新提交 57%

Securing Agentic AI: From Per-Action Checks to Trajectory Assurance

安全智能体AI:从单步行动检查到轨迹保障

Alireza Lotfi, Subangkar Karmaker Shanto, Imtiaz Karim, Elisa Bertino

机构 * Purdue University(普渡大学) University of Texas at Dallas(德克萨斯大学达拉斯分校)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 该研究围绕自主智能体安全领域,梳理了单智能体、多智能体及宏观层面的各类安全挑战,提出安全需成为智能体架构等的可验证属性,为可信自主智能体部署提供路线图。

Comments 6 pages. Accepted to the ACM AI Leadership Summit 2026 (Visionary Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01046 2026-08-04 cs.CL cs.AI 新提交 57%

DeBERTa-Sentinel: Toward Transparent and Trustworthy Detection of AI-Generated Text

DeBERTa-Sentinel:实现透明且可信的AI生成文本检测

Muhammad Yousaf Rehman, Muhammad Islam

机构 * University of Hertfordshire(赫特福德大学) James Cook University(詹姆斯库克大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 DeBERTa-Sentinel是基于DeBERTa-v3的透明AI生成文本检测框架,在GLC-AIText数据集上实现优异检测性能,可公开token级解释以支持利益相关者审计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00490 2026-08-04 cs.CV 新提交 57%

Image-Space Rule Discovery

图像空间中的规则发现

Misora Sugiyama, Toya Oyama, Hirokatsu Kataoka

机构 * The University of Tokyo(东京大学) National Institute of Advanced Industrial Science and Technology (AIST)(独立行政法人产业技术综合研究所) University of Oxford(牛津大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 本研究提出WISRD基准测试图像编辑模型的图像空间规则发现能力,发现Nano Banana Pro表现最优,当前模型可部分依赖图像内指令,且该模型在4×4数独等任务上有一定性能。

Comments 20 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00486 2026-08-04 cs.CV 新提交 57%

DreamTraj: Generating 6-DoF Object Trajectories by Reading Unrendered Video Diffusion Latents

DreamTraj:通过读取未渲染视频扩散隐变量生成6自由度物体轨迹

Tongsheng Ding, Zhen Luo, Yixuan Yang, Boyu Wang, Luyang Xie, Jinyu Yang, Feng Zheng

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 DreamTraj利用含细粒度指令的MOVE数据集,从单张RGB图像和任务指令读取冻结视频扩散模型中间表示,直接解码6自由度物体轨迹,性能优于传统方法且速度提升4.6倍。

Comments 17 pages, 8 figures, 11 tables. Project page: https://whathappen0.github.io/DreamTraj/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00263 2026-08-04 cs.RO 新提交 57%

Compliant Sphere Lattice Contact: Distributed Contact Modeling for Sphere-Based Robot Representations

柔顺球格接触:基于球的机器人表示的分布式接触建模

Nataliya Nechyporenko, Ava Abderezaei, Alessandro Roncone

专题命中 机器人操作 :robotics(abstract);分类 cs.RO

AI总结 该研究针对基于球的机器人接触模型物理准确性不足的问题,提出CSLC分布式接触模型,通过弹簧连接的柔顺球格实现空间接触区域建模,经验证可提升抓取稳定性。

Journal ref ICRA 2026 Workshop on Contact-Rich Control and Representation

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00206 2026-08-04 cs.RO cs.SY eess.SY 新提交 57%

Motion Planning for Mobile Manipulators Navigating Doorways via Model Predictive Control

基于模型预测控制的移动机械臂 doorway 运动规划

Kasra Sinaei, Kasun Weerakoon, Christopher Bradley, Seyed Abolfazl Fakoorian, Donald Ebeigbe

机构 * The Pennsylvania State University(宾夕法尼亚州立大学) AlphaZ Inc.(AlphaZ公司)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 针对移动机械臂在人类环境中穿越 doorway 的需求,提出基于非线性 MPC 的耦合系统运动规划框架,经仿真与硬件实验验证可生成无碰撞的 door 穿越轨迹。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00150 2026-08-04 cs.CR cs.AI 新提交 57%

Exposed by Design: A Dynamic Security Assessment of Internet-Facing MCP Servers at Scale

设计暴露:面向互联网的MCP服务器的大规模动态安全评估

Nicolás Padilla

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 该研究针对公共互联网上的MCP服务器开展大规模动态安全评估,借助自主框架Corvus发现大量未授权、存在漏洞的服务器,并开源Corvus用于MCP安全评估。

Comments 13 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01938 2026-08-04 cs.CR 新提交 50%

D-MUTRA: DLT-based MUTual Remote Attestation for Multi-Agent Systems

D-MUTRA:面向多智能体系统的基于分布式账本(DLT)的相互远程证明

Adam Zahir, Vincent Lefebvre, Mark Angoustures, Milan Groshev, Carlos J. Bernardos

专题命中 机器人操作 :robotics(abstract)

AI总结 针对多智能体系统传统远程证明的局限,本文提出基于区块链的D-MUTRA框架,实现智能体间的持续相互证明,可检测恶意软件修改,且扩展时开销可忽略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01609 2026-08-04 cs.CR 新提交 50%

From Viral to Void: Multi-Dimensional Behavioral and Contractual Analysis for Rug Pull Identification

从“病毒式”到“虚空”:用于识别“ rug pull”的多维行为与合约分析

Jinyin Song, Hongping Wang, Xiaoqi Li

专题命中 机器人操作 :manipulation(abstract)

AI总结 针对以太坊“rug pull”诈骗检测的缺陷,本文构建多维特征体系,设计结合SMOTE与Focal Loss的MLP模型,开发Flask可视化检测系统,实验指标优于传统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01539 2026-08-04 cs.CR 新提交 50%

SP2UBI: Secure and Privacy-Preserving Usage-Based Insurance

SP2UBI:安全且隐私保护的基于使用量的保险

Mobin Aghamirkarimi, Matin Aghamirkarimi, Farid Zaredar, Morteza Amini

专题命中 机器人操作 :manipulation(abstract)

AI总结 针对UBI系统的数据泄露、传感器异常及隐私与数据完整性难以兼顾的问题,提出基于Torus全同态加密与ISAC速度验证的SP2UBI方案,该轻量级框架可在保护隐私的同时保障数据完整性。

详情

展开后加载摘要…

URL PDF HTML 收藏