arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 8651 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 8651 篇

2606.05669 2026-07-23 cs.RO cs.SY eess.SY 版本更新 79%

Dynamic Multi-Agent Pickup and Delivery in Robotic Cellular Warehousing Systems

机器人化仓储系统中的动态多智能体取送货

Cheng Ren, Ming Li, Xinping Guan, George Q. Huang

机构 * Department of Industrial and Systems Engineering, The Hong Kong Polytechnic University(工业与系统工程系,香港理工大学) School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(自动化与智能感知学院,上海交通大学)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 针对订单内部SKU动态追加的仓库场景,首次形式化动态多智能体取送货问题,提出两种基于令牌传递的事件触发在线重规划算法,显著降低订单流时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12985 2026-07-22 cs.AI 版本更新 79%

SENTINEL: A Multi-Level Formal Framework for Safety Evaluation of Foundation Model-based Embodied Agents

SENTINEL:面向基础模型基于具身代理的安全性评估多级形式框架

Simon Sinong Zhan, Philip Wang, Yao Liu, Yiyan Peng, Zinan Wang, Qineng Wang, Zhian Ruan, Xiangyu Shi, Xinyu Cao, Frank Yang, Zhenyang Ni, Kangrui Wang, Ruohan Zhang, Huajie Shao, Manling Li, Qi Zhu

机构 * Northwestern University, USA University of Southern California, USA College of William \& Mary

专题命中 机器人数据与评测 :embodied agent(title,abstract);分类 cs.AI

AI总结 SENTINEL通过形式时序逻辑多级验证框架,系统性评估基础模型具身代理在模拟环境中的物理安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17767 2026-07-21 cs.RO 新提交 79%

VLN-AVP: Zero-Shot Vision-Language Navigation with Hybrid Long-Short-Term Memory for Autonomous Valet Parking

VLN-AVP:用于自动代客泊车的基于混合长短时记忆的零样本视觉语言导航

Yijian Li, Xiangru Mu, Changze Li, Hantian Shi, Jiyuan Cai, Jia Cai, Xiaoxue Liu, Yajing Sun, Ming Yang, Tong Qin

机构 * Shanghai Jiao Tong University(上海交通大学) Yinwang Intelligent Technology Co., Ltd.(银望智能科技有限公司)

专题命中 机器人数据与评测 :navigation(title,abstract);分类 cs.RO

AI总结 研究针对自主代客泊车依赖预建地图限制可扩展性问题,提出VLN-AVP零样本导航框架,结合BEV模型与VLM,引入混合记忆系统,构建数据集和基准,实验证明该方法在模拟和实际车辆实验中均有良好效果,提升了成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15642 2026-07-20 cs.RO 新提交 79%

Difference-Based Relational Learning for Zero-Shot Object-Goal Visual Navigation With Direct Sim-to-Real Transfer

基于差异的关系学习用于零样本目标视觉导航及直接模拟到现实的迁移

Guolei Qi, Feitian Zhang

专题命中 机器人数据与评测 :navigation(title,abstract);分类 cs.RO

AI总结 针对零样本目标视觉导航中模拟到现实差距的挑战,提出T-DRN,结合基于暹罗差异的特征提取器和双帧时间缓冲区,经实验验证其在AI2-THOR及物理轮式机器人上能提高零样本泛化能力,支持直接模拟到现实迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19464 2026-07-20 cs.RO 版本更新 79%

Can LLMs Prove Robotic Path Planning Optimality? A Benchmark for Research-Level Algorithm Verification

大语言模型能否证明机器人路径规划的最优性?一种用于研究级算法验证的基准测试

Zhengbang Yang, Md. Tasin Tazwar, Minghan Wei, Zhuangdi Zhu

机构 * George Mason University(乔治梅森大学) Florida Atlantic University(佛罗里达大西洋大学)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 本文提出首个评估大语言模型在机器人路径规划算法近似比证明能力的基准测试,包含34个研究级证明任务,揭示了LLM在缺乏领域知识时的局限性,并通过上下文补充分析改进推理质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01060 2026-07-16 cs.RO 版本更新 79%

RoboWorld: Fast and Reliable Neural Simulators for Generalist Robot Policy Evaluation

RoboWorld: 用于通用机器人策略评估的快速可靠神经模拟器

Byeongguk Jeon, Seonghyeon Ye, JaeHyeok Doo, Sungdong Kim, Minjoon Seo, Hyungmok Son, Kimin Lee

机构 * KAIST(韩国科学技术院) Config

专题命中 机器人数据与评测 :robot policy(title);world model(abstract);分类 cs.RO

AI总结 提出RoboWorld自动化评估流程,结合快速自回归视频世界模型和任务进度感知视觉语言模型评分,通过Step Forcing减少训练-测试不匹配,实现与真实世界评估高度一致。

Comments Project page: https://byeongguks.github.io/RoboWorld/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07403 2026-07-09 cs.MA cs.RO 新提交 79%

Multi-Agent Robotic Control with Onboard Vision-Language Models

基于机载视觉语言模型的多智能体机器人控制

Kajetan Rachwał, Maciej Majek, Bartłomiej Boczek, Jakub Matejczyk, Dominik Matejkowski, Adam Dąbrowski, Tim Seyde, Alexander Amini, Maria Ganzha

机构 * Faculty of Mathematics and Information Science, Warsaw University of Technology(华沙技术大学数学与信息科学学院)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 研究针对视觉语言模型用于机器人控制的挑战,提出多智能体系统架构,在机载硬件部署智能体,用紧凑型VLMs并经微调及新型编排智能体,经硬件在环模拟验证,证明该机载架构可行高效,有实际应用潜力且模拟环境已开源。

Comments 6 pages, 2 figures, accepted to 24th International Conference on Practical applications of Agents and Multi-Agent Systems (PAAMS'26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06445 2026-07-09 cs.CV 版本更新 79%

What if? Emulative Simulation with World Models for Situated Reasoning

如果呢?基于世界模型的仿真模拟用于情境推理

Ruiping Liu, Yufan Chen, Yuheng Zhang, Junwei Zheng, Kunyu Peng, Chengzhi Wu, Chenguang Huang, Di Wen, Jiaming Zhang, Kailun Yang, Rainer Stiefelhagen

机构 * Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) Hunan University(湖南大学) ETH Zürich(苏黎世联邦理工学院) INSAIT, Sofia University ``St. Kliment Ohridski''(INSAIT,索菲亚大学『圣克莱门特·奥赫里迪斯』) RAI Institute(RAI研究所)

专题命中 机器人数据与评测 :world model(title,abstract);分类 cs.CV

AI总结 提出WanderDream数据集,利用世界模型进行心理探索的仿真模拟,使代理无需主动探索即可回答空间假设问题,实验证明心理探索对情境推理至关重要。

Comments Accepted at ECCV 2026. The data and code are available at: https://github.com/RuipingL/WanderDream

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02474 2026-07-03 cs.RO cs.SY eess.SY 新提交 79%

QuadRocket: An Aerial Robotic Testbed for Adaptive Thrust-Vector Control of Rocket-Like Vehicles

QuadRocket:用于火箭类飞行器自适应推力矢量控制的空中机器人试验台

Pedro Santos, Joel Reis, Paulo Oliveira, Carlos Silvestre

机构 * ISR, Instituto Superior Técnico, Universidade de Lisboa(里斯本大学高等技术学院ISR) LAETA LARSyS

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 提出QuadRocket四旋翼火箭原型,通过自适应反步控制器实现未知扰动下的轨迹跟踪,并验证其作为推力矢量控制试验台的适用性。

Comments Paper accepted for publication in IEEE Transactions on Aerospace and Electronic Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27313 2026-07-03 cs.RO 版本更新 79%

MetaTune: Adjoint-based Meta-tuning via Robotic Differentiable Dynamics

MetaTune: 通过机器人可微动力学进行基于共轭的元调优

Xiexin Peng, Bingheng Wang, Tao Zhang, Que Dong, Ying Zheng

机构 * School of Artificial Intelligence and Automation, Huazhong University of Science and Technology(华中科技大学人工智能与自动化学院) School of Electrical and Computer Engineering, National University of Singapore(新加坡国立大学电气与计算机工程系) The Shenzhen Huazhong University of Science and Technology Research Institute(华中科技大学深圳研究院)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 本文提出MetaTune框架,通过可微闭环元学习实现反馈控制器与扰动观测器的联合自调优,减少计算复杂度并提升鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20857 2026-07-02 cs.RO 版本更新 79%

Multi-Embodiment Robotic Retargeting via Guided Diffusion Model

基于引导扩散模型的多体机器人重定向

Zhefeng Cao, Ben Liu, Shunpeng Yang, Sen Li, Wei Zhang, Hua Chen

机构 * Southern University of Science and Technology(南方科技大学) The Hong Kong University of Science and Technology(香港科技大学) Zhejiang University-University of Illinois Urbana-Champaign Institute(浙江大学伊利诺伊大学厄巴纳-香槟校区联合学院) LimX Dynamics

专题命中 机器人数据与评测 :robotic(title);robotics(abstract);分类 cs.RO

AI总结 提出统一图条件扩散框架,利用图结构编码不同机器人拓扑几何特征,通过基于能量的引导损失训练,实现跨异构体的运动重定向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29303 2026-07-01 cs.CV 版本更新 79%

Occlusion-Robust Multi-Object Decoupling for Physics-Based Robotic Interaction

基于物理的机器人交互的遮挡鲁棒多对象解耦

Xin Dong, Lihan Zhang, Tianru Dai, Wenfeng Deng, Yansong Tang

机构 * Pengcheng Laboratory(鹏城实验室) Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.CV

AI总结 提出一种无掩码方法,从稀疏遮挡视角实现无损多对象3D重建,通过MPM模拟实现物理合理的机器人交互,核心是利用联合SDS过程结合扩散先验实现对象解耦。

Comments 7 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27406 2026-06-29 cs.SE cs.AI 新提交 79%

Towards Evaluation of Implicit Software World Models in Coding LLMs

面向编码大语言模型中隐式软件世界模型的评估

Egor Bogomolov, Yaroslav Zharov

机构 * JetBrains Research(JetBrains研究)

专题命中 机器人数据与评测 :world model(title,abstract);分类 cs.AI

AI总结 本文通过预测执行资源(峰值内存、墙钟时间、分析器输出)扩展软件世界模型评估,发现前沿模型表现有限,表明对软件执行理解不足。

Comments Accepted to DL4Code workshop at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03939 2026-06-26 cs.RO 79%

Deep Learning-Enhanced Robotic Subretinal Injection with Real-Time Retinal Motion Compensation

深度学习增强的机器人视网膜注射与实时视网膜运动补偿

Tianle Wu, Mojtaba Esfandiari, Peiyao Zhang, Russell H. Taylor, Peter Gehlbach, Iulian Iordachita

机构 * Laboratory for Computational Sensing and Robotics(计算感知与机器人实验室) Johns Hopkins University(约翰霍普金斯大学) Wilmer Eye Institute(威尔默眼科研究所)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 本文提出了一种全自动机器人视网膜注射系统,结合术中光学相干断层扫描和深度学习运动预测,实现针头运动与视网膜位移同步,实验验证了其在视网膜微手术中的安全性和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24256 2026-06-24 cs.CV 新提交 79%

Trimming the Long-Tail of Visual World Modeling Evaluation

修剪视觉世界建模评估的长尾

Bingxuan Li, Yining Hong, Cheng Qian, Hyeonjeong Ha, Jiateng Liu, Zhenhailong Wang, Yue Guo, Yunzhu Li, Heng Ji

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Stanford University(斯坦福大学) Columbia University(哥伦比亚大学)

专题命中 机器人数据与评测 :world model(title,abstract);分类 cs.CV

AI总结 针对视觉世界模型在罕见物理交互上泛化不足的问题,提出Tailor-Bench基准,通过常规、非常规和不可能三种场景模式系统评估模型推理能力,揭示长尾性能差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03374 2026-06-23 cs.RO 版本更新 79%

eMEM: A Hybrid Spatio-Temporal Memory System For Embodied Agents

eMEM:一种面向具身智能体的混合时空记忆系统

A. Haroon Rasheed, Maria Kabtoul

专题命中 机器人数据与评测 :embodied agent(title,abstract);分类 cs.RO

AI总结 提出eMEM混合图记忆系统,通过多索引架构和分层整合管道实现具身智能体在空间、时间和语义上的高效记忆检索,并在ProcTHOR-10K基准测试中达到80.8加权平均分。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18847 2026-06-18 cs.AI 新提交 79%

WorldLines: Benchmarking and Modeling Long-Horizon Stateful Embodied Agents

WorldLines: 对长时域有状态具身智能体进行基准测试与建模

Yehang Zhang, Jianchong Su, Haojian Huang, Yifan Chang, Tianhao Zhou, Xinli Xu, Yingjie Xu, Yinchuan Li, Zexi Li, Ying-Cong Chen

机构 * HKUST(GZ)(香港科技大学(广州)) HKUST(香港科技大学) Knowin

专题命中 机器人数据与评测 :embodied agent(title,abstract);分类 cs.AI

AI总结 提出WorldLines基准,通过构建带时间跨度的家庭轨迹(含对话、动作、状态变化等)评估具身智能体的长时记忆与任务规划能力,并设计ObsMem记忆框架提升状态感知决策。

Comments 27 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18628 2026-06-18 cs.RO 新提交 79%

Self-Supervised Mask-Aware Transformers for Fault-Tolerant FBG Force Sensing in Minimally Invasive Surgical Robotics

自监督掩码感知Transformer用于微创手术机器人中容错FBG力传感

Peibo Sun, Shiyuan Dong, Shucheng Ye, Jianrong Cai, Yushan Liu, Hongen Liao, Tianqi Huang, Fang Chen

机构 * Shanghai Jiao Tong University(上海交通大学) Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

专题命中 机器人数据与评测 :robotics(title,abstract);分类 cs.RO

AI总结 针对微创手术机器人中FBG传感器因通道耦合和断裂导致的力估计退化问题,提出统一的自监督掩码感知Transformer,通过掩码通道重建预训练和动态损坏课程微调,实现多通道故障下的优雅降级,在8通道数据集上达到0.0066 N均方根误差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.06348 2026-06-18 cs.HC cs.RO 版本更新 79%

Why Automate This? Exploring Correlations Between Desire for Robotic Automation, Invested Time and Well-Being

为什么自动化这个?探索机器人自动化愿望、投入时间与幸福感之间的相关性

Ruchira Ray, Leona Pang, Sanjana Srivastava, Li Fei-Fei, Samantha Shorey, Roberto Martín-Martín

机构 * University of Texas at Austin(德克萨斯大学奥斯汀分校) Stanford University(斯坦福大学) University of Pittsburgh(匹兹堡大学)

专题命中 机器人数据与评测 :robotic(title);robotics(abstract);分类 cs.RO

AI总结 本研究利用BEHAVIOR-1K等数据集,发现活动时间并非自动化偏好的强预测因子,而幸福感和痛苦感是最强指标,并揭示了性别和收入水平的差异。

Comments 26 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18097 2026-06-17 cs.RO 新提交 79%

WireCraft: A Simulation Benchmark for Industrial DLO Manipulation

WireCraft:工业DLO操作仿真基准

Chongyu Zhu, Ramy ElMallah, Hyegang Kim, Zachary Tang, Jiachen Rao, Artem Arutyunov, Seungyeon Ha, Chi-Guhn Lee

机构 * Department of Mechanical and Industrial Engineering, University of Toronto(多伦多大学机械与工业工程系) Department of Computer Science, University of Toronto(多伦多大学计算机科学系) CREFLE Inc.(CREFLE公司)

专题命中 机器人数据与评测 :manipulation(title,abstract);分类 cs.RO

AI总结 针对工业中可变形线性物体(DLO)操作缺乏统一基准的问题,提出WireCraft仿真基准,支持可配置难度和资产,涵盖三种任务族,并评估强化学习、模仿学习和视觉-语言-动作策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19098 2026-06-17 cs.RO 版本更新 79%

SimTO: A two-stage, simulation-driven topology optimization framework for bespoke soft robotic grippers

SimTO:一种面向定制软体机器人夹爪的两阶段仿真驱动拓扑优化框架

Kurt Enkera, Josh Pinskier, Marcus Gallagher, David Howard

机构 * CSIRO Robotics(CSIRO机器人研究所) School of Electrical Engineering and Computer Science(电气工程与计算机科学学院)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 提出SimTO框架,通过两阶段仿真驱动拓扑优化自动提取接触载荷,为特征丰富物体定制软体夹爪,实验证明其抓取力优于传统方法且泛化性强。

Comments 15 pages, 9 figures. Published in Structural and Multidisciplinary Optimization

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16953 2026-06-16 cs.RO 新提交 79%

SidewalkBench: Benchmarking Visual Navigation on Urban Sidewalks

SidewalkBench: 城市人行道视觉导航基准

Zhizheng Liu, Honglin He, Vivek Alumootil, Akshat Pandya, Brad Squicciarini, Wayne Wu, Bolei Zhou

机构 * University of California, Los Angeles(加利福尼亚大学洛杉矶分校) Coco Robotics

专题命中 机器人数据与评测 :navigation(title,abstract);分类 cs.RO

AI总结 针对城市人行道视觉导航缺乏统一基准的问题,提出SidewalkBench,基于NVIDIA Isaac Sim构建高保真仿真环境,评估9种模型,发现行人交互和长距离鲁棒性是关键瓶颈。

Comments Project Page: https://vail-ucla.github.io/SidewalkBench/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15469 2026-06-16 cs.RO 新提交 79%

Learning Context-Aware Neural ODE Dynamics for Adaptive Robotic Control

学习上下文感知的神经ODE动力学用于自适应机器人控制

Shao-Yi Yu, Jen-Wei Wang, Maya Horii, Masayoshi Tomizuka, Vikas Garg

机构 * University of California, Berkeley(加州大学伯克利分校) Aalto University(阿尔托大学) YaiYai Ltd(YaiYai有限公司)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 提出基于神经ODE的上下文感知动力学模型,通过两阶段训练从状态-动作历史推断环境因素,实现模型预测控制下的自适应,在四旋翼、Sphero BOLT和Fanuc机械臂上验证了时空变化环境下的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11381 2026-06-16 cs.CV 新提交 79%

From Simulation to the Real-World: An In-Field 6D Pose Dataset and Baseline for Robotic Strawberry Harvesting

从仿真到现实:面向机器人草莓采摘的实地6D位姿数据集与基线

Woojung Son, Won Suk Lee, Zijing Huang, Daeun Choi, Catia Silva, Yu She, Yan Gu

机构 * Department of Agricultural and Biological Engineering, University of Florida(佛罗里达大学农业与生物工程系) Department of Electrical and Computer Engineering, University of Florida(佛罗里达大学电气与计算机工程系) Edwardson School of Industrial Engineering, Purdue University(普渡大学爱德华森工业工程学院) School of Mechanical Engineering, Purdue University(普渡大学机械工程学院)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.CV

AI总结 针对机器人草莓采摘中6D位姿估计的仿真到现实差距问题,首次构建了实地草莓6D位姿真值数据集(12,040张图像),并基于NVIDIA Isaac Sim生成具有场景级真实感的合成数据集,通过基线实验量化了差距。

Comments 7 pages, 6 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14058 2026-06-15 cs.RO 新提交 79%

ReactSim-Bench: Benchmarking Reactive Behavior World Model Simulation in Autonomous Driving

ReactSim-Bench:自动驾驶中反应性行为世界模型模拟的基准测试

Zhiyuan Zhang, Yanlun Peng, Jianing Zhang, Xianda Guo, Zehan Huang, Haoran Liu, Qifeng Li, Shaofeng Zhang, Xiaosong Jia, Junchi Yan

机构 * School of Computer Science & School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学计算机科学与技术学院、人工智能学院) Great Wall Motor(长城汽车) Institute of Trustworthy Embodied AI (TEAI), Fudan University(复旦大学可信具身人工智能研究所) School of Computer Science, Wuhan University(武汉大学计算机学院) University of Science and Technology of China(中国科学技术大学)

专题命中 机器人数据与评测 :world model(title,abstract);分类 cs.RO

AI总结 提出ReactSim-Bench,通过解耦自车与周围智能体控制,使用偏离日志的自车行为作为输入,评估行为世界模型模拟的反应性能力,并基于碰撞、地图和运动学指标系统评测多种模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12042 2026-06-11 cs.RO 新提交 79%

KinematicRL: A Sim-to-Real Reinforcement Learning Framework For Social Navigation With Kinodynamic Feasibility

KinematicRL: 一种面向社交导航的具有运动学可行性的仿真到现实强化学习框架

Zhiming Xu, Haodong Yang, Chengju Liu, Qijun Chen, Chenpeng Yao

机构 * School of Computer Science and Technology, Tongji University(同济大学计算机科学与技术学院) Department of Electronics and Information Engineering, Tongji University(同济大学电子与信息工程学院) Shanghai Institute of Intelligent Science and Technology, Tongji University(同济大学上海智能科学与技术研究院)

专题命中 机器人数据与评测 :navigation(title,abstract);分类 cs.RO

AI总结 提出KinematicRL框架,通过二阶控制动作空间、基于2D LiDAR的聚类人体追踪和无偏残差门控模块,解决社交导航中仿真到现实的动态可行性问题。

Comments Accepted by IEEE Transactions on Automation Science and Engineering (T-ASE)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07833 2026-06-11 cs.RO 版本更新 79%

Harnessing Embodied Agents: Runtime Governance for Policy-Constrained Execution

利用具身体 agent:运行时治理以实现政策约束执行

Xue Qin, Simin Luan, John See, Zeyd Boukhers, Cong Yang, Zhijun Li

机构 * School of Software, Harbin Institute of Technology(哈尔滨工业大学软件学院) School of Computer Science and Technology, Harbin Institute of Technology(哈尔滨工业大学计算机科学与技术学院) School of Mathematical and Computer Sciences, Heriot-Watt University, Malaysia Campus(赫瑞-沃德大学马来西亚校区数学与计算机科学学院) School of Future Science and Engineering, Soochow University(苏州大学未来科学与工程学院) Fraunhofer Institute for Applied Information Technology(弗劳恩霍夫应用信息技术研究所)

专题命中 机器人数据与评测 :embodied agent(title,abstract);分类 cs.RO

AI总结 本文提出了一种政策约束执行框架,通过将 agent 认知与执行监督分离,增强了具身体 agent 的运行时治理能力,通过 1000 次随机模拟验证,显著提高了对未经授权动作的拦截率和系统恢复成功率。

Comments 36 pages, 3 figures, 10 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18765 2026-06-10 cs.RO 版本更新 79%

Goal-oriented Communication for Fast and Robust Robotic Fault Detection and Recovery

面向快速鲁棒机器人故障检测与恢复的目标导向通信

Shutong Chen, Adnan Aijaz, Yansha Deng

机构 * Department of Engineering, King’s College London(伦敦国王学院工程系) Bristol Research and Innovation Laboratory, Toshiba Europe Ltd.(托bsd欧洲有限公司布里斯托尔研究与创新实验室)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 提出目标导向通信框架,通过联合设计通信-计算-控制回路,利用3D场景图检测故障,并微调小语言模型结合知识蒸馏生成恢复动作,实现故障检测与恢复时间降低82.6%,任务成功率提升76%。

Comments Submit to IEEE for potential publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08548 2026-06-09 cs.RO 新提交 79%

OASIS: From Simulation Data Collection to Real-World Humanoid Loco-Manipulation

OASIS:从仿真数据收集到真实世界人形机器人移动操作

Zehao Yu, Jiakun Zheng, Weiji Xie, Jiyuan Shi, Chenyun Zhang, Chenjia Bai, Xuelong Li

机构 * Institute of Artificial Intelligence (TeleAI), China Telecom(中国电信人工智能研究院(TeleAI)) Fudan University(复旦大学) East China University of Science and Technology(华东理工大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 机器人数据与评测 :manipulation(title,abstract);分类 cs.RO

AI总结 提出OASIS框架,利用3D生成模型从真实图像重建物体资产,在仿真中收集并增强轨迹数据,训练层次化视觉运动策略,实现零样本部署下人形机器人移动操作,成功率优于真实遥操作数据。

Comments Project Page: https://oasis-humanoid.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04545 2026-06-04 cs.CV 79%

Impostor: An Agent-Curated Benchmark for Realistic AIGC Manipulation Localization

Impostor:一个用于真实AIGC篡改定位的智能体策划基准

Zhenliang Li, Yutao Hu, Qixiong Wang, Wenpeng Du, Hongxiang Jiang, Jiasong Wu, Xiaolong Jiang, Jungong Han

机构 * Southeast University(东南大学) Xiaohongshu Inc.(小红书公司) Tsinghua University(清华大学)

专题命中 机器人数据与评测 :manipulation(title,abstract);分类 cs.CV

AI总结 为解决现有图像篡改检测与定位基准在视觉真实感、篡改多样性和生成器覆盖方面的局限,提出了Impostor数据集和CraftAgent框架,并设计了PhaseAware-Net方法,在多个基准上取得优异性能。

Comments 10 pages, 3 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏