arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-08-17 至 2026-08-17 共收录 33 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 9 篇

2608.14049 2026-08-17 cs.RO 新提交 88%

FlatLab: A Unified Methodology Framework and Simulation-Based Benchmark for Robotic Manipulation of Flat Objects

FlatLab:面向扁平物体机器人操作的统一方法论框架及基于仿真的基准测试

Xingyu Zhu, Wenshuo Han, Zhouyu Wang, Yuran Wang, Ruihai Wu, Hao Dong, Fan Tang, Hechang Chen, Hyung Jin Chang, Yixing Gao

机构 * Jilin University(吉林大学) Peking University(北京大学) Chinese Academy of Sciences(中国科学院) University of Birmingham(伯明翰大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 该研究针对扁平物体机器人操作泛化能力有限的问题,提出含策略生成器与执行模块的统一框架,并构建FlatLab仿真基准,方法泛化效果优于现有基线。

Comments This paper is accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14379 2026-08-17 cs.RO cs.AI 新提交 84%

Reflex: Enabling Fast and Predictive Vision-Language-Action Models for Reaction-Critical Manipulation

Reflex:面向反应关键型操作的快速且可预测的视觉-语言-动作模型

Yuxuan Chen, Wanruo Zhang, Xiao Li

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 针对现有VLA模型忽略动态交互场景的问题,提出面向反应关键型操作的ReflexBench基准与无需大规模机器人数据预训练的ReflexVLA模型,其可提升动态操作性能并保持静态操作精度。

Comments 8 pages, 6 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13904 2026-08-17 cs.RO 新提交 83%

Communication in modular robotic motor control: Bilateral controllers under realistic constraints

模块化机器人电机控制中的通信:现实约束下的双边控制器

Jingwen Li, Levin Kuhlmann, Jason Friedman, Gideon Kowadlo

机构 * Monash University(莫纳什大学) Tel Aviv University(特拉维夫大学) Cerenaut(瑟雷诺特公司)

专题命中 机器人操作 :robotic(title,abstract);robotics(abstract);分类 cs.RO

AI总结 该研究提出受大脑双侧结构启发的模块化GRU双边控制器,在双臂肌肉骨骼仿真任务中,其性能优于整体架构及无通信的模块化控制器,证明模块间通信可优化机器人运动的精度、成本与稳定性。

Comments 15 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14028 2026-08-17 cs.RO cs.AI 新提交 81%

AdvDex: Learning Dexterous Manipulation from Human Demonstrations via Joint-Aligned Actions and Adversarial Learning

AdvDex:通过关节对齐动作与对抗学习从人类演示中学习灵巧操作

Zhiyue Zhao, Jingyi Wu, Hairuo Liu, Mingyu Liu, Liyang Li, Hengdi Zhang, Tong He, Zhengxue Cheng

机构 * Zhejiang University(浙江大学) Shanghai Innovation Institute(上海创新研究院) Fudan University(复旦大学) Shanghai Jiao Tong University(上海交通大学) Paxini Tech(帕西尼科技)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO、cs.AI

AI总结 AdvDex是一种统一视觉-语言-动作框架,通过OmniShare数据集、JAAS动作空间与领域对抗学习,实现从人类和机器人演示中学习灵巧操作,提升跨实体泛化与技能迁移能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14244 2026-08-17 cs.RO eess.SY 新提交 79%

Vibration Suppression in Collaborative Flexible Payload Manipulation Using Passive Force Control

基于被动力控制的协作式柔性负载操作中的振动抑制

Alaa Abderrahim, Antonio Rosales, Ferdinando Milella, Markku Suomalainen, Shuai Li

机构 * VTT Technical Research Centre of Finland Ltd(芬兰VTT技术研究中心) RP Technical University of Kaiserslautern(凯泽斯劳滕RP工业大学) UK Atomic Energy Authority(英国原子能管理局) University of Oulu(奥卢大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 本文针对大型重型结构操作中的振动问题,提出基于主从异构工业机械臂协作的被动力控制策略,通过导纳控制器与等效质量-弹簧-阻尼模型实现振动抑制,经模拟与实验验证了方法的有效性。

Comments Published in the proceedings of the 2026 European Control Conference (ECC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14462 2026-08-17 cs.RO 新提交 70%

THRIVE: Therapeutic Humanoid Robot In Virtual Environment

THRIVE:虚拟环境中的治疗性人形机器人

Jin Xu, Yu-Ping Chen, Ayanna Howard

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出了家用康复平台THRIVE,集成VR上肢康复游戏、摄像头运动追踪与机器人治疗师,采用模块化设计,为上肢运动障碍儿童提供持续且具吸引力的上肢治疗。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13765 2026-08-17 eess.SP 新提交 50%

Energy Efficient Multi-User Beamforming and 3D Position Optimization for SIM-Assisted UAVs

面向智能超表面(SIM)辅助无人机的节能多用户波束成形与三维位置优化

Chandan Kumar Sheemar, Giovanni Iacovelli, Sourabh Solanki, Wali Ullah Khan, George C. Alexandropoulos, Symeon Chatzinotas

专题命中 机器人操作 :manipulation(abstract)

AI总结 针对配备堆叠智能超表面的节能无人机多用户通信,提出联合优化数字预编码、SIM相移与无人机三维位置的算法,大幅提升能效并揭示关键设计权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13984 2026-08-17 physics.optics 新提交 50%

Multi-quantum-channel mediated tunable single-photon skyrmions from metasurfaces

超构表面介导的多量子通道可调谐单光子斯格明子

Yan Wang, Zhenyu Guo, Minggui Liang, Shuangchun Wen, Yijie Shen, Hailu Luo

专题命中 机器人操作 :manipulation(abstract)

AI总结 该研究利用超构表面实现偏振纠缠光子对的多通道量子态分布,通过多通道量子测量介导生成可调谐单光子斯格明子,为抗噪高维量子信息处理提供了可行路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13761 2026-08-17 cond-mat.soft 新提交 50%

From suspensions to porous multilayers: microstructure formation and particle packing in drying colloidal films

从悬浮液到多孔多层膜:胶体薄膜干燥过程中的微结构形成与颗粒堆积

Qingguang Xie, Jens Harting

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究通过数值模拟结合理论模型,揭示胶体薄膜干燥时颗粒间相互作用决定最终多孔结构,为定制功能层提供指导。

Comments 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身导航 8 篇

2608.13923 2026-08-17 cs.CV cs.RO 新提交 81%

OpenBelief-Nav: Evidence-Preserving Object Memory for Open-Vocabulary Language-Guided Navigation

OpenBelief-Nav:面向开放词汇语言引导导航的证据保留型对象记忆

Dinh Tuan Nguyen, Anh Dao, Phuong Nam Dang, Quan-Dung Pham, Tuyen P. Le, Truong Nguyen, Quan Nguyen

机构 * VinMotion, Inc.(VinMotion公司) University of Southern California(南加利福尼亚大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 该研究针对开放词汇语言引导导航的对象记忆缺陷,提出OpenBelief-Nav模型,保留多源证据并支持灵活读出,在多数据集导航任务中优于基线方法,修正策略可提升目标确认成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14466 2026-08-17 cs.RO cs.IT cs.LG 新提交 81%

Expected Free Energy-based Informative Path Planning for Robotic Mars Exploration

基于期望自由能的火星探测机器人信息路径规划

Ajith Anil Meera, Pablo Lanillos, Wouter Kouw

机构 * TU Eindhoven(埃因霍温理工大学) Cajal Centre for Neuroscience, Spanish National Research Council(西班牙国家研究委员会卡哈尔神经科学中心)

专题命中 具身导航 :robotic(title,abstract);分类 cs.RO、cs.LG

AI总结 该研究提出将主动推理的期望自由能作为统一准则,用于预算约束下的机器人信息路径规划,其规划方法在火星探测场景中可同时实现精准地图构建与高价值区域定位,性能优于信息论基准方法。

Comments accepted for IWAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13723 2026-08-17 cs.RO 新提交 80%

Graph-MambaNav: Spatial-Temporal Graph Mamba Leveraging Object-Relation Knowledge for Object-Goal Navigation

Graph-MambaNav:利用对象关系知识的时空图Mamba用于目标对象导航

Leyuan Sun, Genxin Chen, Linwei Ye, Yan Zhang, Xi Kan, Yanfei Sun

机构 * School of Internet of Things Engineering, Wuxi University(无锡大学物联网工程学院) School of Communications and Information Engineering, Nanjing University of Posts and Telecommunications(南京邮电大学通信与信息工程学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO;robotics(comments)

AI总结 本研究提出Graph-MambaNav,一种结合LLM常识对象关系的目标感知时空图编码框架,通过节点排序与Mamba建模实现高效导航,在仿真环境表现优异且泛化性好,经真实机器人部署验证有效。

Comments Accepted by IEEE Robotics and Automation Letters (IEEE RA-L), will transfer to 2027 IEEE International Conference on Robotics & Automation (ICRA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14531 2026-08-17 cs.RO eess.SY 新提交 79%

Spatiotemporal Tube-Based Safety-Certificate for Autonomous Navigation of Articulated Vehicles

铰接式车辆自主导航的基于时空管的安全证书

Mohd. Faizuddin Faruqui, Ratnangshu Das, Ravi Kumar L, Pushpak Jagtap

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 针对铰接式车辆自主导航的狭窄路线机动挑战,提出基于时空管的规划方法,确保挂车处于道路走廊内,经仿真验证可提供路线安全证书。

Comments Accepted for presentation at the 2026 IEEE International Conference on Intelligent Transportation Systems (ITSC 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14160 2026-08-17 cs.RO 新提交 79%

OccPlanner: Goal-Aware Occupancy-Conditioned Diffusion Planner for Pixel-Goal Navigation

OccPlanner:面向像素目标导航的目标感知占用条件扩散规划器

Binling Huang, Nianjin Ye, Xi Yang, Liang Hu, Zhou Huang, Shuang Wei, Longrui Yang, Yanchi Chen, Lanpeng Jia

机构 * Changhong Intelligent Robot(长虹智能机器人) University of Electronic Science and Technology of China(电子科技大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 该研究针对像素目标导航的3D目标定位与无碰撞规划难题,提出OccPlanner模型,引入L3ROcc生成监督,在仿真中大幅提升导航成功率,还验证了其仿真到真实的迁移适配性。

Comments Technical report. 11 pages, 6 figures, and 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13611 2026-08-17 cs.IT 新提交 78%

SN-ASMO: Satellite-Navigation Array Spatial-Manifold Precise Observation Theory A Mathematical Foundation for Observation Formation, Unified U(1) Geometry, Intrinsic Information, and Preservation of the RTK Integer Structure

SN-ASMO:卫星导航阵列空间流形精确观测理论——观测形成、统一U(1)几何、本征信息及RTK整数结构保留的数学基础

Xianwei Meng

专题命中 具身导航 :navigation(title,abstract)

AI总结 SN-ASMO理论针对卫星导航的根本问题,构建了统一观测形成等多要素且可物理验证的数学框架,解决了抗干扰、高动态场景下RTK整数结构保留等关键问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13589 2026-08-17 cs.HC cs.AI 新提交 70%

Context Aware AI Assistant and AR Interface for Lunar Extravehicular Activity (EVA) Procedural Guidance

面向月球舱外活动(EVA)程序指导的上下文感知AI助手与AR界面

Rodrigo Gallardo, Qilmeg Doudatcz, Ganit Goldstein, Ilkyaz Sarimehmetoglu, Sergio Mutis, Alexander Htet Kyaw, Anita Lin, Clara Emmerling, Berfin Ataman, Skylar Tibbits

专题命中 具身导航 :navigation(abstract,abstract_cn);分类 cs.AI

AI总结 针对月球EVA中宇航员注意力分散导致的信息适配难题,提出GAIN-AI系统,通过两层架构结合大语言模型与AR界面,在111个合成EVA场景中取得良好表现。

Comments 4 pages, 4 figures, 1 table. Accepted to ACM SIGGRAPH 2026 Conference Posters, July 19-23, 2026, Los Angeles, California, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13921 2026-08-17 cs.AI 新提交 57%

When Personal Memory Has No Single Answer: Evaluating LLM Agents under Irreducible Conflict

当个人记忆没有唯一答案时:评估大语言模型智能体在不可约冲突下的表现

Lu Yang, Shusheng Xu, Zhuoran Li, Tongkai Yang, Longbo Huang

机构 * Ant Group(蚂蚁集团)

专题命中 具身导航 :navigation(abstract_cn);分类 cs.AI

AI总结 该研究针对大语言模型智能体的记忆冲突问题,提出了基准TANGLE并评估其表现,发现现有方法存在缺陷,进而提出冲突感知行动策略CAAP。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身推理 6 篇

2608.13678 2026-08-17 cs.RO cs.LG 新提交 86%

hint$^2$: Hierarchical World Models for Inference-Time Temporal Logic Guidance

hint$^2$:用于推理时态逻辑引导的分层世界模型

Moritz Zoellner, Anastasios Manganaris, Ahmed H. Qureshi, Rohan Paleja

机构 * Purdue University(普渡大学)

专题命中 具身推理 :world model(title,abstract);robot learning(abstract);manipulation(abstract);分类 cs.RO、cs.LG

AI总结 本文提出hint$^2$,一种用分层世界模型引导策略满足LTL规范的方法,在CALVIN基准及真实UR5e机械臂实验中,其性能优于现有推理引导方法。

Comments Videos available on our project page: this https URL (https://anonymous-hint2.github.io/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14022 2026-08-17 cs.CV cs.AI 新提交 81%

ForgeWM: Progressive Causal Training for Few-Step Action-Conditioned Video World Models

ForgeWM:面向少步骤动作条件视频世界模型的渐进式因果训练

Xinye Li, Lingshuai Lin, Lei Wang, Liuzhou Zhang, Jialin Cui, Qingshan Li, Guanchu Wang, Qingbin Liu, Xi Chen, Jiang Bian, Wai Lam

机构 * CUHK(香港中文大学) Tencent PCG(腾讯平台与内容事业群) FDU(复旦大学) Shanghai AI Laboratory(上海人工智能实验室) HKUST(香港科技大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.CV

AI总结 ForgeWM 是一种渐进式框架,通过多阶段技术将双向动作条件视频生成器转化为少步骤世界模型,在 Minecraft 和 FPS 游戏任务中实现了更优的可控少步骤视频生成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14481 2026-08-17 cs.RO cs.AI 新提交 74%

Ensuring Safe Physical AI in Urban Mobility via Hazard-Informed Synthesized Envelopes

通过危险信息合成包络确保城市移动中的安全物理人工智能

Alexei Odinokov, Rostislav Yavorskiy

机构 * Xortech DOO

专题命中 具身推理 :world model(abstract);robotic(abstract);分类 cs.RO、cs.AI;robotics(comments)

AI总结 针对异构机器人城市部署的安全挑战,提出结合危险分析与运行时执行的统一框架,通过跨层安全转换保障物理AI的城市移动安全。

Comments The 2026 International Conference on Control, Robotics Engineering and Technology (CRET 2026), this https URL (https://www.cret.net/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13901 2026-08-17 cs.RO 新提交 74%

Ontology-Grounded World Models for Failure Diagnosis and Closed-Loop Repair in Physical AI Systems

用于物理人工智能系统故障诊断与闭环修复的本体论驱动世界模型

Kailin Wang, Haoxiang Jie, Yaoyuan Yan, Jiacheng Zhou, Zhiyou Heng

机构 * AI Lab, Country Garden Services Group(碧桂园服务集团AI实验室) Fudan University(复旦大学) Omni AI

专题命中 具身推理 :world model(title);分类 cs.RO

AI总结 本文提出分层于EV-WM之上的Onto-EV-WM本体驱动接口,在PointMaze、LIBERO-Goal等基准测试中实现高故障修复成功率,为物理AI系统提供有效的故障诊断与闭环修复方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14530 2026-08-17 cs.CV cs.AI 新提交 62%

Marionette: Predicting World States, Rendering Geometry, Painting Appearance

Marionette:预测世界状态、渲染几何、绘制外观

Zian Meng, Zhen Li, Chuanhao Li, Qiang Li, Kaipeng Zhang

机构 * Alaya Lab(Alaya实验室) Shanghai Innovation Institute(上海创新研究院) Huazhong University of Science and Technology(华中科技大学)

专题命中 具身推理 :world model(abstract);分类 cs.AI、cs.CV

AI总结 Marionette是面向带关节角色的交互式游戏的世界模型,通过显式建模3D世界状态、委托几何计算、合成外观,实现了可控的长时序行为,且外观生成无明显保真度损失。

Comments Project page: this https URL (https://alayalab.github.io/Marionette/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14125 2026-08-17 cs.AI 新提交 57%

Traj-LeWM: Path-Aware World-Model Planning via Latent Trajectory Cost

Traj-LeWM:通过潜在轨迹代价实现路径感知的世界模型规划

Xiaodi Huang, Ziyi Ding, Jingtian Wan, Yuchen Liu, Yuan Zhang, Xiao-Ping Zhang, Jiayu Chen, Zhang Zhang, Tao Huang

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Shanghai Jiao Tong University(上海交通大学) Tsinghua Shenzhen International Graduate School(清华大学深圳国际研究生院) The University of Hong Kong(香港大学) INFIFORCE University of Science and Technology of China(中国科学技术大学) Peking University(北京大学)

专题命中 具身推理 :world model(abstract);分类 cs.AI

AI总结 本文针对LeWM的局限提出Traj-LeWM,通过引入潜在轨迹代价结合终点距离的联合评分,在多个机器人与导航任务上实现性能提升,验证了轨迹级信息的互补作用。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 模仿学习与强化学习 3 篇

2608.14332 2026-08-17 cs.RO cs.LG 新提交 62%

CORAL: Curriculum-Optimized Reward Adaptation for LiDAR-Based Goal-Directed Urban Driving

CORAL:面向基于激光雷达的目标导向城市驾驶的课程优化奖励适配

Anisa Saleem, Duksu Kim

机构 * Korea University of Technology and Education (KOREATECH)(韩国技术教育大学)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.LG

AI总结 CORAL结合五阶段课程与阶段感知奖励,在CARLA中训练多流演员-评论家策略,实现基于激光雷达的城市驾驶,长路线约束下成功率显著优于PPO基线,且可零样本跨城镇迁移。

Comments 13 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14498 2026-08-17 cs.LG cs.DC 新提交 57%

Rollplex: Cross-Phase GPU Spatial Sharing for Vision Language Model Post-Training

Rollplex:面向视觉语言模型后训练的跨阶段GPU空间共享

Hanfeng Lu, Tianyu Feng, Suyi Li, Yuheng Zhao, Wei Gao, Shaopan Xiong, Ju Huang, Siran Yang, Jiamang Wang, Lin Qu, Wei Wang

机构 * HKUST(香港科技大学) Alibaba Inc(阿里巴巴公司)

专题命中 模仿学习与强化学习 :embodied agent(abstract);分类 cs.LG

AI总结 Rollplex是一种跨阶段GPU空间共享运行时,通过解耦RL后训练的参考与训练阶段、优化内存与并行度,提升VLMs后训练的GPU利用率与训练速度。

Comments 16 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14082 2026-08-17 cs.RO 新提交 57%

PILOT: Privileged Imitation Learning for End-to-End Motion Planning of Autonomous UAVs under Partial Observability

PILOT:部分可观测条件下自主无人机端到端运动规划的特权模仿学习方法

Qingrui Zhang, Feng Xue, Xiang Zhou, Chenghao Yu

机构 * School of Aeronautics and Astronautics, Sun Yat-sen University(中山大学航空航天学院) Sun Yat-sen University(中山大学)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO

AI总结 本文提出PILOT框架,通过特权模仿学习结合TCN时空感知融合模块,实现部分可观测下无人机端到端运动规划,性能接近最优控制专家且计算开销降超80%,零样本部署验证其可行性与泛化性。

Comments 13 Pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 人机交互与遥操作 1 篇

2608.14406 2026-08-17 cs.RO physics.ins-det 新提交 79%

Effect of Twisted-Yarn Architecture on Pressure and Proximity Sensing Characteristics of Textile Capacitive Sensors for Robotic Skin

捻纱结构对用于机器人皮肤的纺织电容式传感器的压力与接近传感特性的影响

Ishtia Zahir, Eslam Saleh, Maryam Rezayati, Güunter Grabher, Gaffar Hossain

机构 * V-Trion GmbH(V-Trion有限公司) Institute of Mechatronic Systems, ZHAW Zurich University of Applied Sciences(苏黎世应用科技大学机电系统研究所) Grabher Group GmbH(格拉伯集团有限公司)

专题命中 人机交互与遥操作 :robotic(title,abstract);分类 cs.RO

AI总结 本研究开发基于银涂层纱线的纺织电容传感器,探究捻纱层数对其压力、接近传感等特性的影响,实现传感性能调谐,验证其可用于机器人皮肤的实时触觉检测。

Comments 10 pages. Submitted to IEEE Transactions on Instrumentation and Measurement

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 机器人数据与评测 5 篇

2608.14284 2026-08-17 cs.RO cs.CV 新提交 73%

PRM-as-a-Judge 1.5: A Toolkit for Robot Process Assessment

PRM-as-a-Judge 1.5:机器人过程评估工具包

Yuyang Liu, Yanqing Shen, Ruike Chen, Jifan Zhao, Yuxuan Tian, Yichi Zhang, Tianfeng Long, Zixuan Yin, Yipu Wang, Ziheng Qin, Wenxing Tan, Yang Shi, Mingyu Cao, Runze Xiao, Ziqi Wang, Zhixin Yin, Shiwei Chu, Yi-Fan Zhang, Yao Mu, Yuheng Ji, Yihao Wang, Jun Yan, Zhongyuan Wang, Pengwei Wang, Xiaolong Zheng

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 该研究推出PRM-as-a-Judge 1.5工具包,新增三个评估指标并结合RoboPulse++,发布含基准与可视化工具的评估套件,呼吁建立透明可复现的机器人评估体系。

Comments Project page: this https URL (https://prm-as-a-judge.github.io)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13719 2026-08-17 cs.AI cs.RO 新提交 62%

Coverage Aware Active Evaluation for Failure Discovery with Paired Systems

面向配对系统故障发现的覆盖率感知主动评估

Anjali Parashar, Rachel Luo, Apoorva Sharma, Sushant Veer, Edward Schmerling, Carson Sobolewski, Mingxin Yu, Chuchu Fan, Marco Pavone

机构 * Laboratory of Information & Decision Systems (LIDS), MIT(麻省理工学院信息与决策系统实验室(LIDS)) NVIDIA Research(英伟达研究院)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO、cs.AI

AI总结 该研究针对自主系统故障发现难题,提出结合代理评估与残差建模、支持感知互信息目标的自适应方法,在三类任务中发现的故障数是基线的两倍。

Comments 9 main pages followed by Appendix, total 21 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14490 2026-08-17 cs.AI 新提交 57%

Twin: Playing an Unknown Game with a Test-Time Digital Twin

Twin:利用测试时数字孪生玩未知游戏

Alexy Skoutnev, Kirill Acharya, Gaston Longhitano, Madeleine Udell, Kevin Ellis, Iddo Drori

专题命中 机器人数据与评测 :world model(abstract);分类 cs.AI

AI总结 该研究提出Twin系统,通过测试时数字孪生构建可执行世界模型,在ARC-AGI-3等未知游戏中通关率达97.8%,效率优于人类,核心是通过模拟交互和反例修复推断游戏规则与目标。

Comments Project website with action-by-action replays of all 25 runs: this https URL (https://arc-agi-3-twin.vercel.app/) Code: this https URL (AGI-3" target="_blank" rel="noopener">https://github.com/Alexyskoutnev/TWIN-ARC-AGI-3)

详情

展开后加载摘要…

URL PDF HTML 收藏