arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-06-03 至 2026-06-03 共收录 131 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 34 篇

2606.02677 2026-06-03 cs.RO 57%

Motion Planning in Dynamic Environments: A Survey from Classical to Modern Methods

动态环境中的运动规划:从经典到现代方法的综述

Zongyuan Shen, Yaming Ou, Shalabh Gupta, Shancheng Zhao, Dehua Zhou, Gao Wang, Zhongqiang Ren, Junfeng Fan, Long Cheng

机构 * College of Information Science and Technology, Jinan University(济南大学信息科学与技术学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Department of Electrical and Computer Engineering, University of Connecticut(康奈尔大学电子与计算机工程系) Global College, Shanghai Jiao Tong University(上海交通大学全球学院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文综述了138篇文献,将动态环境中的运动规划方法分为采样、图搜索、模型预测控制、学习及经典局部规划五类,分析了各方法的原理、优缺点及动态环境特有挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00366 2026-06-03 cs.LG math.OC 57%

GLENS: Global Search via Learning from Solver Iterates with Diffusion Models

GLENS: 通过扩散模型从求解器迭代中学习进行全局搜索

Anjian Li, Bartolomeo Stellato, Ryne Beeson

机构 * Department of Electrical and Computer Engineering, Princeton University(电气工程与计算机科学系,普林斯顿大学) Department of Operations Research and Financial Engineering, Princeton University(运筹学与金融工程系,普林斯顿大学) Department of Mechanical and Aerospace Engineering, Princeton University(机械与航空航天工程系,普林斯顿大学)

专题命中 具身导航 :navigation(abstract);分类 cs.LG

AI总结 提出GLENS方法,利用扩散模型学习求解器迭代过程中的局部几何结构,生成高质量且多样化的初始猜测,加速多模态非凸优化问题的全局搜索。

详情

展开后加载摘要…

URL PDF HTML 收藏
1112.5282 2026-06-03 cs.RO cs.SY eess.SY 57%

Observability of Strapdown INS Alignment: A Global Perspective

捷联惯导系统对准的可观测性:全局视角

Yuanxin Wu, Hongliang Zhang, Meiping Wu, Xiaoping Hu, Dewen Hu

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文从全局视角出发,利用SO(3)流形上的姿态演化等固有特性,研究捷联惯导系统静态和翻滚对准的可观测性,证明绕两个不同轴连续旋转可实现完全可观测,绕单轴旋转则存在有限不可观测状态。

Comments 25 pages; IEEE Trans. on Aerospace and Electronic Systems, Jan. 2012

Journal ref IEEE Trans. on Aerospace and Electronic Systems, 48(1), pp. 78-102, 2012

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03673 2026-06-03 eess.SP 56%

Chasing Lightning: Detecting, Characterizing, and Identifying a Powerful Space-Based GNSS Interference Source

追逐闪电:检测、表征和识别一个强大的天基GNSS干扰源

Zachary L. Clements, Argyris Kriezis, Todd E. Humphreys

专题命中 具身导航 :navigation(abstract,comments)

AI总结 本文利用2019-2026年地面GNSS参考站网络数据,开发了基于接收功率的检测框架,详细描述了干扰事件的时空谱模式,并融合接收功率和到达时间差测量技术,将干扰源识别为俄罗斯“闪电”轨道预警卫星星座。

Comments Submitted for review to the Institute of Navigation journal NAVIGATION

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03427 2026-06-03 cs.SE 50%

Multi-Modal Assessment of Road Roughness Using Smartphone Applications, Acceleration, and Passenger Ratings

使用智能手机应用、加速度和乘客评分的多模态道路平整度评估

Novel Certada, Amirhesam Aghanouri, Joseba Gorospe, Cristina Olaverri-Monreal

专题命中 具身导航 :navigation(abstract)

AI总结 提出一种基于智能手机IRI估计、车载GNSS-IMU测量和乘客PSR评分的低成本多模态道路平整度评估框架,验证了数据间的相关性及感知与物理指标的关联。

Comments 6 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03225 2026-06-03 cs.DB cs.DS 50%

HRNN: A Hybrid Graph Index for Approximate Reverse k-Nearest Neighbor Search on High-Dimensional Vectors

HRNN: 一种用于高维向量近似反向k近邻搜索的混合图索引

Wenxuan Xia, Mingyu Yang, Wentao Li, Wei Wang

专题命中 具身导航 :navigation(abstract)

AI总结 针对高维空间中反向k近邻搜索存在的候选扩展开销大和验证成本高的问题,提出HRNN混合图索引,通过代理点策略和离线物化kNN半径实现高效近似搜索。

Comments technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02856 2026-06-03 math.PR cs.SI math.CO 50%

Geometric Routing in Geometric Inhomogeneous Random Graphs

几何非均匀随机图中的几何路由

Yu-Cheng Chiu, Marc Kaufmann, Kostas Lakis, Ulysse Schaller

专题命中 具身导航 :navigation(abstract)

AI总结 本文首次严格分析了几何非均匀随机图(GIRG)中的去中心化几何路由,证明在特定参数条件下,仅利用几何信息即可实现与贪婪路由相同的最优渐近路径长度Θ(log log n)。

详情

展开后加载摘要…

URL PDF HTML 收藏
1202.4375 2026-06-03 math.OC cs.SY eess.SY 50%

The Stochastic Reach-Avoid Problem and Set Characterization for Diffusions

扩散过程随机到达-规避问题与集合刻画

Peyman Mohajerin Esfahani, Debasish Chatterjee, John Lygeros

专题命中 具身导航 :navigation(abstract)

AI总结 从最优控制角度研究具有状态约束的随机可达性问题,通过连接两类随机到达-规避问题与三类不连续支付函数的最优控制问题,推导弱动态规划原理,并给出值函数作为不连续粘性解偏微分方程的特征刻画。

Journal ref Automatica, Vol. 70, pp. 43-56, 2016

详情

展开后加载摘要…

URL PDF HTML 收藏
1302.0249 2026-06-03 eess.SY cs.IT cs.SI cs.SY math.IT 50%

Bayesian Quadratic Network Game Filters

贝叶斯二次网络博弈滤波器

Ceyhun Eksin, Pooya Molavi, Alejandro Ribeiro, Ali Jadbabaie

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出二次网络博弈(QNG)滤波器,使智能体基于贝叶斯纳什均衡更新信念、选择最优行动,并学习网络状态的充分统计量,应用于古诺市场竞争和协调博弈。

详情

展开后加载摘要…

URL PDF HTML 收藏
1211.6189 2026-06-03 eess.SY cs.LO cs.SY 50%

Distributed Priority Synthesis

分布式优先级综合

Chih-Hong Cheng, Rongjie Yan, Saddek Bensalem, Harald Ruess

专题命中 具身导航 :robotics(abstract)

AI总结 针对非确定性交互组件与安全需求,通过优先级限制交互集以保证安全,提出分布式优先级综合问题,形式化为多玩家安全博弈,并基于诊断方法与SAT归约优化求解,集成于VissBIP框架。

Comments In Proceedings SSV 2012, arXiv:1211.5873

Journal ref EPTCS 102, 2012, pp. 57-72

详情

展开后加载摘要…

URL PDF HTML 收藏
1107.5348 2026-06-03 eess.SY cs.SY math.OC 50%

Decision Making for Rapid Information Acquisition in the Reconnaissance of Random Fields

随机场侦察中快速信息获取的决策制定

Dimitar Baronov, John Baillieul

专题命中 具身导航 :robotic(abstract)

AI总结 本文提出基于微分拓扑和信息论的理论框架,用于设计快速发现随机场拓扑特征的侦察策略,并引入新的性能指标来平衡速度与精度。

Comments 34 pages, 20 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1012.5113 2026-06-03 eess.SY cs.SY 50%

Timed Game Abstraction of Control Systems

控制系统的定时博弈抽象

Christoffer Sloth, Rafael Wisniewski

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出一种基于定时博弈自动机的控制系统抽象方法,通过Lyapunov函数生成的正负不变集划分状态空间,实现自动控制器综合。

详情

展开后加载摘要…

URL PDF HTML 收藏
1010.0034 2026-06-03 cs.MA cs.SY eess.SY math.OC 50%

Spectral Control of Mobile Robot Networks

移动机器人网络的频谱控制

Michael M. Zavlanos, Victor M. Preciado, Ali Jadbabaie

专题命中 具身导航 :robotics(abstract)

AI总结 提出一种连续时间控制方案,通过邻接矩阵谱矩抽象来修改移动机器人网络结构,使其达到期望的特征值集合。

Comments http://alum.mit.edu/www/vmp

详情

展开后加载摘要…

URL PDF HTML 收藏
0807.0403 2026-06-03 math.NA cs.NA math.AP 50%

Fully adaptive multiresolution schemes for strongly degenerate parabolic equations with discontinuous flux

完全自适应多分辨率格式用于具有间断通量的强退化抛物方程

Raimund Bürger, Ricardo Ruiz Baier, Mauricio Sepúlveda, Kai Schneider

专题命中 具身导航 :navigation(abstract)

AI总结 提出一种基于Engquist-Osher通量近似和显式时间步进的完全自适应有限体积多分辨率格式,通过动态分级树存储多分辨率表示,有效解决强退化抛物方程的计算效率问题。

Journal ref Journal of Engineering Mathematics, vol. 60, pp. 365-385, (2008)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身推理 9 篇

2606.02753 2026-06-03 cs.CV cs.AI 84%

MetaWorld: Scaling Multi-Agent Video World Model from Single-view Video Data

MetaWorld: 从单视角视频数据扩展多智能体视频世界模型

Teng Hu, Mingchun Lu, Yating Wang, Jiangning Zhang, Jinkun Hao, Ye Pan, Ran Yi, Lizhuang Ma, Dacheng Tao

机构 * Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学) Nanyang Technological University(南洋理工大学)

专题命中 具身推理 :world model(title,abstract);embodied AI(abstract);分类 cs.AI、cs.CV

AI总结 提出MetaWorld框架,通过单目世界状态展开、主体感知世界生成器和世界状态对齐机制,从单视角视频构建多智能体视频世界模型,解决数据稀缺和世界状态对齐问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03685 2026-06-03 cs.LG cs.AI 81%

A Close Look At World Model Recovery In Supervised Fine-Tuned LLM Planners

监督微调的大语言模型规划器中世界模型恢复的深入探究

Patrick Emami, Nan Qiang, Peter Graf

机构 * National Laboratory of the Rockies(落基山国家实验室)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.LG

AI总结 通过可解释性实验,研究监督微调如何影响大语言模型在经典规划任务中恢复世界模型的能力,发现微调使模型线性编码动作有效性和状态谓词,且更广泛的状态空间覆盖有助于更准确的世界模型恢复。

Comments 17 pages. Under review at TMLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18690 2026-06-03 q-bio.NC cs.CV cs.LG 81%

Neural Fields as World Models

神经场作为世界模型

Joshua Nunley

机构 * Luddy School of Informatics, Computing, and Engineering, Indiana University, Bloomington(信息学、计算与工程学院,印第安纳大学,布卢明顿) Cognitive Science Program, Indiana University, Bloomington(认知科学项目,印第安纳大学,布卢明顿)

专题命中 具身推理 :world model(title,abstract);分类 cs.CV、cs.LG

AI总结 提出同构世界模型,利用运动门控神经场在空间图中进行物理预测,实现离线任务学习和身体相关表征。

Comments 6 pages, 6 figures. Annual Meeting of the Cognitive Science Society (CogSci 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03603 2026-06-03 cs.CV cs.CL 79%

World Models Meet Language Models: On the Complementarity of Concrete and Abstract Reasoning

世界模型遇见语言模型:论具体推理与抽象推理的互补性

Yucheng Zhou, Wei Tao, Yiwen Guo, Jianbing Shen

机构 * Nanyang Technological University(南洋理工大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.CV

AI总结 本文提出受控具体推理框架及PF-OPSD方法,通过结合世界模型的视觉模拟与多模态大语言模型的抽象推理,在空间前瞻和开放域物理预测任务上提升性能与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
1206.3285 2026-06-03 cs.AI cs.LG cs.SY eess.SY 62%

Dyna-Style Planning with Linear Function Approximation and Prioritized Sweeping

具有线性函数逼近和优先级扫描的Dyna风格规划

Richard S. Sutton, Csaba Szepesvari, Alborz Geramifard, Michael P. Bowling

专题命中 具身推理 :world model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种基于模型的Dyna风格规划方法,扩展至线性函数逼近,证明其收敛性,并引入线性Dyna的优先级扫描算法。

Comments Appears in Proceedings of the Twenty-Fourth Conference on Uncertainty in Artificial Intelligence (UAI2008)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03188 2026-06-03 cs.RO 57%

GeoSem-WAM: Geometry- and Semantic-Aware World Action Models

GeoSem-WAM:几何与语义感知的世界动作模型

Fulong Ma, Daojie Peng, Wenjun Yue, Jiahang Cao, Bintao Wang, Qiang Zhang, Jun Ma

机构 * HKUST(GZ)(香港科技大学(广州)) HKU(香港大学) USTC(中国科学技术大学) SDU(山东大学) X-Humaniod

专题命中 具身推理 :world model(abstract);分类 cs.RO

AI总结 提出GeoSem-WAM框架,通过几何和语义监督增强潜在表示,在统一潜在空间中联合捕捉场景动态、空间几何和语义上下文,避免测试时显式未来展开或视频生成,提升动作预测准确性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29930 2026-06-03 cs.AI cs.CY cs.HC 57%

Toward AI That Understands Self and Others: A World-Model Theory of Cognitive Diversity and Alignment

迈向理解自我与他人的AI系统:人类认知多样性与世界模型对齐的多阶段推理框架

Toru Takahashi

机构 * Human Informatics and Systems Lab, Doshisha University(立命馆大学人机系统实验室) Linked Open Data Initiative, NPO Keio Research Institute at SFC(庆应义塾大学SFC研究所开放数据计划) Stroly Inc(Stroly公司)

专题命中 具身推理 :world model(abstract);分类 cs.AI

AI总结 提出多阶段推理框架(MIM),通过阶段形成空间、前景化场、主体特定轮廓状态和状态表示对齐图,形式化异质世界模型的产生,并将世界模型对齐重新定义为使异质表示相互可处理的问题,而非强制一致。

Comments 87 pages. Revised version with a refined abstract emphasizing disagreement as a late-stage phenomenon, target admissibility, processability, and the methodological abstraction used to compare humans, AI systems, and institutional decision procedures under shared information-theoretic constraints

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18954 2026-06-03 cs.CV 57%

VOIC: Visible-Occluded Integrated Guidance for 3D Semantic Scene Completion

VOIC:可见-遮挡联合引导的3D语义场景补全

Zaidao Han, Risa Higashita, Jiang Liu

机构 * Research Institute of Trustworthy Autonomous Systems, Southern University of Science and Technology(可信自主系统研究院,南方科技大学) Department of Computer Science and Engineering, Southern University of Science and Technology(计算机科学与工程系,南方科技大学) School of Computer Science, University of Nottingham Ningbo China(宁波大学计算机学院) Department of Electronic and Information Engineering, Changchun University(电子与信息工程学院,长春大学)

专题命中 具身推理 :robotic(abstract);分类 cs.CV

AI总结 提出VOIC网络,通过解耦可见区域感知与遮挡区域推理,利用离线可见区域标签提取策略和双解码器框架,在SemanticKITTI和SSCBench-KITTI360上实现最先进的3D语义场景补全性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02586 2026-06-03 cs.GR 50%

Fewer, Better Frames: A Compute-Normalized Proof of Concept for Coherence-First World-Model Rendering with Model-Guided FSR4 Frame Generation

更少但更好的帧:一种计算归一化的概念验证,采用一致性优先的世界模型渲染与模型引导的FSR4帧生成

Paweł Katarzyński

专题命中 具身推理 :world model(abstract)

AI总结 本文提出一种一致性优先的渲染策略,通过生成高上下文锚定帧(15 FPS)并利用潜在增量运动引导和合成深度重建至30 FPS,在有限推理预算下比原生30 FPS基线更长时间保持场景几何、物体身份和深度层次,并通过LPIPS等指标验证了其有效性。

Comments 19 pages, 8 figures, independent systems proof of concept

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 机器人基础模型 8 篇

2606.03556 2026-06-03 cs.RO 84%

Partially Observable Adversarial Patch Attacks on Vision-Language-Action Models in Robotics

部分可观测的对抗性补丁攻击在机器人视觉-语言-动作模型上的应用

Xiaofei Wang, Mingliang Han, Tianyu Hao, Yi Yang, Yun-Bo Zhao, Keke Tang

机构 * Department of Automation, University of Science and Technology of China(自动化系,中国科学技术大学) SmartMore Corporation(SmartMore公司) Cyberspace Institute of Advanced Technology, Guangzhou University(广西亚技术空间研究所,广州大学) th Medical Center of Chinese PLA General Hospital(中国人民解放军总医院第八医学中心) Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(合肥综合性国家科学中心人工智能研究院)

专题命中 机器人基础模型 :robotics(title,abstract);robotic(abstract);分类 cs.RO

AI总结 针对机器人VLA模型,提出部分可观测威胁模型下的两阶段攻击框架,利用注意力图定位关键区域并优化补丁以破坏语义接地和增加动作轨迹曲率,导致长期任务失败。

Comments Accepted by IEEE Robotics and Automation Letters, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03392 2026-06-03 cs.RO 77%

OpenEAI-Platform: An Open-source Embodied Artificial Intelligence Hardware-Software Unified Platform

OpenEAI-Platform: 一个开源具身人工智能硬件-软件统一平台

Jinyuan Zhang, Luoyi Fan, Leiyu Wang, Yeqiang Wang, Yicheng Zhu, Cewu Lu, Nanyang Ye

机构 * Shanghai Innovation Institute(上海创新研究院) Huazhong University of Science and Technology(华中科技大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 机器人基础模型 :embodied AI(abstract);manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出OpenEAI-Platform,集成低成本6+1自由度机械臂和可复现VLA模型,通过开源设计和两阶段训练在真实操作任务中超越商业臂,性能媲美大规模预训练基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01241 2026-06-03 cs.RO 77%

OneVLA: A Unified Framework for Embodied Tasks

OneVLA:面向具身任务的统一框架

Lingfeng Zhang, Xiaoshuai Hao, Yingbo Tang, Lei Zhou, Shuyi Zhang, Jinkun Liu, Hongsheng Li, Chenhao Zhang, Qiang Zhang, Hangjun Ye, Xiaojun Liang, Long Chen, Wenbo Ding

机构 * Tsinghua University(清华大学) Pengcheng Laboratory(鹏城实验室) Xiaomi EV(小米电动车) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Peking University(北京大学) HKUST(GZ)(香港科技大学(广州))

专题命中 机器人基础模型 :manipulation(abstract);navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出统一架构OneVLA,通过设计统一动作头和渐进式训练策略(含数据构建和思维链微调),在导航与操作任务上实现跨任务正迁移,达到最先进性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23117 2026-06-03 cs.CR cs.AI cs.RO 73%

TRAP: Hijacking VLA CoT-Reasoning via Adversarial Patches

TRAP: 通过对抗性补丁劫持VLA的CoT推理

Zhengxian Huang, Wenjun Zhu, Haoxuan Qiu, Xiaoyu Ji, Wenyuan Xu

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 机器人基础模型 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 提出TRAP攻击,利用对抗性补丁劫持视觉-语言-动作模型的链式推理,实现目标行为操控。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02775 2026-06-03 cs.AI cs.AR cs.DC cs.PF cs.RO 62%

AURA: Action-Gated Memory for Robot Policies at Constant VRAM

AURA: 恒定VRAM下机器人策略的动作门控记忆

Josef Chen

机构 * KAIKAKU(卡基库)

专题命中 机器人基础模型 :embodied agent(abstract);分类 cs.RO、cs.AI

AI总结 提出AURA-Mem,一种恒定大小、基于动作误差信号门控写入的循环记忆,替代KV缓存,在边缘机器人任务中实现与基线相当的准确率,同时减少5-9倍写入次数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03240 2026-06-03 cs.RO 57%

GeoAlign: Beyond Semantics with State-Guided Spatial Alignment in VLA Models

GeoAlign: VLA模型中的状态引导空间对齐超越语义

Yizhi Chen, Zhanxiang Cao, Xinyi Peng, Yixiao Zheng, Xiaxi Si, Yiheng Li, Liyun Yan, Keqi Zhu, Xueyun Chen, Shengcheng Fu, Tianyue Zhan, Yufei Jia, Jinming Yao, Yan Xie, Kun Wang, Cewu Lu, Yue Gao

机构 * Tongji University(同济大学) Shanghai Innovation Institute(上海创新研究院) Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学) Jingdezhen Ceramic University(景德镇陶瓷大学) Tsinghua University(清华大学) HONOR(HONOR公司) University of Science and Technology of China(中国科学技术大学)

专题命中 机器人基础模型 :manipulation(abstract);分类 cs.RO

AI总结 提出GeoAlign架构,通过RGB几何分支的后训练和机器人本体状态引导的几何特征查询,实现几何感知的空间对齐和动态可供性选择,在多个基准上取得高性能。

Comments 20 pages, 9 figures, 8 tables, including appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03127 2026-06-03 cs.RO 57%

TTT-VLA: Test-Time Latent Prompt Optimization for Vision-Language-Action Models

TTT-VLA:面向视觉-语言-动作模型的测试时潜在提示优化

Wenbo Zhang, Jianxiong Li, Shuai Yang, Sijin Chen, Jiajun Liu, Lingqiao Liu, Xiao Ma

机构 * ByteDance Seed(字节跳动种子) The University of Adelaide(阿德莱德大学) Tsinghua University(清华大学) Zhejiang University(浙江大学) The University of Hong Kong(香港大学) CSIRO Data61

专题命中 机器人基础模型 :manipulation(abstract);分类 cs.RO

AI总结 提出TTT-VLA框架,通过测试时优化潜在提示来适应分布偏移,无需修改策略本身,在SimperEnv上提升单/多实体任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏