arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2026-06-23 至 2026-06-23 共收录 6 信号源:cs.RO, cs.CV, cs.AI, cs.LG

1. VLA模型 5 篇

2602.12691 2026-06-23 cs.RO cs.AI 版本更新 90%

ALOE: Action-Level Off-Policy Evaluation for Vision-Language-Action Model Post-Training

ALOE: 面向视觉-语言-动作模型后训练的动作级离策略评估

Rushuai Yang, Hecheng Wang, Zhichao Wu, Chiming Liu, Xiaohan Yan, Xuan Du, Shuoyu Yue, Chuheng Zhang, Yunlong Wang, Yongcheng Liu, Lizhe Qi, Yi Chen, Wei Shan, Maoqing Yao

机构 * AgiBot The Hong Kong University of Science and Technology(香港科技大学) Fudan University(复旦大学) Nanjing University(南京大学) Independent Researcher(独立研究者)

专题命中 VLA模型 :vision-language-action(title,abstract);action model(title);VLA(abstract,abstract_cn);分类 cs.RO、cs.AI

AI总结 提出ALOE框架,通过离策略评估直接估计当前策略的价值,结合分块时序差分和保守值聚合,改善稀疏奖励下的信用分配,在四项真实世界操作任务中优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21445 2026-06-23 cs.RO 版本更新 89%

VLA Knows Its Limits: Adaptive Execution Horizons for Robot Policies

VLA 知道自己的极限:机器人策略的自适应执行视界

Haoxuan Wang, Gengyu Zhang, Yan Yan, Ramana Rao Kompella, Gaowen Liu

机构 * University of Illinois Chicago(伊利诺伊大学芝加哥分校) Cisco Research(思科研究)

专题命中 VLA模型 :VLA(title,title_cn);vision-language-action(abstract);分类 cs.RO

AI总结 针对流式视觉-语言-动作模型中执行视界影响性能的问题,提出 AutoHorizon 方法,通过分析注意力权重动态估计每块动作的执行视界,提升机器人操作任务性能。

Comments ECCV 2026. Project page at https://hatchetproject.github.io/autohorizon/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21415 2026-06-23 astro-ph.HE 版本更新 78%

Impact of the EPOS.LHC-R hadronic interaction model on the Centaurus A ultrahigh-energy cosmic-ray scenario

EPOS.LHC-R强子相互作用模型对半人马座A超高能宇宙射线情景的影响

Silvia Mollerach, Esteban Roulet

专题命中 VLA模型 :action model(title,abstract)

AI总结 本文探讨了EPOS.LHC-R强子相互作用模型对邻近半人马座A射电星系作为能量>5 EeV宇宙线主要起源的情景的影响,发现该模型导致更重的成分组成,并引入了一种从大气簇射最大发展深度提取宇宙线质量信息的新方法。

Comments matches published version

Journal ref Phys.Rev.D 113 (2026) 10, 103019

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15757 2026-06-23 cs.RO cs.AI 版本更新 73%

You've Got a Golden Ticket: Improving Generative Robot Policies With A Single Noise Vector

你有一张金票:用单一噪声向量改进生成式机器人策略

Omkar Patil, Ondrej Biza, Thomas Weng, Karl Schmeckpeper, Wil Thomason, Xiaohan Zhang, Kausik Sivakumar, Robin Walters, Nakul Gopalan, Sebastian Castro, Stephen Hart, Eric Rosen

机构 * Robotics and AI Institute(机器人与人工智能研究所) Arizona State University(亚利桑那州立大学) Northeastern University(东北大学)

专题命中 VLA模型 :VLA(abstract,abstract_cn);分类 cs.RO、cs.AI

AI总结 提出用固定初始噪声替换高斯采样,通过蒙特卡洛搜索找到“金票”,无需训练即可提升预训练扩散/流匹配策略在46/51个任务中的成功率,最高提升55%。

Comments 34 pages, 14 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10187 2026-06-23 astro-ph.SR astro-ph.HE gr-qc 版本更新 71%

Modern tidal interaction models for rapid binary population synthesis: I. Methods

现代潮汐相互作用模型用于快速双星族合成:I. 方法

Veome Kapil, Ilya Mandel, Evgeni Grishin, Jim Fuller, Jeff Riley, Emanuele Berti

专题命中 VLA模型 :action model(title)

AI总结 本文提出适用于快速双星族合成的现代潮汐耗散理论简化表达式,在COMPAS中实现并验证了潮汐与恒星演化及双星性质的自洽耦合,潮汐耗散效率可比常用模型高1-7个数量级。

Comments 24 pages, 11 figures, accepted for publication by ApJ

Journal ref ApJ 1002 200 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 数据集与评测 1 篇

2606.04825 2026-06-23 cs.RO 版本更新 77%

HapTile: A Haptic-Informed Vision-Tactile-Language-Action Dataset for Contact-Rich Imitation Learning

HapTile: 用于接触丰富模仿学习的触觉感知视觉-触觉-语言-动作数据集

Amirhosein Alian, Yongqiang Zhao, Shiyi Gu, Xuyang Zhang, Zhuo Chen, Christopher E. Mower, Haitham Bou-Ammar, Shan Luo

机构 * King’s College London, UK(伦敦国王学院) Huawei, Noah’s Ark Lab, UK(华为、诺亚实验室) University College London, UK(伦敦大学学院)

专题命中 数据集与评测 :VLA(abstract,abstract_cn);vision-language-action(abstract);分类 cs.RO

AI总结 提出HapTile数据集,通过集成指尖触觉反馈和操作员触觉感知,为接触丰富的机器人操作任务提供视觉-触觉-语言-动作联合数据,并验证其在策略学习中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏