arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2026-07-22 至 2026-07-22 共收录 3 信号源:cs.RO, cs.CV, cs.AI, cs.LG

1. VLA模型 2 篇

2607.18580 2026-07-22 cs.RO 新提交 81%

STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models

STeP:用于视觉语言模型动作生成精确规范的信号时序逻辑

Kasra Torshizi, Anukriti Singh, Sidharth Mathur, Khuzema Habib, Leo Du, Pratap Tokekar

机构 * University of Maryland(马里兰大学)

专题命中 VLA模型 :VLA(abstract,abstract_cn);vision-language-action(abstract);language-conditioned robot(abstract);分类 cs.RO

AI总结 针对视觉语言动作模型缺乏可解释性及难以遵循精确自然语言指令的问题,提出用信号时序逻辑(STL)连接高级语言理解与低级机器人执行的分层框架,经实验验证该框架能提高语言条件下机器人规划的精度、可靠性和可解释性。

Comments 14 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18440 2026-07-22 astro-ph.GA 新提交 67%

Vz-GAL Dusty Star-Forming Galaxies: Revisiting the CO-H2 Conversion Factor Tension

Vz-GAL尘埃星形成星系:重新审视CO-H2转换因子的张力

Prachi Prajapati, Axel Weiss, Dominik Riechers, Tom J. L. C. Bakx, Leindert A. Boogaard, Diana Ismail, Pierre Cox, Andrew J. Baker, Roberto Neri, Matthew Lehnert, Chentao Yang, Emilio Romano-Diaz, Hiddo S. B. Algera, Stefano Berta, Edoardo Borsato, Kirsty M. Butler, Asantha Cooray, Bethany Jones, Amelie Saintonge, Paul van der Werf

专题命中 VLA模型 :VLA(abstract,abstract_cn)

AI总结 研究高红移尘埃星形成星系中CO-H2转换因子的“张力”,通过对21个星系样本用多种方法推导分子气体质量,发现当前数据不支持αCO = 0.8,中间到接近银河系的值可行,校准需解析分子气体观测、物理建模和对尘埃性质的约束。

Comments Submitted to ApJ

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 动作表示与策略 1 篇

2607.18840 2026-07-22 cs.RO 新提交 79%

WorldScape Policy 2.0: Empowering Steerable World Action Modeling with Reasoning-Augmented Memory

WorldScape Policy 2.0:通过推理增强记忆实现可控的世界行动建模

Haisheng Su, Zongdai Liu, Xin Jin, Haoxuan Dou, Chengming Hu, Baorun Li, Zhanwang Liu, Ruiyan Xu, Jianjie Fang, Xin Zhang, Zhenjie Yang, Xue Yang, Chen Gao, Junchi Yan, Yong Li, Wei Wu

专题命中 动作表示与策略 :action model(title,abstract);分类 cs.RO

AI总结 研究针对现有世界行动模型的局限,提出WorldScape Policy 2.0,用推理增强记忆,构建相关数据集,实现从高级指令自主规划及基于细粒度文本等的可控执行,在模拟和现实平台实验中展现出在多方面的卓越能力。

详情

展开后加载摘要…

URL PDF HTML 收藏