arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2026-08-04 至 2026-08-04 共收录 39 信号源:cs.RO, cs.CV, cs.AI, cs.LG

1. VLA模型 33 篇

2608.00844 2026-08-04 cs.CY cs.HC 新提交 50%

BoilerSketch: A TA-Supervised, Diagram-First GenAI Practice for Structured Diagrams in CS1/Early CS2

BoilerSketch:面向CS1/早期CS2的TA监督、以图表为核心的生成式AI结构化图表实践

Ethan Dickey, Vivan Tiwari, Anvit Sinha, Andres Bejarano

专题命中 VLA模型 :action model(abstract)

AI总结 BoilerSketch是面向CS1/早期CS2的TA监督式生成式AI实践,通过双面板交互模型生成结构化Mermaid图表,经21名教学人员评估,三分之二认为其对概念理解和支持任务有中等以上帮助,为入门计算课程提供了实用AI支持方案。

Comments 9 pages, 3 tables, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02029 2026-08-04 cond-mat.mes-hall 新提交 50%

Emission dynamics in zincblende InAsxP1-x quantum dots in InP nanowires: influence of quantum dot size, composition and nanowire geometry

InP纳米线中闪锌矿型InAsxP1-x量子点的发射动力学:量子点尺寸、组成及纳米线几何结构的影响

Tomasz Gzyl, Giada Bucci, Krzysztof Gawarecki, Elisa García-Tabarés, Anna Musiał, Valentina Zannier, Ylea Vlamidis, Fabio Beltram, Julian V. Montero, Beatriz Galiana, Lucia Sorba, Wojciech Rudno-Rudziński, Grzegorz Sęk

专题命中 VLA模型 :action model(abstract)

AI总结 本文研究InP纳米线中InAsxP1-x量子点的发射动力学,结合实验与理论分析,明确了量子点尺寸、组成及纳米线几何结构对发射的影响,揭示了珀塞尔效应的作用。

Comments 22 pages, 7 figures, submitted to: Photonics and Nanostructures - Fundamentals and Applications

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28978 2026-08-04 nucl-th nucl-ex 版本更新 50%

Ab initio optical potentials for magnesium isotopes at intermediate energies: from stability to the island of inversion

从稳定性到倒置岛的镁同位素从头计算光学势

G. H. Sargsyan, J. I. Fuentealba Bustamente, K. Beyer, Ch. Elster

专题命中 VLA模型 :action model(abstract)

AI总结 本文基于从头计算方法,首次计算了镁同位素的非局域光学势,通过比较全球模型验证了其在近N=20倒置岛区域的反应建模有效性。

Comments Accepted version to JPG Emerging Leaders issue

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 动作表示与策略 5 篇

2608.01381 2026-08-04 cs.RO 新提交 77%

DreamTrajectory: Trajectory-Guided Action Generation with World Model Alignment for Mobile Manipulation

DreamTrajectory:面向移动操作的、结合世界模型对齐的轨迹引导动作生成方法

Zheng Yang, Wenjie Zhang, Xiangyu Chen, Wenxuan Song, Xianpeng Wang, Yihang Kang, Wen Chen, Lujia Wang, Renjing Xu, Xiaowen Chu

专题命中 动作表示与策略 :VLA(abstract,abstract_cn);vision-language-action(abstract);分类 cs.RO

AI总结 DreamTrajectory是面向移动操作的轨迹引导框架,通过联合预测末端执行器轨迹与全身动作块、结合轨迹世界模型的测试时细化,在MS-HAB及真实任务中大幅提升操作成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02578 2026-08-04 cs.RO cs.AI cs.LG 新提交 67%

CoWAM: Coordination Contracts for Selective Policy Intervention with WAMs

CoWAM:结合世界动作模型(WAMs)的选择性策略干预协调合约

Shuaijun Liu, Qifu Wen, Shuyang Hao, Qi Luo, Chenglong Zhang, Feiyang You, Chengyu Wu, Ningxin Su

专题命中 动作表示与策略 :action model(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 该研究针对双机械臂机器人策略协调问题,提出结合世界动作模型(WAMs)的CoWAM协调合约选择性干预层,经8项模拟任务验证,其协调选择与闭环成功率均显著提升且有害干预极低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01397 2026-08-04 cs.RO cs.CV 新提交 62%

SG-WAM: Self-Guided World Modeling in Geometry-Aware Policy Space

SG-WAM:几何感知策略空间中的自引导世界建模

Ruiteng Zhao, Zhengshen Zhang, Yue Su, Wenshuo Wang, Jiahui Li, Zhiyuan Yang, Francis E. H. Tay, Marcelo H. Ang, Haiyue Zhu

专题命中 动作表示与策略 :action model(abstract);分类 cs.RO、cs.CV

AI总结 SG-WAM是自引导的几何感知世界动作模型框架,通过策略衍生空间联合优化动态预测等,在LIBERO等数据集上实现高成功率,性能优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00625 2026-08-04 cs.RO cs.AI 新提交 62%

Learning-Based Motion Planning for Dynamic Environments: From Foundational Algorithms to Emerging Paradigms

动态环境下基于学习的运动规划:从基础算法到新兴范式

Zongyuan Shen, Shalabh Gupta, Shancheng Zhao, Dehua Zhou, Gao Wang, Rui Cheng, Yaming Ou, Zhongqiang Ren, Yikui Zhai, C. L. Philip Chen

机构 * College of Information Science and Technology, Jinan University(暨南大学信息科学技术学院) University of Connecticut(康涅狄格大学) Guangzhou Maritime University(广州海事大学) University of Chinese Academy of Sciences(中国科学院大学) Global College, Shanghai Jiao Tong University(上海交通大学全球学院) Wuyi University(五邑大学) South China University of Technology(华南理工大学)

专题命中 动作表示与策略 :action model(abstract);分类 cs.RO、cs.AI

AI总结 本综述回顾2015至2025年动态环境下基于学习的运动规划代表性研究,提出学习作用分类法,分析相关影响因素,探讨安全可验证规划等开放挑战与未来方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07386 2026-08-04 cs.RO 版本更新 57%

Spline Policy: A Structured Representation for Robot Policies

样条策略:机器人策略的结构化表示

Mengze Tian, Yiming Li, Sichao Liu, Auke Ijspeert, Sylvain Calinon

机构 * École Polytechnique Fédérale de Lausanne (EPFL)(瑞士联邦理工学院(EPFL)) Idiap Research Institute(Idiap研究 institute)

专题命中 动作表示与策略 :vision-language-action(abstract);分类 cs.RO

AI总结 提出样条策略(SP),用样条参数替代动作块,保留策略主干,支持连续轨迹解码、时域重采样、参数空间编辑及下游控制,并具有局部修正机制。

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 数据集与评测 1 篇

2608.02580 2026-08-04 cs.RO 新提交 70%

Ego2Robot: Scalable Robot Data Synthesis from Egocentric Human Data

Ego2Robot:从第一视角人类数据生成可扩展机器人数据

Ye Wang, Pei Lin, Xiong-Hui Chen, Haoqi Yuan, Zhixuan Liang, Yiyang Huang, Anzhe Chen, Zixing Lei, Jie Zhang, Tao Zhang, Haoyang Li, Tong Zhang, Chenxi Xiao, Ziyuan Jiao, Qin Jin

机构 * AIM3 Lab, Renmin University of China(中国人民大学AIM3实验室) Qwen Team, Alibaba Inc.(阿里巴巴通义千问团队) ShanghaiTech University(上海科技大学) Beijing Institute for General Artificial Intelligence (BIGAI)(北京通用人工智能研究院) Beijing University of Aeronautics and Astronautics(北京航空航天大学)

专题命中 数据集与评测 :vision-language-action(abstract);action model(abstract);分类 cs.RO

AI总结 Ego2Robot提出将第一视角人类操控视频转换为机器人训练数据的可扩展流水线,生成18561小时机器人数据,扩展RoboTwin2.0验证其联合预训练可提升机器人分布外泛化能力并经真实部署验证

详情

展开后加载摘要…

URL PDF HTML 收藏