arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2026-03-04 至 2026-03-04 共收录 7 信号源:cs.RO, cs.CV, cs.AI, cs.LG

1. VLA模型 6 篇

2603.02271 2026-03-04 cs.PF cs.AI cs.AR cs.RO 84%

Characterizing VLA Models: Identifying the Action Generation Bottleneck for Edge AI Architectures

表征VLA模型:识别边缘AI架构中的动作生成瓶颈

Manoj Vishwanathan, Suvinay Subramanian, Anand Raghunathan

机构 * Google, Mountain View, CA(谷歌,山景城,加利福尼亚) Purdue University, West Lafayette, IN(普渡大学,沃斯堡,印第安纳)

专题命中 VLA模型 :VLA(title,abstract);vision-language-action(abstract);分类 cs.RO、cs.AI

AI总结 本文研究了VLA模型在边缘AI中的动作生成瓶颈,通过分析发现动作生成阶段占端到端延迟的75%,并探讨了扩展至100B参数模型的硬件需求及未来技术路径。

Comments 3 Pages 4 Figures for Workshop paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17520 2026-03-04 cs.RO cs.CV 84%

InstructVLA: Vision-Language-Action Instruction Tuning from Understanding to Manipulation

InstructVLA: 从理解到操作的视觉-语言-动作指令微调

Shuai Yang, Hao Li, Bin Wang, Yilun Chen, Yang Tian, Tai Wang, Hanqing Wang, Feng Zhao, Yiyi Liao, Jiangmiao Pang

机构 * University of Science and Technology of China(中国科学技术大学) Zhejiang University(浙江大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 VLA模型 :vision-language-action(title,abstract);VLA(abstract);分类 cs.RO、cs.CV

AI总结 InstructVLA通过视觉-语言-动作指令微调,实现了在多模态推理和动作生成之间的平衡,提升了机器人在复杂任务中的操控性能和泛化能力。

Comments 48 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08946 2026-03-04 q-bio.BM cs.LG 79%

Physically Valid Biomolecular Interaction Modeling with Gauss-Seidel Projection

基于高斯-塞德尔投影的物理有效生物分子相互作用建模

Siyuan Chen, Minghao Guo, Caoliwen Wang, Anka He Chen, Yikun Zhang, Jingjing Chai, Yin Yang, Wojciech Matusik, Peter Yichen Chen

机构 * University of British Columbia(不列颠哥伦比亚大学) MIT CSAIL(麻省理工学院计算机科学与人工智能实验室) NVIDIA(英伟达) Peking University(北京大学) Foundry Biosciences(Foundry 生物科技) University of Utah(犹他大学)

专题命中 VLA模型 :action model(title,abstract);分类 cs.LG

AI总结 本文提出了一种基于高斯-塞德尔投影的生物分子相互作用建模方法,通过强制物理有效性约束提升结构准确性,实现高效且稳定的去噪过程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03195 2026-03-04 cs.CV cs.AI cs.RO 75%

Chain of World: World Model Thinking in Latent Motion

链式世界:潜在运动中的世界模型思维

Fuxiang Yang, Donglin Di, Lulu Tang, Xuancheng Zhang, Lei Fan, Hao Li, Chen Wei, Tonghua Su, Baorui Ma

机构 * Harbin Institute of Technology(哈尔滨工业大学) Li Auto Beijing Academy of Artificial Intelligence (BAAI)(北京人工智能研究院) University of New South Wales(新南威尔士大学) Chongqing Research Institute of HIT(哈尔滨工业大学重庆研究院) Peking University(北京大学)

专题命中 VLA模型 :vision-language-action(abstract);VLA(abstract);分类 cs.RO、cs.CV、cs.AI

AI总结 CoWVLA通过统一世界模型的时间推理与解耦的潜在运动表示,提升视觉-运动学习效率。

Comments Accepted by CVPR2026. Project page: https://fx-hit.github.io/cowvla-io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19471 2026-03-04 astro-ph.CO astro-ph.GA 50%

Revealing the intricacies of radio galaxies and filaments in the merging galaxy cluster Abell 2255. II. Properties of filaments using multi-frequency radio data

揭示阿贝尔2255合并星系团中射电星系和纤维的复杂性。II. 使用多频射电数据研究纤维的性质

E. De Rubeis, M. Bondi, A. Botteon, R. J. van Weeren, J. M. G. H. J. de Jong, G. Brunetti, L. Rudnick, M. Brüggen, L. Bruno, E. L. Escott, C. Gheller, L. K. Morabito, K. Rajpurohit, H. J. A. Röttgering

专题命中 VLA模型 :VLA(abstract)

AI总结 通过多频射电数据研究阿贝尔2255中纤维的性质,揭示其复杂的频谱结构和极化特征。

Comments 18 pages, 13 figures, proposed for acceptance on Astronomy and Astrophysics

Journal ref A&A 707, A49 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02529 2026-03-04 eess.SP 50%

Uncertainty Quantification of Radio Wave Propagation over Irregular Terrains Using Adaptive Polynomial Chaos Expansion

利用自适应多项式混沌展开对不规则地形上无线电波传播的不确定性量化

Sicheng An, Luca Di Rienzo, Hao Qin, Xingqi Zhang, Lorenzo Codecasa

专题命中 VLA模型 :action model(abstract)

AI总结 本文提出一种改进的自适应多项式混沌展开方法,结合双向抛物线波方程,高效地对不规则地形上无线电波传播的不确定性进行量化,提高了预测精度和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 部署与泛化 1 篇

2603.02772 2026-03-04 cs.RO 57%

Agentic Self-Evolutionary Replanning for Embodied Navigation

代理自进化重规划用于具身导航

Guoliang Li, Ruihua Han, Chengyang Li, He Li, Shuai Wang, Wenchao Ding, Hong Zhang, Chengzhong Xu

机构 * Department of Computer and Information Science, University of Macau(澳门大学计算机与信息科学系) SIAT, Chinese Academy of Sciences(中国科学院上海技术物理研究所) Department of Computer Science, University of Hong Kong(香港大学计算机科学系) Academy for Engineering & Technology, Fudan University(复旦大学工程与技术学院) Department of EEE, Southern University of Science and Technology(南方科技大学电子工程系)

专题命中 部署与泛化 :action model(abstract);分类 cs.RO

AI总结 SERP通过自进化动作模型和图链式思考重规划,提升具身导航在复杂环境中的鲁棒性和效率。

Comments 8 pages, 10 figures, 4 tables, submitted to IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏