arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2026-02-27 至 2026-02-27 共收录 5 信号源:cs.RO, cs.CV, cs.AI, cs.LG
2602.22663 2026-02-27 cs.RO 88%

Rethinking the Practicality of Vision-language-action Model: A Comprehensive Benchmark and An Improved Baseline

重新审视视觉-语言-动作模型的实用性:一个全面的基准和一个改进的基线

Wenxuan Song, Jiayi Chen, Xiaoquan Sun, Huashuo Lei, Yikai Qin, Wei Zhao, Pengxiang Ding, Han Zhao, Tongxin Wang, Pengxu Hou, Zhide Zhong, Haodong Yan, Donglin Wang, Jun Ma, Haoang Li

机构 * OpenHelix-Team(OpenHelix团队)

专题命中 VLA模型 :vision-language-action(title,abstract);action model(title);VLA(abstract);分类 cs.RO

AI总结 本文提出CEbench基准和LLaVA-VLA模型,通过轻量级设计和两阶段训练提升视觉-语言-动作模型的实用性,实现在消费级GPU上的实际应用。

Comments Accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22514 2026-02-27 cs.RO cs.AI cs.SY eess.SY 84%

SignVLA: A Gloss-Free Vision-Language-Action Framework for Real-Time Sign Language-Guided Robotic Manipulation

SignVLA:一种无 gloss 的视觉-语言-动作框架,用于实时 sign language 引导的机器人操作

Xinyu Tan, Ningwei Bai, Harry Gardener, Zhengyang Zhong, Luoyu Zhang, Liuhaichen Yang, Zhekai Duan, Monkgogi Galeitsiwe, Zezhi Tang

机构 * Department of Computer Science, University College London (UCL)(计算机科学系,伦敦大学学院(UCL))

专题命中 VLA模型 :vision-language-action(title,abstract);VLA(abstract);分类 cs.RO、cs.AI

AI总结 SignVLA 提出了一种无 gloss 的视觉-语言-动作框架,用于实时手语引导的机器人操作,通过几何归一化、时间平滑和词汇精炼提升多模态交互的稳定性和可扩展性。

Comments 7 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12099 2026-02-27 cs.CV 83%

GigaBrain-0.5M*: a VLA That Learns From World Model-Based Reinforcement Learning

GigaBrain-0.5M*: 基于世界模型强化学习的VLA

GigaBrain Team, Boyuan Wang, Bohan Li, Chaojun Ni, Guan Huang, Guosheng Zhao, Hao Li, Jie Li, Jindi Lv, Jingyu Liu, Lv Feng, Mingming Yu, Peng Li, Qiuping Deng, Tianze Liu, Xinyu Zhou, Xinze Chen, Xiaofeng Wang, Yang Wang, Yifan Li, Yifei Nie, Yilong Li, Yukun Zhou, Yun Ye, Zhichao Liu, Zheng Zhu

机构 * GigaBrain Team(GigaBrain团队)

专题命中 VLA模型 :VLA(title,abstract);vision-language-action(abstract);分类 cs.CV

AI总结 GigaBrain-0.5M*通过基于世界模型的强化学习提升VLA模型的跨任务适应能力,实现复杂操作任务的可靠执行。

Comments https://gigabrain05m.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02297 2026-02-27 astro-ph.GA 50%

The Polarization and Magnetic Field of the Radio Arc as Observed by ALMA at 100 GHz

射电弧的偏振与磁场:由ALMA在100 GHz观测所得

Nora Salem, Dylan M. Paré, Paulo Cortes, Mark R. Morris, Valentin J. M. Le Gouellec

专题命中 VLA模型 :VLA(abstract)

AI总结 ALMA在100 GHz观测揭示射电弧磁场特征,发现其磁场方向与NTF丝状结构方向存在均匀旋转,且不同丝状结构磁场方向系统性不同。

Comments Accepted to the Astrophysical Journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.00341 2026-02-27 cs.IR 50%

A Survey on Bundle Recommendation: Methods, Applications, and Challenges

捆绑推荐的综述:方法、应用与挑战

Meng Sun, Lin Li, Ming Li, Xiaohui Tao, Dong Zhang, Qing Xie, Peipei Wang, Jimmy Xiangji Huang

专题命中 VLA模型 :action model(abstract)

AI总结 本文综述了捆绑推荐的方法、应用和挑战,探讨了判别性和生成性推荐方法,并讨论了该领域的未来发展方向。

Comments Accepted by ACM Computing Surveys

详情

展开后加载摘要…

URL PDF HTML 收藏