arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2026-03-30 至 2026-03-30 共收录 7 信号源:cs.RO, cs.CV, cs.AI, cs.LG

1. VLA模型 4 篇

2603.25766 2026-03-30 cs.RO cs.AI 91%

ETA-VLA: Efficient Token Adaptation via Temporal Fusion and Intra-LLM Sparsification for Vision-Language-Action Models

ETA-VLA:通过时间融合和内在LLM稀疏化实现高效标记适应的视觉-语言-动作模型

Yiru Wang, Anqing Jiang, Shuo Wang, Yuwen Heng, Zichong Gu, Hao Sun

机构 * Bosch Corporate Research, Bosch (China) Investment Ltd.(博世企业研究,博世(中国)投资有限公司) School of Communication and Information Engineering, Shanghai University(上海大学通信与信息工程学院)

专题命中 VLA模型 :vision-language-action(title,abstract);VLA(title,abstract);action model(title);分类 cs.RO、cs.AI

AI总结 本文提出ETA-VLA框架,通过时间融合和内在LLM稀疏化技术,减少视觉-语言-动作模型的计算负担,实验表明在保持高精度的同时,显著降低计算量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26666 2026-03-30 cs.RO 91%

VLA-OPD: Bridging Offline SFT and Online RL for Vision-Language-Action Models via On-Policy Distillation

VLA-OPD: 通过在线策略蒸馏连接离线SFT与在线RL以构建视觉-语言-动作模型

Zhide Zhong, Haodong Yan, Junfeng Li, Junjie He, Tianran Zhang, Haoang Li

专题命中 VLA模型 :vision-language-action(title,abstract);VLA(title,abstract);action model(title);分类 cs.RO

AI总结 本文提出VLA-OPD框架,通过在线策略蒸馏结合离线SFT与在线RL,解决预训练模型在部署中的分布偏移和灾难性遗忘问题,提升样本效率与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26360 2026-03-30 cs.RO 79%

Realtime-VLA V2: Learning to Run VLAs Fast, Smooth, and Accurate

Realtime-VLA V2:学习以快速、平滑和准确地运行VLAs

Chen Yang, Yucheng Hu, Yunchao Ma, Yunhuan Yang, Jing Tan, Haoqiang Fan

专题命中 VLA模型 :VLA(title,abstract);分类 cs.RO

AI总结 本文提出Realtime-VLA V2,通过校准、规划与控制及学习方法,实现机器人在真实任务中高速、高精度和高灵活性的VLAs运行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14804 2026-03-30 astro-ph.HE 50%

Cosmic ray mass composition measurement in the energy range from $10^{16.5}$ eV to $10^{18.5}$ eV observed with the TALE hybrid detector

在10^16.5 eV到10^18.5 eV能量范围内用TALE混合探测器测量宇宙射线质量组成

Telescope Array Collaboration, R. U. Abbasi, T. Abu-Zayyad, M. Allen, J. W. Belz, D. R. Bergman, F. Bradfield, I. Buckland, W. Campbell, B. G. Cheon, K. Endo, A. Fedynitch, T. Fujii, K. Fujisue, K. Fujita, M. Fukushima, G. Furlich, A. Gálvez Ureña, Z. Gerber, N. Globus, T. Hanaoka, W. Hanlon, N. Hayashida, H. He, K. Hibino, R. Higuchi, D. Ikeda, D. Ivanov, S. Jeong, C. C. H. Jui, K. Kadota, F. Kakimoto, O. Kalashev, K. Kasahara, Y. Kawachi, K. Kawata, I. Kharuk, E. Kido, H. B. Kim, J. H. Kim, J. H. Kim, S. W. Kim, R. Kobo, I. Komae, K. Komatsu, K. Komori, A. Korochkin, C. Koyama, M. Kudenko, M. Kuroiwa, Y. Kusumori, M. Kuznetsov, Y. J. Kwon, K. H. Lee, M. J. Lee, B. Lubsandorzhiev, J. P. Lundquist, H. Matsushita, A. Matsuzawa, J. A. Matthews, J. N. Matthews, K. Mizuno, M. Mori, S. Nagataki, K. Nakagawa, M. Nakahara, H. Nakamura, T. Nakamura, T. Nakayama, Y. Nakayama, K. Nakazawa, T. Nonaka, S. Ogio, H. Ohoka, N. Okazaki, M. Onishi, A. Oshima, H. Oshima, S. Ozawa, I. H. Park, K. Y. Park, M. Potts, M. Przybylak, M. S. Pshirkov, J. Remington, C. Rott, G. I. Rubtsov, D. Ryu, H. Sagawa, N. Sakaki, R. Sakamoto, T. Sako, N. Sakurai, S. Sakurai, D. Sato, K. Sekino, T. Shibata, J. Shikita, H. Shimodaira, H. S. Shin, K. Shinozaki, J. D. Smith, P. Sokolsky, B. T. Stokes, T. A. Stroman, H. Tachibana, K. Takahashi, M. Takeda, R. Takeishi, A. Taketa, M. Takita, Y. Tameda, K. Tanaka, M. Tanaka, M. Teramoto, S. B. Thomas, G. B. Thomson, P. Tinyakov, I. Tkachev, T. Tomida, S. Troitsky, Y. Tsunesada, S. Udo, F. R. Urban, M. Vrábel, D. Warren, K. Yamazaki, Y. Zhezher, Z. Zundel, J. Zvirzdin

专题命中 VLA模型 :action model(abstract)

AI总结 TALE混合探测器在10^16.5 eV至10^18.5 eV能量范围内测量宇宙射线质量组成,发现随着能量增加,平均X_max斜率出现转折,表明银河系到超银河系宇宙射线源的转变。

Comments Accepted for publication in Phys. Rev. D, 24 pages, 23 figures, 4 tables

Journal ref Phys. Rev. D 113, 062003 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 动作表示与策略 2 篇

2509.15219 2026-03-30 cs.CV cs.LG cs.MA cs.MM cs.RO 75%

Out-of-Sight Embodied Agents: Multimodal Tracking, Sensor Fusion, and Trajectory Forecasting

视线外的具身智能体:多模态跟踪、传感器融合与轨迹预测

Haichao Zhang, Yi Xu, Yun Fu

机构 * Department of Electrical and Computer Engineering, Northeastern University(东北大学电气与计算机工程系) Khoury College of Computer Sciences, Northeastern University(东北大学库里计算机科学学院)

专题命中 动作表示与策略 :vision-language-action(abstract);action model(abstract);分类 cs.RO、cs.CV、cs.LG

AI总结 本文提出改进的视线外轨迹预测方法,通过视觉定位去噪模块提升轨迹预测性能,实验表明在Vi-Fi和JRDB数据集上达到最优效果,为自动驾驶、机器人和监控提供新方向。

Comments Published in IEEE Transactions on Pattern Analysis and Machine Intelligence (Early Access), pp. 1-14, March 23, 2026

Journal ref IEEE Transactions on Pattern Analysis and Machine Intelligence, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26322 2026-03-30 cs.RO 70%

DiffusionAnything: End-to-End In-context Diffusion Learning for Unified Navigation and Pre-Grasp Motion

DiffusionAnything: 端到端的上下文扩散学习用于统一导航和预抓取运动

Iana Zhura, Yara Mahmoud, Jeffrin Sam, Hung Khang Nguyen, Didar Seyidov, Miguel Altamirano Cabrera, Dzmitry Tsetserukou

机构 * Intelligent Space Robotics Laboratory, Center for Digital Engineering, Skolkovo Institute of Science and Technology(斯科尔科沃科学技术学院数字工程中心智能空间机器人实验室)

专题命中 动作表示与策略 :vision-language-action(abstract);VLA(abstract);分类 cs.RO

AI总结 本文提出一种端到端的上下文扩散学习方法,通过多尺度特征调制实现统一的导航与精细操控,仅需5分钟自监督数据即可实现零样本泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 数据集与评测 1 篇

2603.26378 2026-03-30 cs.LG cs.AI 62%

Generative Modeling in Protein Design: Neural Representations, Conditional Generation, and Evaluation Standards

蛋白质设计中的生成建模:神经表示、条件生成与评估标准

Senura Hansaja Wanasekara, Minh-Duong Nguyen, Xiaochen Liu, Nguyen H. Tran, Ken-Tye Yong

机构 * The University of Sydney(悉尼大学) VinUniversity

专题命中 数据集与评测 :action model(abstract);分类 cs.AI、cs.LG

AI总结 本文系统综述了蛋白质研究中的生成AI,涵盖序列、几何和多模态表示,生成架构如SE(3)等价扩散、流匹配和混合预测生成系统,以及从结构预测到蛋白质-配体相互作用的任务设置,并提出评估最佳实践和开放挑战。

Comments 20 pages, 7 tables, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏