arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2026-04-24 至 2026-04-24 共收录 8 信号源:cs.RO, cs.CV, cs.AI, cs.LG

1. VLA模型 6 篇

2604.03956 2026-04-24 cs.CV cs.AI 94%

VLA-Forget: Vision-Language-Action Unlearning for Embodied Foundation Models

VLA-Forget:面向具身基础模型的视觉-语言-动作去学习

Ravi Ranjan, Agoritsa Polyzou

机构 * Florida International University(佛罗里达国际大学)

专题命中 VLA模型 :VLA(title,title_cn);vision-language-action(title,abstract);embodied foundation model(title,abstract);分类 cs.CV、cs.AI

AI总结 本文提出VLA-Forget框架,通过结合感知选择性编辑与层选择性推理去学习,提升去学习效果,保留感知特性和推理能力,减少量化恢复。

Comments 18 pages, 9 figures, Accepted to ACL-2026, KnowFM

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20100 2026-04-24 cs.RO 81%

JoyAI-RA 0.1: A Foundation Model for Robotic Autonomy

JoyAI-RA 0.1:一种用于机器人自主性的基础模型

Tianle Zhang, Zhihao Yuan, Dafeng Chi, Peidong Liu, Dongwei Li, Kejun Hu, Likui Zhang, Junnan Nie, Ziming Wei, Zengjue Chen, Yili Tang, Jiayi Li, Zhiyuan Xiang, Mingyang Li, Tianci Luo, Hanwen Wan, Ao Li, Linbo Zhai, Zhihao Zhan, Xiaodong Bai, Jiakun Cai, Peng Cao, Kangliang Chen, Siang Chen, Yixiang Dai, Shuai Di, Yicheng Gong, Chenguang Gui, Yucheng Guo, Peng Hao, Qingrong He, Haoyang Huang, Kunrui Huang, Zhixuan Huang, Shibo Jin, Yixiang Jin, Anson Li, Dongjiang Li, Jiawei Li, Ruodai Li, Yihang Li, Yuzhen Li, Jiaming Liang, Fangsheng Liu, Jing Long, Mingxi Luo, Xing Pan, Hui Shen, Xiaomeng Tian, Daming Wang, Song Wang, Junwu Xiong, Hang Xu, Wanting Xu, Zhengcheng Yu, He Zhang, Jiyao Zhang, Lin Zhao, Chen Zhou, Nan Duan, Yuzheng Zhuang, Liang Lin

机构 * Joy Future Academy(京东探索研究院)

专题命中 VLA模型 :VLA(abstract,abstract_cn);vision-language-action(abstract);embodied foundation model(abstract);分类 cs.RO

AI总结 本文提出JoyAI-RA,一种面向通用机器人操作的视觉-语言-动作基础模型,通过多源多层级预训练框架提升跨身体行为学习能力,在仿真和现实任务中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21138 2026-04-24 cs.RO cs.AI 73%

Navigating the Clutter: Waypoint-Based Bi-Level Planning for Multi-Robot Systems

在杂乱中导航:基于路标的目标级规划用于多机器人系统

Jiabao Ji, Yongchao Chen, Yang Zhang, Ramana Rao Kompella, Chuchu Fan, Gaowen Liu, Shiyu Chang

机构 * UC Santa Barbara(加州大学圣芭芭拉分校) Massachusetts Institute of Technology(麻省理工学院) Harvard University(哈佛大学) MIT-IBM Watson AI Lab(MIT-IBM沃森人工智能实验室) Cisco Research(思科研究)

专题命中 VLA模型 :VLA(abstract,abstract_cn);分类 cs.RO、cs.AI

AI总结 本文提出了一种混合多机器人控制框架,通过引入路标和课程训练策略,解决多机器人任务和运动规划的联合优化问题,提升了任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21559 2026-04-24 astro-ph.IM astro-ph.SR 50%

Diffraction in the ASPIICS coronagraph: observations and modeling

ASPIICS日冕仪中的衍射:观测与建模

S. Shestov, A. N. Zhukov, R. Rougeot, C. Aime, B. Bourgoignie, L. Dolla, N. Britavskiy, S. Fineschi, S. Gunar, P. Lamy, M. Mierla, H. Peter, P. Rudawy, K. Tsinganos

专题命中 VLA模型 :action model(abstract)

AI总结 研究ASPIICS日冕仪中衍射效应,通过观测与分析模型对比,验证模型并估计衍射光贡献,结果显示大部分视场内衍射光强度低于日冕信号。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17657 2026-04-24 hep-ph hep-ex 50%

Sequential Y(nS) suppression in high-multiplicity pp collisions: the experimental case for an early, globally correlated medium

高多重性pp碰撞中序列Y(nS)抑制:实验案例中的早期全局相关介质

Renato Campanini

专题命中 VLA模型 :action model(abstract)

AI总结 研究高多重性pp碰撞中Y(nS)和ψ(2S)/J/ψ的抑制现象,通过四个多微分测试揭示早期全局相关介质的特征。

Comments 18 pages,8 figures.v2: significance values in the sphericity section replaced , Bjorken energy-density section replaced by a model-independent ; azimuthal-sector discussion extended to highlight the transverse sector as the most diagnostic; cone-isolation argument restated in model-independent form without Cornell radii. Physics arguments and experimental results unchanged

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13011 2026-04-24 gr-qc 50%

Buchdahl Limit and TOV Equations in Interacting Vacuum Scenarios

Buchdahl 限制与相互作用真空情景中的 TOV 方程

Rodrigo Maier

专题命中 VLA模型 :action model(abstract)

AI总结 研究相互作用真空成分下超致密恒星配置的稳定性,通过扩展 TOV 方程引入流体与真空部分的协变能量交换,探讨 Buchdahl 稳定性限制的修改,分析两种现象学相互作用模型,发现相互作用项可缓解压力梯度并保持有限中心压力。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 数据集与评测 1 篇

2604.05320 2026-04-24 cs.RO 57%

ExpressMM: Expressive Mobile Manipulation Behaviors in Human-Robot Interactions

ExpressMM: 人机交互中的表达性移动 manipulation 行为

Souren Pashangpour, Haitong Wang, Matthew Lisondra, Goldie Nejat

机构 * Autonomous Systems and Biomechatronics Laboratory(自主系统与生物机械实验室) Department of Mechanical and Engineering(机械与工程系) University of Toronto(多伦多大学)

专题命中 数据集与评测 :vision-language-action(abstract);分类 cs.RO

AI总结 本文提出ExpressMM框架,结合视觉语言模型和低层策略生成表达性机器人行为,支持中断交互,提升人机协作任务中的沟通效果与社会适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 部署与泛化 1 篇

2604.21192 2026-04-24 cs.RO cs.AI 73%

How VLAs (Really) Work In Open-World Environments

视觉-语言-动作模型(VLAs)在开放世界环境中的实际运作方式

Amir Rasouli, Yangzheng Wu, Zhiyuan Li, Rui Heng Yang, Xuan Zhao, Charles Eret, Sajjad Pakdamansavoji

机构 * Noah’s Ark Laboratory, Huawei Technologies Canada(华为加拿大技术有限公司诺亚实验室)

专题命中 部署与泛化 :vision-language-action(abstract);action model(abstract);分类 cs.RO、cs.AI

AI总结 本文探讨了VLAs在开放世界环境中的实际运作,指出现有评估方法可能忽视安全性问题,并提出改进的评估协议以更准确衡量复杂交互场景中的性能。

Comments 8 pages, 7 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏