arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2026-06-12 至 2026-06-12 共收录 6 信号源:cs.RO, cs.CV, cs.AI, cs.LG

1. VLA模型 5 篇

2602.04208 2026-06-12 cs.RO cs.AI cs.LG 版本更新 92%

SCALE: Self-uncertainty Conditioned Adaptive Looking and Execution for Vision-Language-Action Models

SCALE: 基于自不确定性条件自适应观察与执行的视觉-语言-动作模型

Hyeonbeom Choi, Daechul Ahn, Youhan Lee, Taewook Kang, Seongwon Cho, Jonghyun Choi

机构 * Seoul National University(首尔国立大学)

专题命中 VLA模型 :VLA(summary_cn,abstract);vision-language-action(title,abstract);action model(title);分类 cs.RO、cs.AI、cs.LG

AI总结 提出SCALE推理策略,利用自不确定性联合调节视觉感知和动作,无需额外训练或验证器,仅单次前向传播,提升VLA模型在模拟和真实环境中的鲁棒性。

Comments ICML 2026 Spotlight. Project page: https://dcahn12.github.io/projects/scale/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16013 2026-06-12 cs.RO cs.SE 版本更新 91%

Safety Case Patterns for VLA-based driving systems: Insights from SimLingo

基于VLA的驾驶系统的安全案例模式:来自SimLingo的见解

Gerhard Yu, Fuyuki Ishikawa, Oluwafemi Odu, Alvine Boaye Belle

机构 * York University(约克大学) National Institute of Informatics(国家信息研究所)

专题命中 VLA模型 :VLA(title,title_cn);vision-language-action(abstract);分类 cs.RO

AI总结 针对VLA驾驶系统提出RAISE安全案例设计方法,通过扩展HARA和定制模式,结合SimLingo案例验证其构建基于证据的安全声明的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06370 2026-06-12 nucl-th 版本更新 71%

New approach for the quantification of uncertainties in reaction modeling via data-driven multi-objective optimization

通过数据驱动的多目标优化量化反应建模中不确定性的新方法

N. Dimitrakopoulos, G. Perdikakis, F. Montes, P. Gastis, S. A. Kuvin, H. Y. Lee, P. Tsintari, A. V. Voinov

专题命中 VLA模型 :action model(title)

AI总结 提出一种多目标优化方法,在Hauser-Feshbach框架下同时考虑多通道数据,量化核反应参数的不确定性,并在Ni-Ge区域验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01763 2026-06-12 astro-ph.GA astro-ph.IM 版本更新 67%

When the Shadow Meets Its Measure: Assessing the Feasibility of Submillimeter Black Hole Shadow Imaging in Megamaser Disk AGN

当阴影遇到其尺度:评估巨脉泽盘活动星系核中亚毫米黑洞阴影成像的可行性

Roman N. Burridge, Geoffrey C. Bower

专题命中 VLA模型 :VLA(abstract,abstract_cn)

AI总结 本文评估了利用水巨脉泽盘活动星系核进行亚毫米黑洞阴影成像的可行性,发现仅NGC 4258在地球-L2基线上可分辨,且自旋偏移测量因脉泽天体测量精度不足而不可行。

Comments 25 pages, 7 figures, 9 tables. Revised version with updated 230 GHz flux standardization, astrometric feasibility analysis for NGC 4258, mass/distance/inclination treatment, references, and machine-readable table description

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13718 2026-06-12 astro-ph.CO 版本更新 50%

Optical depth to reionization in a Universe with multiple inhomogeneous domains

具有多个非均匀域宇宙中的再电离光学深度

Shashank Shekhar Pandey, Ruchika, Subhadeep Mukherjee, A. S. Majumdar

专题命中 VLA模型 :action model(abstract)

AI总结 利用Buchert平均形式主义,研究包含物质不均匀性反馈的宇宙学设置中的再电离光学深度,通过多域模型参数化并使用PantheonPlus+SH0ES超新星样本进行MCMC分析,得到τ_reion=0.0581,更接近观测估计,并适度缓解哈勃张力。

Comments 20 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 部署与泛化 1 篇

2510.03896 2026-06-12 cs.CV cs.RO 版本更新 62%

GAE: Unleashing Physical Potential of VLM with Generalizable Action Expert

GAE: 利用可泛化动作专家释放VLM的物理潜力

Mingyu Liu, Zheng Huang, Xiaoyi Lin, Muzhi Zhu, Canyu Zhao, Yating Wang, Haoyi Zhu, Hao Chen, Chunhua Shen

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学)

专题命中 部署与泛化 :vision-language-action(abstract);分类 cs.RO、cs.CV

AI总结 提出通用动作专家(GAE),通过稀疏几何接口将VLM的高层意图转化为连续动作轨迹,采用动作预训练-点云微调(APPF)方案解耦动作动力学与几何基础,实现跨视觉域、视角和指令的强泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏