arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-08-14 至 2026-08-14 共收录 3 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人基础模型 3 篇

2608.13453 2026-08-14 cs.CV cs.AI 新提交 79%

UniTexture: Cross-Task Universal Adversarial Textures for Vision-Language-Action Models

UniTexture:面向视觉-语言-动作模型的跨任务通用对抗纹理

Yukun Dai, Mingzhe Dai, Tianshi Wang, Fengling Li, Jingjing Li, Lei Zhu

专题命中 机器人基础模型 :embodied agent(abstract);manipulation(abstract);robotic(abstract);分类 cs.AI、cs.CV

AI总结 该研究提出UniTexture跨任务通用对抗纹理攻击,通过单个带纹理3D物体诱导VLA动作预测偏差,在OpenVLA等模型上可显著降低任务成功率,且具备跨套件与跨模型迁移性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29699 2026-08-14 cs.CV cs.AI cs.RO 版本更新 67%

Early Warning Signals for OpenVLA Failure under Visual Distribution Shift

视觉分布偏移下OpenVLA故障的早期预警信号

Dipesh Tharu Mahato, Rachel Ren

机构 * New York University(纽约大学)

专题命中 机器人基础模型 :manipulation(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 研究在视觉分布偏移下,OpenVLA内部激活是否包含可线性解码的近期任务失败信息,通过LIBERO操作实验发现第16层逻辑探针在遮挡条件下预测失败AUROC达0.972。

Comments 16 pages, 2 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13474 2026-08-14 cs.RO 新提交 57%

Decoding Task Progress from VLA Representations

从视觉-语言-动作模型(VLA)表征中解码任务进度

Atiksh Bhardwaj, Edward Weiyi Duan, Prithwish Dan, Wei-Chiu Ma, Preston Culbertson

机构 * Cornell University(康奈尔大学)

专题命中 机器人基础模型 :manipulation(abstract);分类 cs.RO

AI总结 该研究利用机制可解释性探究VLA的π₀.₅残差流,发现任务进度可从激活值线性读取,基于此构建的探测器可作为无标签OOD检测器,性能接近最先进方法,为监控部署的视觉运动策略提供轻量可解释路径。

详情

展开后加载摘要…

URL PDF HTML 收藏