arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2026-07-01 至 2026-07-01 共收录 2 信号源:cs.RO, cs.CV, cs.AI, cs.LG

1. 机器人基础模型 2 篇

2606.31958 2026-07-01 cs.RO 新提交 70%

Adapting Generalist Robot Policies with Semantic Reinforcement Learning

基于语义强化学习的通用机器人策略自适应

Jagdeep Singh Bhatia, Andrew Wagenmaker, William Chen, Sergey Levine

机构 * U.C. Berkeley(加州大学伯克利分校)

专题命中 机器人基础模型 :VLA(abstract,abstract_cn);分类 cs.RO

AI总结 提出语义动作强化学习(SARL),通过在线交互优化语言提示空间,利用通用策略的预训练技能解决复杂长时任务,显著优于现有方法。

Comments Website: https://semantic-action-rl.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28529 2026-07-01 cs.RO cs.AI cs.CV 版本更新 67%

The Speedup Paradox: Rethinking Inference Speed-Quality Trade-off in Embodied Tasks

加速悖论:具身任务中推理速度与质量权衡的再思考

Yujin Wang, Junli Chen, Yixuan Li, Shunan Dong, Huazhong Yang, Yongpan Liu, Hongyang Jia

机构 * Tsinghua University(清华大学)

专题命中 机器人基础模型 :embodied foundation model(abstract);分类 cs.RO、cs.CV、cs.AI

AI总结 提出TISED分析框架,揭示具身任务中推理加速技术对任务级性能的悖论效应:静态任务中可能延长完成时间,动态任务中适度优化可提升成功率,且效果受硬件配置影响。

Comments 23 pages

详情

展开后加载摘要…

URL PDF HTML 收藏