arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

世界模型

面向环境建模、时序预测、仿真规划、具身智能和自动驾驶的世界模型方法与应用。

2026-07-09 至 2026-07-09 共收录 5 信号源:cs.AI, cs.LG, cs.CV, cs.RO, cs.MA

1. 通用世界模型 3 篇

2607.07196 2026-07-09 cs.RO cs.AI cs.LG cs.SE 新提交 91%

Validate the Dream Before You Trust Its Verdict: Admissibility for World-Model Simulators

在信任世界模型模拟器的裁决之前先验证其可靠性:世界模型模拟器的可接受性

Christian Oefinger, Finn Rasmus Schäfer, Korbinian Moller, Mattia Piccinini, Johannes Betz

机构 * Autonomous Vehicle Systems Lab(自主车辆系统实验室) Technical University of Munich(慕尼黑技术大学)

专题命中 通用世界模型 :world-model(title);world-model(title);world model(abstract,comments);world models(abstract,comments)

AI总结 研究世界模型模拟器裁决的可靠性问题,基于安全关键模拟的可信度实践定义可接受性阶梯,通过自动驾驶实例验证,指出视觉保真度不能预测行动稳健性,为世界模型模拟器的评估提供了新框架。

Comments Accepted at RSS 2026 Workshop on Robot World Models

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06925 2026-07-09 cs.AI 新提交 90%

Grounding Spatial Relations in a Compact World Model: Instruction Leakage and a Goal-Free Dynamics Fix

在紧凑世界模型中建立空间关系:指令泄漏与无目标动力学修复

Yufeng Wang, Lu Wei, Haibin Ling

机构 * Stony Brook University(纽约州立大学石溪分校) Westlake University(西湖大学)

专题命中 通用世界模型 :world model(title,abstract);world model(title,abstract);world models(abstract);world models(abstract)

AI总结 研究以语言目标为条件的紧凑世界模型中空间关系建立问题,发现指令泄漏陷阱,提出将目标排除在动力学外并监督读取路径的修复方法,适用于相关世界模型,提升关系基础的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06640 2026-07-09 cs.LG cs.AI 新提交 88%

The Rank-One Corner: How Much Value Equivalence Does a Task Need from a World Model?

一阶角:任务从世界模型中需要多少价值等价性?

Donna Vakalis

机构 * Mila – Quebec AI Institute(米拉-魁北克人工智能研究所) Université de Montréal(蒙特利尔大学)

专题命中 通用世界模型 :world model(title,abstract);world model(title,abstract);分类 cs.AI、cs.LG

AI总结 研究任务从世界模型中所需的价值等价性,通过在DreamerV3堆栈上测量发现,潜在因素代表的闭包由训练目标维度决定,价值等价具维度性,单奖励目标是其一阶角,模型安装的任务结构与预测目标相关。

Comments 22 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身与机器人 1 篇

2607.06706 2026-07-09 cs.RO cs.AI cs.LG 新提交 83%

Vision Language Action (VLA) Models for Unmanned Aerial Robotics and Bimanual Manipulation: A Review

用于无人机机器人和双手操作的视觉语言动作(VLA)模型综述

Inkyu Sa, Chanoh Park, Hea-Min Lee, Donghee Noh, Ho Seok Ahn

机构 * Chef Robotics RovifyLab IT Application Research Center, Jeonbuk Regional Branch Department of Electrical, Computer and Software Engineering(电气与计算机软件工程系)

专题命中 具身与机器人 :world model(abstract);world models(abstract);world model(abstract);world models(abstract)

AI总结 综述2017 - 2026年183篇文献,围绕视觉语言动作模型在无人机机器人和双手操作方面的应用,涵盖多维度,表明双手VLA相关策略可转移至无人机系统,还确定了两领域的14个研究方向。

Comments 56 pages, 11 figures, 16 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 仿真与规划 1 篇

2607.07534 2026-07-09 cs.CV 新提交 69%

Infinite Worlds with Versatile Interactions

具有通用交互的无限世界

Zelin Gao, Qiuyu Wang, Jiapeng Zhu, Jingye Chen, Zichen Liu, Qingyan Bai, Jiahao Wang, Yufeng Yuan, Hanlin Wang, Yichong Lu, Ka Leong Cheng, Haojie Zhang, Jian Gao, Tianrui Feng, Yuzheng Liu, Yao Yao, Yinghao Xu, Xing Zhu, Yujun Shen, Hao Ouyang

专题命中 仿真与规划 :world model(abstract);world model(abstract);分类 cs.CV

AI总结 介绍LingBot-World 2.0的升级,包括通过因果预训练实现无界交互、提炼实时变体保证快速响应,引入多样交互元素,集成智能控制并开发共享界面,还将主模型与轻量级模型配对便于单GPU部署。

Comments Project page: https://technology.robbyant.com/lingbot-world-v2 Code: https://github.com/robbyant/lingbot-world-v2

详情

展开后加载摘要…

URL PDF HTML 收藏