arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-06-01 至 2026-06-01 共收录 107 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 33 篇

2602.14441 2026-06-01 cs.CV 57%

D-SECURE: Dual-Source Evidence Combination for Unified Reasoning in Misinformation Detection

D-SECURE:用于虚假信息检测中统一推理的双源证据融合

Samudi Amarasinghe, Gagandeep Singh, Priyanka Singh

机构 * School of Information Technology(信息科技学院) Electrical Engineering The University of Queensland, Brisbane, Australia(电气工程学院,昆士兰大学,布里斯班,澳大利亚)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 提出D-SECURE框架,通过融合内部篡改检测(HAMMER)和外部证据检索(DEFAME)实现多模态虚假新闻的统一推理与可解释报告。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31230 2026-06-01 physics.app-ph 50%

Hydrogel microwells with light-controlled reversible closure

具有光控可逆闭合功能的水凝胶微孔

Qifei Ma, David Urban, Stefano Gabetti, Beatrice Masante, Huaizhou Jin, Federica Galvagno, Diana Massai, Alberto Puliafito, Shangzhong Jin, Denis Garoli, Emiliano Descrovi

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究提出一种光响应水凝胶纳米复合材料,通过激光照射实现微米级孔的选择性、顺序性闭合与重新打开,用于无接触按需捕获和释放微尺度物体。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31083 2026-06-01 physics.acc-ph 50%

Attosecond Compression of Relativistic Electron Pulses via Continuous Harmonic Undulator Resonance

通过连续谐波波荡器共振实现相对论电子脉冲的阿秒压缩

Hao Sun, Xiaofan Wang, Xiaozhe Shen, Huaiqian Yi, Cheng-Ying Tsai, Weiqing Zhang, Xueming Yang

专题命中 机器人操作 :manipulation(abstract)

AI总结 提出一种广义谐波激光-电子相互作用机制,利用单周期波荡器中的非整数谐波调制实现阿秒压缩,同时保持束流质量和定时稳定性,为阿秒MeV UED提供可行途径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30933 2026-06-01 physics.optics 50%

Transformation of a three-tone phase modulated CW laser field into sequence of short pulses

三音相位调制连续波激光场到短脉冲序列的变换

Rustem Shakhmuratov

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文通过相位操作光谱成分,将周期相位调制的连续波激光场转换为傅里叶极限脉冲,采用正弦模函数相位调制实现无基座、可调重复率和占空比的脉冲,并可通过选择调制指数消除旁瓣。

Comments 8 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30521 2026-06-01 cs.CL 50%

Evaluating using Mock Tool Calls to Quarantine Untrusted Prompt Inputs

评估使用模拟工具调用隔离不可信提示输入

David Gros, Adam Gleave

专题命中 机器人操作 :manipulation(abstract)

AI总结 通过自动化红队测试,研究将不可信内容包装在模拟工具调用中作为隔离措施是否能提高大语言模型的鲁棒性,发现该方法通常无效甚至有害。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.07875 2026-06-01 physics.optics 50%

Deep-subwavelength engineering of stealthy hyperuniformity

深度亚波长尺度的隐形超均匀性工程

Jusung Park, Seungkyun Park, Kyuho Kim, Jeonghun Kwak, Sunkyu Yu, Namkyoo Park

专题命中 机器人操作 :manipulation(abstract)

AI总结 通过隐形超均匀性概念,在深度亚波长尺度上设计无序多层膜,实现波局域的角度选择性操控。

Comments 32 pages, 4 figures, 3 supplementary figures

Journal ref Nanophotonics 14, 1113 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.12715 2026-06-01 math.PR math-ph math.MP 50%

On positively divisible non-Markovian processes

关于正可分的非马尔可夫过程

Bilal Canturk, Heinz-Peter Breuer

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文研究转移矩阵满足Chapman-Kolmogorov方程的正可分非马尔可夫过程,结合Kolmogorov一致性条件推导出有限样本空间上正可分随机过程的必要条件,并给出构造示例及Feller经典例子的分析。

Comments 14 pages, 1 figure

Journal ref J. Phys. A: Math. Theor. 57 265006, (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身导航 19 篇

2605.31314 2026-06-01 cs.RO 88%

AR Forcing: Towards Long-Horizon Robot Navigation World Model

AR Forcing: 迈向长时域机器人导航世界模型

Yifei Yang, Zehua Fan, Huan Li, Aoqi Wang, Lida Huang, Haibao Yu, Haiyan Liu, Xuanyao Mao, Jason Bao, Liang Xu, Bingchuan Sun, Yan Wang

机构 * Institute for AI Industry Research, Tsinghua University(清华大学人工智能产业研究院) Shanghai Jiao Tong University(上海交通大学) School of Safety Science, Tsinghua University(清华大学安全科学学院) The University of Hong Kong(香港大学) Lenovo, Beijing, China(北京联想公司)

专题命中 具身导航 :navigation(title,abstract);world model(title,abstract);分类 cs.RO

AI总结 提出AR Forcing自回归训练策略,通过将扩散损失集成到自回归训练循环中,解决训练与推理分布偏移问题,提升长时域导航中图像一致性和轨迹预测精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31404 2026-06-01 cs.CL cs.AI 83%

The Sword, Shield, and Achilles' Heel: Characterizing the Linguistic Inductive Bias of Large Language Models for Spatial Reasoning in Navigation Planning

剑、盾与阿喀琉斯之踵:大型语言模型在导航规划中空间推理的语言归纳偏置特征化

Xudong Zhang, Jian Yang, Shengkai Wang, Jiangpeng Tian, Shaowen Chen, Xian Wei, Ke Li, Xiong You

机构 * East China Normal University(东华大学) Information Engineering University(信息工程大学) Zhengzhou University(郑州大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI

AI总结 提出双干预框架,通过表示干预和上下文干预分离语言结构与上下文线索,揭示LLM在导航规划中语言归纳偏置的规律:拓扑信息是稳健规划的支柱,语言格式是双刃剑,语义信息是致命弱点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19452 2026-06-01 cs.RO cs.CV cs.LG 82%

HUNT: High-Speed UAV Navigation and Tracking in Unstructured Environments via Instantaneous Relative Frames

HUNT:通过瞬时相对帧在非结构化环境中进行高速无人机导航与跟踪

Alessandro Saviolo, Jeffrey Mao, Giuseppe Loianno

机构 * New York University(纽约大学) University of California Berkeley(加州大学伯克利分校)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV、cs.LG

AI总结 提出HUNT框架,利用瞬时相对帧统一搜索与跟踪,实现高速飞行和鲁棒自主性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21168 2026-06-01 cs.RO cs.SY eess.SY 80%

TAGA: A Tangent-Based Reactive Approach for Socially Compliant Robot Navigation Around Human Groups

TAGA:一种基于切线的反应式方法,用于在人群体周围实现社交合规的机器人导航

Utsha Kumar Roy, Sejuti Rahman

机构 * Department of Computer Science and Engineering, BRAC University(布拉格大学计算机科学与工程系) New Uzbekistan University(新乌兹别克斯坦大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO;robotics(comments)

AI总结 提出TAGA方法,通过切线路径检测群体边界并协调群体与个体避障,引入群体穿越率(GCR)指标,在多种人群动力学模型下验证了反应式与学习型方法的非对称性效果。

Comments 8 pages, 3 figures, 3 tables. Submitted to IEEE Robotics and Automation Letters (RA-L)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30468 2026-06-01 cs.RO 79%

Learning-Based Navigation for Indoor Mobile Robots

基于学习的室内移动机器人导航

Tri-Tin Nguyen, Tien-Dat Nguyen, Gia-Uy Le, Vinh Nguyen, Vinh-Hao Nguyen

机构 * Faculty of Electrical Electronic Engineering, Ho Chi Minh City University of Technology, VNU-HCM Ho Chi Minh City, Vietnam

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 提出一种结合监督学习全局规划器与基于学习的DWA局部规划器的导航框架,通过行为克隆和PPO优化实现安全避障导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26304 2026-06-01 cs.RO 79%

Collaborative Navigation and Exploration with $β$-Sparse Gaussian Processes

基于$β$-稀疏高斯过程的协作导航与探索

Evangelos Psomiadis, Dipankar Maity, Panagiotis Tsiotras

机构 * D. Guggenheim School of Aerospace Engineering, Georgia Tech, Atlanta, GA, USA(佐治亚理工学院D.Guggenheim航空航天工程学院) Department of Electrical and Computer Engineering, UNC Charlotte, Charlotte, NC, USA(北卡罗来纳大学夏洛特分校电气与计算机工程系)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 针对异构机器人在未知环境中的协作导航问题,提出一种利用$β$-稀疏高斯过程进行带宽受限下地图点选择和导航动作联合优化的框架,显著降低路径代价和传输信息量。

Comments 16 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12686 2026-06-01 cs.RO 79%

SignScene: Visual Sign Grounding for Mapless Navigation

SignScene: 用于无地图导航的视觉标志接地

Nicky Zimmerman, Joel Loo, Benjamin Koh, Zishuo Wang, David Hsu

机构 * Smart Systems Institute, National University of Singapore, 3 Research Link, 117602, Singapore.(新加坡国立大学智能系统研究所) School of Computing, National University of Singapore, 13 Computing Drive, 117417, Singapore.(新加坡国立大学计算机学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 提出SignScene,一种以标志为中心的空间语义表示方法,利用视觉语言模型将标志的语义指令与场景元素和导航动作对应,实现无地图导航,在114个查询中达到88%的接地准确率。

Comments Under review for a conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28442 2026-06-01 cs.RO cs.CV 73%

Self-Supervised Online Robot-Agnostic Traversability Estimation for Open-World Environments

面向开放世界的自监督在线机器人无关可通行性估计

Julia Hindel, Simon Bultmann, Houman Masnavi, Daniele Cattaneo, Abhinav Valada

机构 * Department of Computer Science, University of Freiburg(弗赖堡大学计算机科学系)

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 提出COTRATE框架,通过自监督在线学习从多模态未标记机器人经验中估计可通行性,采用机器人无关的地形评估模块和多样性感知特征选择策略,实现跨平台知识迁移并降低遗忘。

Comments 14 pages, 16 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30617 2026-06-01 cs.RO math.OC 72%

Exploiting Chordal Sparsity for Globally Optimal Estimation with Factor Graphs

利用弦稀疏性实现因子图的全局最优估计

Avinash Subramanian, Connor Holmes, Timothy D. Barfoot, Frank Dellaert, Frederike Dümbgen

机构 * College of Computing, Georgia Institute of Technology(佐治亚理工学院计算机学院) Robotics Institute, University of Toronto(多伦多大学机器人研究所) Department of Mechanical Engineering, Carnegie Mellon University(卡内基梅隆大学机械工程系)

专题命中 具身导航 :robotics(abstract,journal_ref);navigation(abstract);分类 cs.RO

AI总结 本文提出在GTSAM框架中自动构建凸半定规划松弛,并利用贝叶斯树分解加速求解,实现因子图的全局最优估计。

Journal ref ICRA 2026 WORKSHOP ON FRONTIERS OF OPTIMIZATION FOR ROBOTICS

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31376 2026-06-01 cs.RO cs.CV cs.GR 62%

LiftNav: Path Planning via Semantic Lifting in TSDF-Guided Gaussian Splatting

LiftNav: TSDF引导的高斯泼溅中的语义提升路径规划

Hannah Schieber, Dominik Frischmann, Victor Schaack, Angela P. Schoellig, Daniel Roth

机构 * Technical University of Munich(慕尼黑技术大学) Human-Centered Computing and Extended Reality Lab(以人为本计算与扩展现实实验室) TUM University Hospital(慕尼黑大学医院) Clinic for Orthopedics and Sports Orthopedics(骨科与运动医学诊所) Munich Institute of Robotics and Machine Intelligence (MIRMI)(慕尼黑机器人与机器智能研究所) Learning Systems and Robotics Lab(学习系统与机器人实验室)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 提出LiftNav混合导航框架,结合TSDF+GS双地图、YOLO检测、TSDF三维提升和B样条轨迹优化,实现无需密集三维嵌入的灵活语义导航,并通过铰链损失碰撞惩罚提升轨迹平滑性和安全性,在Replica数据集仿真中实现100%可行性和更短轨迹。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31121 2026-06-01 cs.RO cs.AI 62%

TARIC: Memory-Augmented Traversability-Aware Outdoor VLN under Interrupted Semantic Cues

TARIC: 语义线索中断下基于记忆增强的可通行性感知户外视觉语言导航

Tianle Zeng, Hanjing Ye, Jianwei Peng, Jingwen Yu, Hanxuan Chen, Hong Zhang

机构 * Shenzhen Key Laboratory of Robotics and Computer Vision(深圳机器人与计算机视觉重点实验室) Southern University of Science and Technology(南方科技大学) CKS Robotics Institute(CKS机器人研究所) Hong Kong University of Science and Technology(香港科技大学) College of Electrical and Information Engineering(电气与信息工程学院)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 针对户外视觉语言导航中语义线索中断导致导航退化的问题,提出统一框架,通过可通行性一致的执行引导和不确定性感知的3D线索记忆,在长时间无线索阶段维持稳定导航,在四足和轮式平台上成功率提升显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30696 2026-06-01 cs.RO cs.SY eess.SY 61%

Geometry-Aware Control Barrier Functions for Collision Avoidance via Bernstein Polynomial Approximations

基于Bernstein多项式近似的几何感知控制障碍函数用于碰撞避免

Siwon Jo, Yanze Zhang, Yupeng Yang, Wenhao Luo

机构 * GRASP Laboratory, University of Pennsylvania(宾夕法尼亚大学GRASP实验室) Department of Computer Science, University of Illinois Chicago(伊利诺伊大学芝加哥分校计算机科学系) Department of Computer Science, University of North Carolina at Charlotte(北卡罗来纳大学夏洛特分校计算机科学系)

专题命中 具身导航 :navigation(abstract);分类 cs.RO;robotics(comments)

AI总结 提出一种基于Bernstein多项式符号距离场的几何感知控制障碍函数,统一表示障碍物与机器人,利用多项式可微性实现闭环控制约束,保证单机器人和异构多机器人碰撞避免的安全性与效率。

Comments 8 pages; Accepted by 2026 IEEE International Conference on Robotics and Automation (ICRA 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31492 2026-06-01 cs.AI 57%

LinTree: Improving LLM Reasoning with Explicitly Structured Search Histories

LinTree: 通过显式结构化搜索历史提升LLM推理能力

Liwei Kang, Yee Whye Teh, Wee Sun Lee

机构 * National University of Singapore(新加坡国立大学) University of Oxford(牛津大学)

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 针对LLM推理中隐式搜索树导致性能不佳的问题,提出LinTree方法,通过添加父指针显式表示线性化树结构,在Blocks World、网格导航和Sokoban任务中提升了任务性能和搜索效率。

Comments 16 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30714 2026-06-01 cs.CV 57%

Vision-Based Localization in Dense Urban Environments: A Case Study of an Urban Village in China

基于视觉的密集城市环境定位:中国城中村案例研究

Menglin Wu, Rui Cao

机构 * Thrust of Urban Governance and Design, Society Hub, The Hong Kong University of Science and Technology (Guangzhou)(城市治理与设计 thrust,社会枢纽,香港科技大学(广州))

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 针对密集城市环境中GPS信号不可靠和地图数据不完整的问题,提出一种基于双摄像头系统的低成本视觉地理定位方法,并在广州石牌村数据集上评估现有模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10809 2026-06-01 cs.CV cs.IR 57%

DeepImageSearch: Benchmarking Multimodal Agents for Context-Aware Image Retrieval in Visual Histories

DeepImageSearch: 多模态智能体在视觉历史中上下文感知图像检索的基准测试

Chenlong Deng, Mengjie Deng, Junjie Wu, Dun Zeng, Teng Wang, Qingsong Xie, Jiadeng Huang, Shengjie Ma, Changwang Zhang, Zhaoxiang Wang, Jun Wang, Yutao Zhu, Zhicheng Dou

机构 * Gaoling School of Artificial Intelligence, Renmin University of China, Beijing, China(中国人民大学北京校区人工智能学院) OPPO Research Institute(OPPO研究院)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 提出DeepImageSearch范式,将图像检索重构为自主探索任务,通过构建DISBench基准和模块化智能体框架,验证了在视觉历史中基于隐式上下文线索进行多步推理的必要性。

Comments 18 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23768 2026-06-01 cs.RO 57%

Motion Tracking with Muscles: Predictive Control of a Parametric Musculoskeletal Canine Model

基于肌肉的运动追踪:参数化肌肉骨骼犬模型的预测控制

Vittorio La Barbera, Steven Bohez, Leonard Hasenclever, Yuval Tassa, John R. Hutchinson

机构 * DeepMind(深Mind) Royal Veterinary College(皇家兽医学院)

专题命中 具身导航 :robotics(abstract);分类 cs.RO

AI总结 提出一种由精确3D肌肉网格程序化生成的犬类肌肉骨骼模型,结合改进的肌肉动力学模型和运动捕捉任务,通过比较模拟肌肉激活模式与实验EMG数据验证,旨在弥合生物力学、机器人和计算神经科学之间的差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31574 2026-06-01 cs.HC 50%

Can Generative AI help people navigate Radical Moral Disagreements? The CONSIDER prototype

生成式AI能否帮助人们应对根本性道德分歧?CONSIDER原型

William Hohnen-Ford, Sarah Chen, Kathryn B. Francis, Madeline G. Reinecke, Ilina Singh, David Lyreskog

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出CONSIDER原型,一种基于大型语言模型的一对一AI工具,通过结构化分歧帮助用户澄清价值观,以应对根本性道德分歧。

Comments 25 pages, 1 figure, 2 tables. Submitted manuscript

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30483 2026-06-01 quant-ph physics.atom-ph 50%

Rydberg state engineering of trapped ions

囚禁离子的里德伯态工程

Robin Thomm, Vinay Shankar, Natalia Kuk, Marion Mallweger, Ivo Straka, Markus Hennrich

专题命中 具身导航 :navigation(abstract)

AI总结 本文首次演示了囚禁离子不同里德伯态之间的相干布居转移,通过微波缀饰实现可调极化率和相互作用强度的本征态,并展示了零极化态与最大缀饰态之间的绝热转移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29929 2026-06-01 physics.atom-ph quant-ph 50%

Restoring Velocity Immunity via Dynamic Mirror Compensation in a Large-Area Dual-Atom-Interferometer Gyroscope

通过动态镜面补偿恢复大面积双原子干涉仪陀螺仪的速度免疫性

Jie Gu, Yin-fei Mao, Zhan-Wei Yao, An-qing Zhang, Si-Bin Lu, Shao-kang Li, Min Jiang, Xiao-Li Chen, Min Ke, Xi Chen, Run-Bing Li, Jin Wang, Ming-Sheng Zhan

专题命中 具身导航 :navigation(abstract)

AI总结 提出并演示了一种动态镜面补偿方案,通过主动旋转拉曼镜面消除科里奥利效应破坏的速度免疫性,在21.1 cm²干涉面积的双原子干涉仪陀螺仪上实现40倍速度依赖性降低和0.13 ppm的标度因子稳定性。

Comments 6 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身推理 13 篇

2605.30542 2026-06-01 cs.AI 88%

Physically Viable World Models: A Case for Query-Conditioned Embodied AI

物理可行的世界模型:面向查询条件具身AI的案例

Adam J. Thorpe, Stepan Tretiakov, Cheng-Hsi Hsiao, Su Ann Low, Xingjian Li, Hassan Iqbal, Neel P. Bhatt, Ufuk Topcu, Krishna Kumar

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 具身推理 :embodied AI(title,abstract);world model(title,abstract);分类 cs.AI

AI总结 针对具身AI中现有世界模型预测未来观测但物理不可行的问题,提出应构建基于查询条件、识别最简物理抽象的世界模型,通过模块化分解确保可解释性和可验证性。

Comments 21 pages; Adam J. Thorpe and Stepan Tretiakov contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11367 2026-06-01 cs.CV 85%

3D-Belief: Embodied Belief Inference via Generative 3D World Modeling

3D-Belief:通过生成式3D世界建模实现具身信念推断

Yifan Yin, Zehao Wen, Suyu Ye, Jieneng Chen, Zehan Zheng, Nanru Dai, Haojun Shi, Aydan Huang, Zheyuan Zhang, Alan Yuille, Jianwen Xie, Ayush Tewari, Tianmin Shu

机构 * Johns Hopkins University(约翰霍普金斯大学) Lambda University of Cambridge(剑桥大学)

专题命中 具身推理 :world model(title,abstract);embodied agent(abstract);navigation(abstract);分类 cs.CV

AI总结 提出3D-Belief,一种生成式3D世界模型,通过在线更新显式3D信念,使具身智能体能够在部分可观测环境中想象场景补全并推理,在2D/3D想象质量和下游物体导航任务上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01985 2026-06-01 cs.LG cs.AI cs.RO 82%

World Action Verifier: Self-Improving World Models via Forward-Inverse Asymmetry

World Action Verifier: 通过前向-反向不对称性自我改进世界模型

Yuejiang Liu, Fan Feng, Lingjing Kong, Weifeng Lu, Jinzhou Tang, Kun Zhang, Kevin Murphy, Chelsea Finn, Yilun Du

机构 * Stanford University(斯坦福大学) UC San Diego(加州大学圣地亚哥分校) Carnegie Mellon University(卡内基梅隆大学) Google DeepMind(谷歌DeepMind) Harvard University(哈佛大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 提出World Action Verifier (WAV)框架,利用状态合理性和动作可达性的独立验证以及前向-反向不对称性,通过视频语料库的多样子目标生成器和稀疏逆模型实现循环一致性,从而在欠探索区域自我改进世界模型,在多个任务中样本效率提升2倍且下游策略性能提升22%以上。

Comments Project Website: https://world-action-verifier.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01075 2026-06-01 cs.LG cs.AI cs.CV 82%

Flow Equivariant World Models: Memory for Partially Observed Dynamic Environments

流等变世界模型:部分观测动态环境的记忆

Hansen Jin Lillemark, Benhao Huang, Fangneng Zhan, Yilun Du, Thomas Anderson Keller

机构 * Kempner Institute, Harvard University(哈佛大学 Kempner 研究所) ML, Carnegie Mellon University(卡内基梅隆大学 ML 研究所) SEAS, Harvard University(哈佛大学 SEAS 研究所)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.CV、cs.LG

AI总结 提出流等变世界建模框架,利用时间参数化对称性在潜在记忆中实现长时程稳定准确的动力学预测,解决部分观测问题。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏