arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 3061 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身推理 350 篇

2608.05891 2026-08-07 cs.AI cs.CL 新提交 79%

AppDeltaWorld: Transition-Grounded Delta Code World Model for Mobile GUI Agents

AppDeltaWorld:面向移动GUI智能体的基于转换的增量代码世界模型

Weikai Xu, Yunren Feng, Haoxiang Lei, Kun Huang, Yuxuan Liu, Kang Zhao, Xiaolin Hu, Shuo Shang, Bo An

专题命中 具身推理 :world model(title,abstract);分类 cs.AI

AI总结 针对移动GUI智能体轨迹获取难、模拟环境扩展难等问题,提出AppDeltaWorld增量代码世界模型,在CMGUIBench-500评估中表现最优,支撑的AppDeltaAgent在多基准达SOTA,测试时强化学习可进一步提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05720 2026-08-07 cs.CV 新提交 79%

PhyLatent: Learning Dynamics-Relevant Representations for JEPA World Models

PhyLatent:为JEPA世界模型学习与动力学相关的表征

Xi Zeng, Haojie Ren, Ziying Song

机构 * School of Mechanical and Aerospace Engineering, Nanyang Technological University(南洋理工大学机械与航天工程学院) School of Artificial Intelligence (School of Software), Yanshan University(燕山大学人工智能学院(软件学院)) The University of Sheffield(谢菲尔德大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.CV

AI总结 PhyLatent为JEPA世界模型设计训练目标,解决其三类失效模式,在OGBench-Cube等数据集上显著降低失效率、提升MPC成功率,证明全局非坍塌不足以学习可靠的JEPA状态空间。

Comments 16 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05706 2026-08-07 cs.CV 新提交 79%

LAWM-3D: Learning 3D-Aware Latent Actions from Human Videos for Generalizable Robot World Models

LAWM-3D:从人类视频中学习具有3D感知能力的潜在动作以构建可泛化的机器人世界模型

Jiarui Yang, Jiale Zhange, Jiawei Li, Hang Guo, Wen Huang, Jinpeng Wang, Peidong Liu, Shu-Tao Xia

专题命中 具身推理 :world model(title,abstract);分类 cs.CV

AI总结 本研究针对现有潜在动作模型缺乏3D感知能力的问题,提出LAWM-3D模型,通过多视图动作 token 化、几何对齐约束和RGB-D联合重建目标,实现了性能SOTA的机器人世界模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05695 2026-08-07 cs.AI cs.CL cs.CR 新提交 79%

DreamGuard: Efficient Runtime Guardrail for LLM Agents via Risk-Aware World Model

DreamGuard:基于风险感知世界模型的LLM智能体高效运行时护栏

Wenhao Lin, Chenyu Yu, Xingwei Lin, Sicong Cao, Xiang Chen, Lei Xue, Le Yu, Letian Sha, Chunming Wu

专题命中 具身推理 :world model(title,abstract);分类 cs.AI

AI总结 针对LLM智能体运行时护栏的长视野风险盲点问题,提出基于风险感知世界模型的主动式护栏DreamGuard,经实验验证其安全-效用权衡更优且延迟低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05523 2026-08-07 cs.CV 新提交 79%

HERA: Historical Evidence Routing Adapter for Physical Prediction in Latent World Models

HERA:用于潜在世界模型中物理预测的历史证据路由适配器

Yuanruyi, Yue Cao, Haojia Gao, Guanqiu Guo, Ziyuezhang, Shangqin, Junbo Tan, Bokui Chen, Zhuo Zou, Xueqian Wang

专题命中 具身推理 :world model(title,abstract);分类 cs.CV

AI总结 本研究提出 HERA 框架,通过 RRPM 适配器为冻结潜在预测器路由历史证据,在 IntPhys2 数据集上显著提升 V-JEPA 2-G 的物理预测准确率,验证了该策略的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05070 2026-08-06 cs.CV 新提交 79%

HelloWorld: Enabling Socially Interactive Characters in Video World Models

HelloWorld:在视频世界模型中实现具有社交互动性的角色

Liangyang Ouyang, Ruicong Liu, Xuangeng Chu, Kaipeng Zhang, Yoichi Sato

机构 * The University of Tokyo(东京大学) Alaya Lab(阿莱亚实验室)

专题命中 具身推理 :world model(title,abstract);分类 cs.CV

AI总结 该研究提出HelloWorld视频世界模型,通过自蒸馏流水线和训练模块实现角色与用户的社交互动,构建含400样本的基准,其互动质量优于基线且保持顶尖图像美学。

Comments Project page: https://github.com/AlayaLab/HelloWorld

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04378 2026-08-06 cs.SD cs.LG eess.AS 新提交 79%

Helping Music Co-Creation Agents 'Listen' Well: Hierarchical Self-Supervised World Models for Understanding and Generation

助力音乐协同创作智能体“良好聆听”:用于理解与生成的分层自监督世界模型

Scott H. Hawley

机构 * Belmont University(贝尔蒙特大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.LG

AI总结 本研究提出分层自监督世界模型,通过Swin V2编码器与条件流匹配模型构建协同音乐创作智能体,提升了和弦与调式检测准确率,可快速生成音乐建议并支持交互演示。

Comments 20 pages, 14 figures. A 6-page version was submitted to the NeurIPS 2026 Creative AI Track. Supplemental website with listening examples: https://drscotthawley.github.io/midi-rae-jepa-son/. Live demo: https://drscotthawley-midi-rae-jepa-son.hf.space/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02603 2026-08-04 cs.CV 新提交 79%

WorldExam: Benchmarking World Models from Apparent Appearance to Inherent Reactivity

WorldExam:从表观外观到内在反应性对世界模型进行基准测试

Yuxue Yang, Shuyao Shang, Jiahe Wang, Zitong Zhou, Liang Tan, Junhan Zeng, Ruizhi Li, Junyan Li, Yu Liu, Xiao Yang, Yong Li, Jun Zhu, Hongsheng Li, Tieniu Tan, Lue Fan, Zhaoxiang Zhang

机构 * CASIA(中国科学院自动化研究所) SLAI(智能科学与技术实验室) CUHK(香港中文大学) AMAP(中国农业科学院) THU(清华大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.CV

AI总结 该研究推出WorldExam基准,评估20个模型在视觉质量等四层级的表现,发现不同驱动模型能力有明显分化,无模型兼具广泛任务覆盖与稳定性能,高视觉质量不代表内在反应性强。

Comments Project Website: https://WorldExam.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01926 2026-08-04 cs.AI 新提交 79%

ProWorld: Progress-Aware Hyperbolic World Models for Long-Horizon Visual Goal Reaching

ProWorld:用于长程视觉目标到达的感知进展双曲世界模型

Zihan Liu, Yuzhe Zhuang, Yuanzu Li, Wanshuang Gou, Jiahong Liu, Min Zhou, Menglin Yang

专题命中 具身推理 :world model(title,abstract);分类 cs.AI

AI总结 本文针对长程视觉目标到达任务中视觉世界模型的进展感知与轨迹区分难题,提出双曲视觉世界模型ProWorld,经实验相较LeWM实现9.67的平均绝对成功率提升。

Comments 24 pages, 14 figures, 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28624 2026-07-31 cs.CV 新提交 79%

PhiZero: A World Model Built Around Physical Language

PhiZero:基于物理语言构建的世界模型

Shuyao Shang, Yuqi Wang, Ruopeng Gao, Xu Chen, Tieniu Tan, Lue Fan, Zhaoxiang Zhang

机构 * NLPR, Institute of Automation, Chinese Academy of Sciences (CASIA)(中国科学院自动化研究所NLPR)

专题命中 具身推理 :world model(title,abstract);分类 cs.CV

AI总结 该研究提出围绕物理语言构建的PhiZero世界模型,采用先推理再渲染的范式,经实验验证其可建模物理连贯的世界演化,还具备交互式世界建模等应用潜力。

Comments Project page: https://phi-zero.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26754 2026-07-30 cs.CV 新提交 79%

StatePlay: State-Aware Game World Models for Mechanics-Consistent Generation

StatePlay:用于机制一致性生成的状态感知游戏世界模型

Zijun Lin, Zeqing Wang, Cheston Tan, Bihan Wen, Yeying Jin

机构 * Tencent(腾讯)

专题命中 具身推理 :world model(title,abstract);分类 cs.CV

AI总结 本文提出StatePlay,一种状态感知游戏世界模型,采用混合Transformer架构联合预测视觉内容与游戏状态,经实验验证可提升游戏生成的机制保真度。

Comments Project Page: https://jimntu.github.io/stateplay_page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26752 2026-07-30 cs.LG 新提交 79%

CalTwin: Towards Calibrated, Shift-Robust Medical World Models via Fisher-Information Regularisation

CalTwin:基于Fisher信息正则化的校准、分布偏移鲁棒医学世界模型研究

Behraj Khan, Shabir Ahmad, Syed Ahmad Chan Bukhari, Tahir Qasim Syed

机构 * Institute of Business Administration Karachi(卡拉奇商业管理学院) Gachon University(嘉泉大学) St. John’s University(圣约翰大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.LG

AI总结 本研究提出CalTwin方法,结合Fisher信息偏移惩罚与置信度失配惩罚,应用于GRU医学世界模型,在PhysioNet脓毒症挑战赛上显著降低了分布外隐状态预测误差,同时改善了置信度校准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26056 2026-07-29 cs.RO 新提交 79%

INTACT: Isomorphic Intent-to-Action Learning for Search-Free World Models

INTACT:用于无搜索世界模型的同构意图到动作学习

Junhan Sun, Hao Zhao, Guofeng Zhang

机构 * State Key Laboratory of CAD&CG, Zhejiang University(浙江大学计算机辅助设计与图形学国家重点实验室) Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院) InSpatio

专题命中 具身推理 :world model(title,abstract);分类 cs.RO

AI总结 研究针对前向潜在世界模型恢复动作需昂贵搜索的问题,提出INTACT方法,通过特定架构和技术实现意图到动作学习,在多任务上取得高成功率,减少采样并提升性能,还具有快速推理能力。

Comments 28 pages, 11 figures, including appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26037 2026-07-29 cs.CV cs.GR 新提交 79%

Wonder: Video World Model Done Better

Wonder:改进的视频世界模型

Jiacong Xu, Hanwen Jiang, Zhixin Shu, Kalyan Sunkavalli, Vishal M. Patel, Yiqun Mei

机构 * Adobe Research(Adobe研究院) Johns Hopkins University(约翰·霍普金斯大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.CV

AI总结 Wonder是用于实时相机可控世界探索的通用视频世界模型,通过系统级协同设计,包括新型相机条件设定、高效内存机制等,能合成多样视频,支持视频条件生成,保持长时间的连贯视觉效果。

Comments Project Page: https://wonder-world-model.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24267 2026-07-28 cs.RO 新提交 79%

FeelWorld: Visuo-Tactile World Model for Hierarchical Contact Prediction and Planning

FeelWorld:用于分层接触预测和规划的视觉触觉世界模型

Wenxuan Ma, Chaofan Zhang, Chao Xue, Yinghao Cai, Guocai Yao, Shaowei Cui, Shuo Wang

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Imprintx Robotics(印记机器人公司) Beijing Academy of Artificial Intelligence(北京人工智能研究院)

专题命中 具身推理 :world model(title,abstract);分类 cs.RO

AI总结 研究针对现有视觉世界模型忽视触觉状态问题,提出分层视觉触觉世界模型FeelWorld,通过联合预测视觉和触觉状态、引入注意力机制及训练方法,实现接触预测与规划,实验表明其能降低预测误差并提高规划成功率。

Comments 9 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23517 2026-07-28 cs.CV 新提交 79%

Real-Time Human-Centric World Modeling for Upper-Body Human-Object Interaction

用于上身人体-物体交互的实时以人为中心的世界建模

Chaonan Ji, Jinwei Qi, Peng Zhang, Bang Zhang

机构 * Tongyi Lab(通义实验室)

专题命中 具身推理 :world model(title,abstract);分类 cs.CV

AI总结 该研究提出用于上身人体-物体交互的实时以人为中心世界模型,采用连续-离散联合控制方案,结合多尺度运动编码的连续人体状态控制与语言编码离散交互状态控制,能精确建模人物与环境交互,提炼后实现高效实时推理,实验验证了其优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23147 2026-07-28 cs.CR cs.AI 新提交 79%

False Prophets: On the Security of World Models in Agentic Systems

虚假预言:论智能体系统中世界模型的安全性

Erik Imgrund, Anna Wimbauer, Klim Kireev, Konrad Rieck

专题命中 具身推理 :world model(title,abstract);分类 cs.AI

AI总结 研究智能体系统中世界模型的安全性,发现其存在特定漏洞,引入安全基准数据集,指出攻击者能诱导错误预测,成功率达95%,并为从业者提供减轻危害、强化系统的实用建议。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21686 2026-07-27 cs.AI 新提交 79%

Persistent Computational State: A Session-Centric Runtime for Generative World Models

持久计算状态:用于生成式世界模型的以会话为中心的运行时

Zhen Lin

专题命中 具身推理 :world model(title,abstract);分类 cs.AI

AI总结 研究发现当前视频世界模型用作模拟器失败的归因不完整,定义了持久计算状态(PCS),构建以会话为中心的运行时,通过测量发现PCS,实现低检查点和恢复成本以及新的内存管理方式。

Comments 29 pages, 8 figures, 10 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19809 2026-07-23 cs.MA cs.LG 新提交 79%

Dreamer-CPC: Message Learning with World Models for Decentralized Multi-agent Reinforcement Learning

Dreamer-CPC:用于去中心化多智能体强化学习的基于世界模型的消息学习

Taisuke Takayama, Naoto Yoshida, Tadahiro Taniguchi

机构 * Graduate School of Informatics, Kyoto University, Kyoto, Japan(京都大学信息学研究生院) Research Organization of Science and Technology, Ritsumeikan University, Shiga, Japan(立命馆大学科学技术研究机构)

专题命中 具身推理 :world model(title,abstract);分类 cs.LG

AI总结 研究针对多智能体强化学习中通信问题,提出Dreamer-CPC方法,将基于CPC的消息学习集成到DreamerV3世界模型,各智能体据此独立维护模型与模块并交换消息,实验表明该方法在多种环境下优于现有方法,能有效支持去中心化决策。

Comments 15 pages, 6 figures. Under review at ICONIP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18715 2026-07-22 cs.AI 新提交 79%

DWM: Separating World Effects from Actions in Latent World Models

DWM:在潜在世界模型中分离世界效应与动作

Yi-Ge Zhang, Tianqi Du, Qi Zhang, Yisen Wang

机构 * Peking University(北京大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI

AI总结 研究在潜在世界模型中分离世界效应与动作的问题,提出DWM框架,通过辅助世界头和正交性约束实现预测转换的显式加法分解,在构建的W变体基准测试中取得更好效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18696 2026-07-22 cs.AI 新提交 79%

Do AI-Native Biotechs Need Departments? Benchmarking Company World Models for AI-Driven Drug Development

人工智能原生生物技术公司需要部门吗?人工智能驱动药物研发的公司世界模型基准测试

Yinan Wang

机构 * Noah AI Research(诺亚人工智能研究)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI

AI总结 研究人工智能原生生物技术公司组织模式,提出公司世界模型,用含45个案例的虚拟实验室基准测试,比较多种架构,发现价值转换架构表现优,核心操作原语应是资产到价值状态而非静态组织结构图,不过研究仅限虚拟实验室。

Comments Working paper. Includes public no-label benchmark cases and dry-lab evaluation artifacts. No wet-lab, patient-level, clinical, regulatory, or investment validation is claimed

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18367 2026-07-22 cs.AI 新提交 79%

AlayaWorld: Interactive Long-Horizon World Modeling -- Full Technical Report

阿莱雅世界:交互式长视野世界建模——完整技术报告

AlayaWorld Team, Kaipeng Zhang, Chuanhao Li, Yifan Zhan, Yongtao Ge, Yuanyang Yin, Jiaming Tan, Kang He, Liaoyuan Fan, Mingliang Zhai, Ruicong Liu, Xiaojie Xu, Xuangeng Chu, Zhen Li, Zhengyuan Lin, Zhixiang Wang, Zian Meng, Zihui Gao

机构 * Alaya Lab(阿莱亚实验室)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI

AI总结 研究旨在创建交互式视频世界模型,核心方法是基于15B视频扩散变压器构建阿莱雅世界,通过自回归生成短潜在块等实现多种能力,在iWorld - Bench上长视野生成性能最佳,为相关研究提供开源可扩展基础。

Comments Authors are listed alphabetically by the first name and their role. See the contribution section for details

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17973 2026-07-21 cs.AI 新提交 79%

SAGE: Subgoal-Conditioned Action Generation for Latent World Model Planning

SAGE:用于潜在世界模型规划的子目标条件动作生成

Letian Cheng, Qi Zhang, Yisen Wang

机构 * Peking University(北京大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI

AI总结 研究潜在世界模型规划中提议质量受限问题,提出先验条件规划器,利用目标条件生成器预测潜在子目标,结合不同时长子目标作先验,实验证明该方法显著提升长期规划性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17747 2026-07-21 cs.NI cs.AI 新提交 79%

Mobile Network Control with a World Model

基于世界模型的移动网络控制

Maxime Bouton, Ioanna Mitsioni, Simon Lindståhl, Jaeseong Jeong

机构 * Ericsson Research(爱立信研究)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI

AI总结 针对移动网络控制问题,提出基于世界模型的方法,通过历史数据训练模型预测行动影响,利用不确定性估计找最优配置,优化目标可动态改变。该方法在模拟闭环控制中有效,相比传统方法和强化学习提升了节能与服务质量平衡性能。

Journal ref 2026 IEEE/IFIP Network Operations and Management Symposium (NOMS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17269 2026-07-21 cs.AI cs.DB 新提交 79%

An Explicit World Model Based on Data-First Ontology: DaoQL Multimodal Storage Validation and Counterfactual Reasoning Evaluation

基于数据优先本体的显式世界模型:DaoQL多模态存储验证与反事实推理评估

Zhanbo Li, Shifeng Wu, Xiangjin Meng, Wenjie Cai

机构 * School of Mathematics and Statistics, Chongqing University(重庆大学数学与统计学院) Guangzhou Polytechnic Normal University(广州技术师范大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI

AI总结 研究大型语言模型隐式编码世界模型的风险,提出数据优先本体并构建DaoQL多模态数据库。通过形式化显式世界模型,对比隐式模型优势。实验展示系统性能,如在反事实实验中DaoQL+GPT-4o可组合反事实可分解性大幅提升。

Comments 20 pages, 2 figures. Code: https://github.com/zhanbolee/DaoQL-Edu

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15901 2026-07-20 cs.AI 新提交 79%

DSWorld: A Data Science World Model for Efficient Autonomous Agents

DSWorld:用于高效自主智能体的数据科学世界模型

Zherui Yang, Fan Liu, Hao Liu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 具身推理 :world model(title,abstract);分类 cs.AI

AI总结 研究自主数据科学智能体依赖试错流程效率低的问题,提出数据科学世界模型概念及DSWorld框架,含多种技术。构建数据集并引入优化策略,实验显示其加速智能体训练和推理,在转换预测任务上超基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15550 2026-07-20 cs.AI 新提交 79%

SeerGuard: A Safety Framework for Mobile GUI Agents via World Model Prediction

SeerGuard:一种通过世界模型预测实现的移动 GUI 代理安全框架

Xue Yu, Bo Yuan, Pengshuai Yang, Kailin Zhao, Hong Hu, Junlan Feng

机构 * JIUTIAN Research(九天研究)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI

AI总结 研究针对移动 GUI 代理安全风险问题,提出 SeerGuard 框架,通过执行前指令级筛选和行动级风险评估减轻风险。构建安全增强世界模型,经实验验证其在不同代理上有效泛化,提升了安全效用分数并降低风险成本分数。

Comments 19 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15439 2026-07-20 cs.AI 新提交 79%

Do Coding Agents Need Executable World Models, Simplification, and Verification to Solve ARC-AGI-3?

解决ARC-AGI-3编码智能体是否需要可执行世界模型、简化和验证?

Sergey Rodionov

专题命中 具身推理 :world model(title,abstract);分类 cs.AI

AI总结 研究探讨解决ARC-AGI-3时编码智能体是否需可执行世界模型、简化和验证。通过四个基于Codex的嵌套智能体评估,发现各变体随模型和推理强度改进,组件影响因设置而异,完整验证处理最佳,文本变体在部分设置中表现出色。

Comments 31 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14076 2026-07-16 cs.CV 新提交 79%

From Pixels to States: Rethinking Interactive World Models as Game Engines

从像素到状态:将交互式世界模型重新思考为游戏引擎

Zhen Li, Zian Meng, Shuwei Shi, Mingliang Zhai, Jiaming Tan, Chuanhao Li, Kaipeng Zhang

机构 * Alaya Lab(阿亚实验室)

专题命中 具身推理 :world model(title,abstract);分类 cs.CV

AI总结 本文从玩家动作控制等四个维度审视交互式游戏世界建模,分析现有方法优缺点,还为《黑神话:悟空》提供可扩展数据引擎,收集相关游戏资源用于状态感知建模,助力推动交互式游戏世界发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13651 2026-07-16 cs.CV 新提交 79%

From Surface Forecasting to Observability Forecasting: A Latent World Model for Cloud-Aware EO Monitoring

从地表预测到可观测性预测:用于云感知地球观测监测的潜在世界模型

Mohanad Albughdadi

机构 * European Centre for Medium-Range Weather Forecasts(欧洲中期天气预报中心)

专题命中 具身推理 :world model(title,abstract);分类 cs.CV

AI总结 研究地球观测处理链中地表可观测性预测问题,采用LeWorldModel模型并将其应用于云感知地球观测序列,经训练和评估,该模型在可观测性基准上优于持久性方法,在多方面表现良好且能产生异常信号。

详情

展开后加载摘要…

URL PDF HTML 收藏