arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-07-21 至 2026-07-21 共收录 157 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 33 篇

2602.00877 2026-07-21 cs.RO 80%

Learning When to Jump for Off-road Navigation

在越野导航中学习何时跳跃

Zhipeng Zhao, Taimeng Fu, Shaoshu Su, Qiwei Du, Ehsan Tarkesh Esfahani, Karthik Dantu, Souma Chowdhury, Chen Wang

机构 * University at Buffalo(布法罗大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO;robotics(journal_ref)

AI总结 本文提出Motion-aware Traversability方法,通过建模实际机器人运动动态,提升越野导航的实时性和安全性,减少75%的路径绕行。

Journal ref Robotics: Science and Systems (RSS), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16956 2026-07-21 cs.RO 新提交 79%

G2-Nav: Grounded and Guarded Vision-Language Costmaps for Robot Social Navigation

G2-Nav:用于机器人社交导航的基于视觉语言的地面与防护代价地图

Yuwen Liao, Yihang Lan, Yizhuo Yang, Ruimeng Liu, Xinhang Xu, Shenghai Yuan, Lihua Xie

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 研究针对机器人社交导航问题,提出G2-Nav框架,将VLM语义推理转化为视觉语言代价地图,经开放集感知评估区域和代理,结合语义验证与高频安全检查,实现非结构化环境下安全、高效且符合社会规范的自主导航。

Comments submitted

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16806 2026-07-21 cs.RO 新提交 79%

Token-Wise Latent Streaming from Slow Reasoners to Fast Planners for Dynamic Vision Language Navigation

用于动态视觉语言导航的从慢速推理器到快速规划器的逐令牌潜在流

Tianshuai Hu, Yangyi Zhong, Zeying Gong, Lingdong Kong, Xiaodong Mei, Guoyang Zhao, Xiaolu Liu, Song Wang, Rong Li, Junwei Liang

机构 * The Hong Kong University of Science and Technology(香港科技大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) National University of Singapore(新加坡国立大学) Zhejiang University(浙江大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 针对动态视觉语言导航中语言推理慢与规划需即时的矛盾,提出SPARK-VLN双系统框架,通过三个模块将慢速VLM推理器知识流到快速规划器,引入新基准套件,提高了导航成功率、社会合规性及推理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16614 2026-07-21 cs.RO cs.SY eess.SY 新提交 79%

An Indoor Navigation System for the Visually Impaired based on UWB Positioning and D* Lite Path Planning Algorithm

基于超宽带定位和D* Lite路径规划算法的视障者室内导航系统

Thanh C. Vo, Dong LT. Tran, Huy HM. Le, Duyen N Ha, Tuan Anh Pham, Hai Thanh Dang, Hoang T. Tran

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 针对视障者室内导航问题,提出基于UWB定位技术和D* Lite路径规划算法的系统,利用UWB传感器定位,集成算法优化轨迹、应对动态障碍,实验表明系统可靠低延迟,为视障者提供安全灵活的室内导航。

Comments 6 pages, 7 figures, 3 tables

Journal ref Proceedings of the 8th Vietnam International Conference and Exhibition on Control and Automation (VCCA-2026), pp.1029-1034, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03920 2026-07-21 cs.RO 版本更新 79%

LH-AVLN: A Benchmark for Long-Horizon Audio-Visual-Language Navigation

LH-AVLN:长距离视听语言导航基准测试

Rufeng Chen, Yue Chang, Zili Shao, Zhaofan Zhang, Li Chen, Hechang Chen, Hui Xiong, Sihong Xie

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Jilin University(吉林大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 介绍长距离视听语言导航基准LH-AVLN,结合多目标任务执行等。提出免训练参考智能体PAG-Nav,可维护语义地图并规划。实验表明现有智能体完成任务有困难,PAG-Nav提供更强诊断基线。

Comments 12 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14643 2026-07-21 cs.AI 版本更新 79%

Arbor: A Framework for Reliable Navigation of Critical Conversation Flows

Arbor:一种用于关键对话流程可靠导航的框架

Luís Silva, Diogo Gonçalves, Catarina Farinha, Clara Matos, Luís Ungaro

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI

AI总结 Arbor通过分解决策树导航为节点级任务,提升了医疗分诊中对话流程的准确性和效率,使小型模型能超越大模型表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12972 2026-07-21 cs.RO 版本更新 79%

SplatSearch: Instance Image Goal Navigation for Mobile Robots using 3D Gaussian Splatting and Diffusion Models

SplatSearch:使用3D高斯点云和扩散模型的移动机器人实例图像目标导航

Siddarth Narasimhan, Matthew Lisondra, Haitong Wang, Goldie Nejat

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 研究移动机器人的实例图像目标导航问题,提出SplatSearch架构,利用3D高斯点云重建和多视角扩散模型,结合前沿探索策略,在多种环境实验中验证其性能优于现有方法。

Comments Project Page: https://splat-search.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16926 2026-07-21 cs.CV 新提交 70%

Splat-based 3D Scene Reconstruction with Extreme Motion-blur

基于体素的极端运动模糊3D场景重建

Hyeonjoong Jang, Dongyoung Choi, Donggun Kim, Woohyun Kang, Min H. Kim

机构 * KAIST(韩国科学技术院) HYPERGRAM(超图)

专题命中 具身导航 :robotics(abstract);navigation(abstract);分类 cs.CV

AI总结 研究针对低光照下RGB-D输入的极端运动模糊问题,提出结合高斯体素框架的相机姿态估计与图像去模糊方法,通过对齐帧、调整高斯位置等步骤,提升3D重建质量,优于现有方法,有广泛应用意义。

Journal ref Proceedings of IEEE/CVF International Conference on Computer Vision (ICCV) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.12190 2026-07-21 cs.RO cs.CV 66%

Bundle Adjustment in the Eager Mode

急切模式下的捆绑调整

Zitong Zhan, Huan Xu, Zihang Fang, Xinpeng Wei, Yaoyu Hu, Chen Wang

机构 * Spatial AI & Robotics (SAIR) Lab, University at Buffalo(空间人工智能与机器人实验室,布法罗大学) Georgia Institute of Technology(佐治亚理工学院) Purdue University(普渡大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 具身导航 :robotic(abstract);分类 cs.RO、cs.CV;robotics(journal_ref)

AI总结 本文提出了一种与PyTorch无缝集成的高效急切模式捆绑调整库,通过稀疏感知的自动微分设计和GPU加速的稀疏运算,提升了在机器人应用中捆绑调整的运行效率和性能。

Journal ref IEEE Transactions on Robotics (T-RO), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17994 2026-07-21 cs.CV cs.AI 新提交 62%

HAS: Highlight-guided Attention Steering for Multimodal LLM Video Summarization

HAS:用于多模态大语言模型视频摘要的高亮引导注意力转向

Rui Chu, Yingjie Lao

机构 * Tufts University(塔夫茨大学)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.CV

AI总结 针对视频摘要,提出HAS方法,通过全局找连续帧级高亮分布并作为注意力转向向量,让多模态大语言模型在推理时更关注高亮帧,避免丢失信息,在多种基准测试中性能出色。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17058 2026-07-21 cs.RO cs.CV 新提交 62%

DROID-ANCHOR: Odometry-Anchored Recurrent Metric Depth Estimation

DROID-ANCHOR:基于里程计锚定的循环度量深度估计

Yuxuan Chen, Brook Du

机构 * UC Berkeley(加州大学伯克利分校)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 研究针对单目系统尺度问题,提出Metric-DROID架构,通过集成里程计,利用LSTM更新算子、不确定性感知度量后端及选择性残差微调策略,实现视觉SLAM与物理现实锚定,有效解决尺度模糊等问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17898 2026-07-21 cs.RO 新提交 61%

Manifold-Guided Motion Planning for Tight Assemblies

用于紧密装配的流形引导运动规划

Dror Livnat, Michael M. Bilevich, Michal Kleinbort, Dan Halperin

机构 * Blavatnik School of Computer Science and Artificial Intelligence, Tel-Aviv University(特拉维夫大学布拉瓦尼克计算机科学与人工智能学院)

专题命中 具身导航 :robotics(abstract,comments);分类 cs.RO

AI总结 针对刚体装配运动规划因几何约束面临的挑战,提出临界流形引导的CMG-RRT规划器。它利用配置空间分层细分,将采样偏向临界流形邻域引导探索,经证明概率完备,在基准测试中成功率达100%,还解决了麋鹿拆解谜题。

Comments Appeared in the 17th World Symposium on the Algorithmic Foundations of Robotics (WAFR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17852 2026-07-21 cs.RO 新提交 61%

Lifelong Localization in Dynamic Indoor Environments Combining Odometry with Sparse Distance Sampling

结合里程计与稀疏距离采样的动态室内环境终身定位

Michael M. Bilevich, Tomer Buber, Dan Halperin

机构 * Blavatnik School of Computer Science and Artificial Intelligence, Tel-Aviv University(特拉维夫大学布拉瓦尼克计算机科学与人工智能学院)

专题命中 具身导航 :navigation(abstract);分类 cs.RO;robotics(comments)

AI总结 研究动态室内环境中机器人定位问题,提出结合里程计与稀疏距离采样的终身定位框架,能实时解决绑架机器人问题,在静态和动态环境中均收敛到真实姿态,少量距离样本即可实现与SLAM相当的定位,具多方面优势。

Comments Appeared in the 2026 IEEE International Conference on Robotics and Automation (ICRA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16341 2026-07-21 cs.RO 新提交 61%

S.E.A.G.R: A Socially and Emotionally Aware Greeting Robot Framework with Dual-Layer Cultural and Affective Modulation

S.E.A.G.R:一个具有双层文化和情感调制的社交和情感感知问候机器人框架

Sajjad Hussain, Ranveer Bhura, Amandip Dutta, Shwetangshu Biswas

机构 * University of Brighton(布莱顿大学) National Institute of Technology, Silchar(锡尔恰尔国立理工学院)

专题命中 具身导航 :robotic(abstract);分类 cs.RO;robotics(comments)

AI总结 研究为不同文化背景和情感状态用户的人机交互设计SEAGR问候机器人框架,引入双层调制,结合多种技术在统一架构内实现,用低成本原型验证概念,当前缺用户研究验证,这是未来主要工作方向。

Comments 13 pages, 6 figures. Accepted for publication in the proceedings of the 18th International Conference on Social Robotics (ICSR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16987 2026-07-21 stat.ML cs.LG 新提交 57%

Twisted Schrödinger Bridge Matching

扭曲薛定谔桥匹配

Maxence Noble, Marie Scheid, Yazid Janati, Eric Moulines, Alain Durmus

专题命中 具身导航 :navigation(abstract);分类 cs.LG

AI总结 研究广义薛定谔桥问题,基于迭代马尔可夫拟合范式引入扭曲薛定谔桥匹配方法TSBM,它能处理连续和离散时间势,扩展了IMF方案,有新的桥匹配损失,还引入方差减少技术,实验证明其对高维轨迹推断有益。

Comments Preprint version

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17938 2026-07-21 cs.CV 新提交 57%

MuViSeg: Multi-View Segment Correspondences from Dense Geometry Priors

MuViSeg:基于密集几何先验的多视图段对应

Denis Fatykhoph, Timur Akhtyamov, Konstantin Pakulev, German Devchich, Gonzalo Ferrer

机构 * Applied AI Institute(应用人工智能研究所)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 研究针对经典图像对应与对象级推理的差距,基于段级匹配范式提出三个学习匹配头,包括LightGlue风格注意力头、DPT风格多尺度融合模块及多视图扩展,在多个数据集和任务中取得显著性能提升。

Comments 16 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17604 2026-07-21 cs.RO cs.SY eess.SY 新提交 57%

Stability and Comfort in Mobile Robot-Pedestrian Interactions

移动机器人与行人交互中的稳定性和舒适性

Alireza Jafari, Hong-Son Nguyen, Yen-Chen Liu

机构 * National Cheng Kung University(国立成功大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 研究针对非完整约束移动机器人,利用社会力模型等设计算法,通过仿真校准、实验比较及统计分析,证明算法稳定性,突出其在提高行人舒适性方面的优势。

Comments 21 pages, 9 figures, 12 tables, submitted for publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17598 2026-07-21 cs.AI cs.CL cs.SE 新提交 57%

Is Progressive Disclosure All You Need for Long-Context Agents?

长上下文智能体仅靠渐进式披露就够了吗?

Yifeng He, Yinzhe Zhao, Jicheng Wang, Hao Chen

机构 * University of California, Davis(加利福尼亚大学戴维斯分校) Zhejiang University(浙江大学) The University of Hong Kong(香港大学)

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 研究长文档问答中智能体获取文档路径自行决定读取内容的模式,通过对照研究,在InfiniteBench上对比原始文档导航、Agent Skills包设计与经典混合检索器,发现不同情况下各方法表现不同,渐进式披露在语料库大时作用关键。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17268 2026-07-21 cs.CV 新提交 57%

PACE: Polar Axis-Conditioned Estimation for PairUAV Relative Localization

PACE:用于PairUAV相对定位的极轴条件估计

Ze Rong

机构 * FST and ICI, University of Macau(澳门大学科技学院和创新与合作研究所)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 研究PairUAV相对定位问题,引入极轴条件估计方法,保留共享表示并分配特定于轴的读出接口,航向和距离采用不同证据路径,在官方测试中取得一定成绩,提供相关代码等资源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17032 2026-07-21 eess.SY cs.RO cs.SY 新提交 57%

Optimal Safety Control using High-Order Control Barrier Functions

使用高阶控制障碍函数的最优安全控制

Neng Li, Zuodong Pan, Jiaxing Wang, Weiguo Xia, Wei Ren

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 研究非线性控制系统最优安全控制问题,提出新型高阶控制障碍函数及控制Lyapunov函数,讨论二者关系与兼容性以建立最优控制器,通过四旋翼导航问题数值示例验证了结果的有效性。

Comments 8 pages, 3 figures, Accepted by ASCC2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16197 2026-07-21 cs.AI 新提交 57%

Some Large Language Models Exhibit Consistent Risk Attitudes

一些大语言模型表现出一致的风险态度

Bowen Sun, Rui Min, Yuxi Wang, Brian Odegaard, Qi Wang, Jing Du

机构 * University of Florida(佛罗里达大学) Northeastern University(东北大学)

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 研究大语言模型在不确定性下的风险态度,引入跨域框架,应用于六个大语言模型和100名人类参与者,发现多数大语言模型有任务内一致性、跨域排序稳定性,且风险态度分布趋向受限,为评估和调整AI系统奠定基础。

Comments 38

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12115 2026-07-21 cs.RO 版本更新 57%

A Behavioral State Vocabulary in Sony ERS-111 R-CODE

索尼 ERS-111 R-CODE 中的行为状态词汇表

Christopher A. Tucker

机构 * Sony(索尼)

专题命中 具身导航 :robotic(abstract);分类 cs.RO

AI总结 研究索尼 ERS-111 AIBO 的 R-CODE 样本行为图,通过语料库级分析比较命名状态,识别反复出现的控制词汇,发现其构建例程的语法,还指出这种基于状态的抽象对构建新行为例程及在受限机器人系统中的作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22881 2026-07-21 cs.RO eess.SP 版本更新 57%

A Vendor-Agnostic LiDAR Data Conversion System with Multi-Signal Detection and Multi-Format Output

一种支持多信号检测和多格式输出的厂商无关LiDAR数据转换系统

Param Patel, Jay Dave, Pratyush Chakraborty

机构 * BITS Pilani, Hyderabad Campus(比拉理工学院海德拉巴校区) Department of Electrical and Electronics Engineering, BITS Pilani, Hyderabad Campus(比拉理工学院海德拉巴校区电气与电子工程系) Department of Computer Science and Information Systems, BITS Pilani, Hyderabad Campus(比拉理工学院海德拉巴校区计算机科学与信息系统系)

专题命中 具身导航 :robotics(abstract);分类 cs.RO

AI总结 提出一种厂商无关的LiDAR数据转换系统,通过加权多信号方法自动识别传感器厂商,并输出五种标准格式,解决了多厂商SDK不兼容问题。

Comments Manuscript submitted at Software: Practice and Experience

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16264 2026-07-21 physics.geo-ph stat.AP stat.CO 新提交 50%

Towards Open Science: Monitoring Crustal Deformations in North America

迈向开放科学:监测北美地壳形变

Lionel Voirol, Haotian Xu, Yuming Zhang, Luca Insolia, Roberto Molinari, Stéphane Guerrier

专题命中 具身导航 :navigation(abstract)

AI总结 针对北美地区复杂构造活动,引入高度可扩展框架,利用标准计算资源对北美GNSS网络地壳形变进行推断,在保持性能同时实现计算增益,支持大规模监测,助力开放科学。

Comments 100 pages, 16 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16639 2026-07-21 cond-mat.stat-mech physics.bio-ph 新提交 50%

On the Information Required for Feedback Control

关于反馈控制所需的信息

Matthew P. Leighton, Jose M. Betancourt, Thierry Emonet, Benjamin B. Machta, Michael C. Abbott

专题命中 具身导航 :navigation(abstract)

AI总结 研究在信息有限时生物及工程系统对随机系统的反馈控制,推导信息率下限,得出性能-信息帕累托前沿,给出特定系统最优控制协议,通过非线性粒子定位等应用展示结果。

Comments 9 pages, 5 figures, + 14 pages SI

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14553 2026-07-21 physics.flu-dyn physics.comp-ph 版本更新 50%

Learning to traverse convective flows at moderate to high Rayleigh numbers

在中等至高雷诺数下学习穿越对流流动

Ao Xu, Hua-Lin Wu, Ben-Rui Xu, Heng-Dong Xi

专题命中 具身导航 :navigation(abstract)

AI总结 研究了在Prandtl数Pr=0.71和单元长宽比Γ=4的Rayleigh-Bénard对流中,自驱动惯性颗粒的导航问题,通过强化学习控制器选择推进加速度,发现随着雷诺数Ra增加,成功率变化趋势由急剧转向渐进,同时推进能量需求降低,POD分析揭示了流体重组的影响。

Comments 37 pages, 21 figures

Journal ref Journal of Fluid Mechanics 2026, 1039, A18

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身推理 17 篇

2607.16314 2026-07-21 cs.CV cs.LG cs.RO 新提交 82%

Depth-Regularized JEPA World Models Learn More Transferable Representations from Real Outdoor Robot Data

深度正则化JEPA世界模型从真实户外机器人数据中学习更多可转移表示

Usman M. Khan

机构 * Aigen(爱igen)

专题命中 具身推理 :world model(title,abstract);分类 cs.RO、cs.CV、cs.LG

AI总结 研究针对从真实户外机器人数据学习世界模型的挑战,引入深度作为训练几何先验,结合SIGReg等方法,训练18M参数模型,实验表明该方法在降低视觉里程计误差、增加意外分数分离及提高多步展开保真度等方面有显著提升,增强了模型泛化能力。

Comments 13 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14169 2026-07-21 cs.AI cs.LG 版本更新 81%

When a Verified World Model Still Loses: Play-Adequacy vs Prediction-Accuracy in LLM-Synthesized Code World Models

当经过验证的世界模型仍然失败时:大语言模型合成代码世界模型中的游戏充分性与预测准确性

Javier Aguilar Martín

机构 * AGILabs(AGILabs实验室)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.LG

AI总结 研究大语言模型合成的代码世界模型,发现其虽预测准确率高,但在游戏中仍失败,存在验证与正确的差距,揭示危害规律,指出更多数据无法修复,相同机制在信念推理函数上重现,表明规划世界模型充分性应基于搜索分布或游戏衡量。

Comments 41 pages, 4 figures. Code and reproduction log: https://github.com/JaviMaligno/code-world-models

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10203 2026-07-21 cs.LG cs.AI 版本更新 81%

Adaptive Compute in Latent World Models: When Depth Helps, Hurts, or Doesn't Matter

深度在组合中何时得以保留?潜在世界模型中的计算-质量机制

Achyuthan Sivasankar

机构 * New York University(纽约大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.LG

AI总结 研究探讨潜在世界模型中深度在组合时的情况,用浅度惩罚ρ测试九个深度思维控制任务,发现三种机制,揭示反转机制由训练产生,其与观察/动作维度等相关,还指出任务机制受多种因素影响及相关注意事项。

Comments 15 pages, 9 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07996 2026-07-21 cs.CV cs.RO 版本更新 81%

3D and 4D World Modeling: A Survey

3D和4D世界建模:一项综述

Lingdong Kong, Yu Yang, Jianbiao Mei, Youquan Liu, Ao Liang, Dekai Zhu, Dongyue Lu, Wei Yin, Xiaotao Hu, Mingkai Jia, Junyuan Deng, Kaiwen Zhang, Yang Wu, Tianyi Yan, Shenyuan Gao, Song Wang, Linfeng Li, Liang Pan, Yong Liu, Jianke Zhu, Wei Tsang Ooi, Steven C. H. Hoi, Ziwei Liu

机构 * WorldBench Team(WorldBench团队)

专题命中 具身推理 :world model(title,abstract);分类 cs.RO、cs.CV

AI总结 该综述针对世界建模中对3D和4D表示利用不足及定义分类缺失的问题,通过建立精确概念、引入结构化分类法,系统总结相关数据集和评估指标,讨论应用、挑战与方向,为3D和4D世界建模领域提供基础参考。

Comments Survey; Project Page at https://worldbench.github.io/survey GitHub Repo at https://github.com/worldbench/awesome-3d-4d-world-models

详情

展开后加载摘要…

URL PDF HTML 收藏