arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-08-07 至 2026-08-07 共收录 96 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 35 篇

2607.21853 2026-08-07 cs.HC cs.SI 版本更新 50%

Filtering Offensive Content Changes Its Visibility but Not User Behavior: Two Randomized Controlled Trials with 200,000 Users on Nextdoor

过滤攻击性内容会改变其可见性,但不会改变用户行为:在Nextdoor上针对20万用户进行的两项随机对照试验

David J. Grüning, Matthew Katsaros

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究在Nextdoor平台针对20万用户进行两项随机对照试验,探究减少攻击性内容可见性的干预措施效果。通过不同过滤机制,虽大幅降低了攻击性内容可见性,但未改变用户行为,凸显了在线平台管理的复杂性。

Comments 9 pages, 3 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18567 2026-08-07 quant-ph physics.atom-ph 版本更新 50%

Four- and six-photon stimulated Raman transitions for coherent qubit and qudit operations

四光子和六光子受激拉曼跃迁用于相干量子比特和量子三态操作

Gabriel J. Gregory, Evan R. Ritchie, Alex Quinn, Sean Brudney, David J. Wineland, David T. C. Allcock, Jameson O'Reilly

专题命中 机器人操作 :manipulation(abstract)

AI总结 通过四光子和六光子受激拉曼跃迁实现高保真度的量子比特和量子三态操作

Comments 16 pages, 5 figures, SM 31 pages, SM 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22680 2026-08-07 physics.optics quant-ph 版本更新 50%

Integrated polarization-entangled photon source for wavelength-multiplexed quantum networks

集成的偏振纠缠光子源用于波长复用的量子网络

Xiaodong Shi, Yue Li, Jinyi Du, Lin Zhou, Ran Yang, En Teng Lim, Sakthi Sanjeev Mohanraj, Mengyao Zhao, Xu Chen, Xiaojie Wang, Guangxing Wu, Hao Hao, Veerendra Dhyani, Sihao Wang, Alexander Ling, Di Zhu

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出了一种基于超薄薄膜锂铌酸盐的集成偏振纠缠光子源,实现了波长复用的量子网络中的纠缠分布,展示了高保真贝尔态和高亮度的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02659 2026-08-07 physics.optics physics.plasm-ph 版本更新 50%

Focusing Terawatt-Scale Lasers Using Holographic Gaseous Lenses

利用全息气体透镜聚焦太瓦级激光

Devdigvijay Singh, Ke Ou, Sida Cao, Victor M. Perez-Ramirez, Harsha Rajesh, Debolina Chakraborty, Elaine Koh, Caleb Redshaw, Pelin Dedeler, Albertine Oudin, Michelle M. Wang, Julia M. Mikhailova, Livia Lancia, Caterina Riconda, Pierre Michel, Matthew R. Edwards

专题命中 机器人操作 :manipulation(abstract)

AI总结 该研究针对太瓦级激光的光学损伤问题,实验演示了抗损伤的全息气体透镜,可高效调控高能激光,为下一代超高功率激光器提供了新方案。

Comments 17 pages, 9 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01874 2026-08-07 physics.app-ph 50%

Graded phononic metamaterials: Scalable design meets scalable microfabrication

Charles Dorn, Vignesh Kannan, Ute Drechsler, Dennis M. Kochmann

专题命中 机器人操作 :manipulation(abstract)

Journal ref Nature Communications 17, 3192 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身导航 13 篇

2608.05597 2026-08-07 cs.CV 新提交 88%

Uncertainty-Aware World Model for Aerial Image-Goal Navigation

面向航拍图像目标导航的不确定性感知世界模型

Deyi Zhu, Haoyu Fan, Yinan Zhu, Weichen Zhang, Shilin Ma, Xinlei Chen, Yansong Tang

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

专题命中 具身导航 :navigation(title,abstract);world model(title,abstract);分类 cs.CV

AI总结 针对航拍图像目标导航中现有世界模型的未来状态预测不足问题,提出UA-NWM模型,将轨迹评分建模为条件分布外检测,仅用不可解释残差评分,实验验证其性能与实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19229 2026-08-07 cs.RO cs.AI cs.CV cs.LG cs.SY eess.SY 版本更新 83%

NavTrust: Benchmarking Trustworthiness for Embodied Navigation

NavTrust:体感导航的可信度基准测试

Huaide Jiang, Yash Chaudhary, Yuping Wang, Zehao Wang, Raghav Sharma, Manan Mehta, Yang Zhou, Lichao Sun, Zhiwen Fan, Zhengzhong Tu, Jiachen Li

机构 * Trustworthy Autonomous Systems Laboratory at the University of California, Riverside(加州大学河滨分校可信自主系统实验室) University of Michigan(密歇根大学) Workday University of Southern California(南加州大学) Texas A&M University(德克萨斯A&M大学) Lehigh University(莱斯大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 NavTrust通过系统性地对输入模态进行腐蚀,评估体感导航性能的鲁棒性,揭示了现有方法在真实环境中的性能缺陷,并提出改进策略。

Comments IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026); Project Website: https://navtrust.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19880 2026-08-07 cs.RO cs.CV 版本更新 81%

EA-Nav: Learning Safe Visual Navigation Policies with Embodiment Awareness

EA-Nav:通过具身感知学习安全的视觉导航策略

Jialu Zhang, Yong Du, Xianda Guo, Shunwang Sun, Xinqi Liu, Yue Sun, Guodong Lu, Wei Sui, Jituo Li

机构 * Zhejiang University(浙江大学) Wuhan University(武汉大学) Hunan University(湖南大学) D-Robotics(D机器人公司)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 针对跨具身导航挑战,提出基于模仿学习的具身感知导航框架,通过模块化多阶段设计,预训练构建数据集并引入具身几何,微调设计多模态信息注入机制,有效提高不同具身设置下的导航性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05506 2026-08-07 cs.CV 版本更新 80%

Robust Scene Transfer for PointGoal Navigation via Privileged Sensor Guided Contrastive Learning

基于特权传感器引导对比学习的点目标导航鲁棒场景迁移

Amirhossein Zhalehmehrabi, Tiziano Tezze, Alberto Castelini, Alessandro Farinelli

机构 * University of Padua(帕多瓦大学) ETH Zurich(苏黎世联邦理工学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.CV;robotics(comments)

AI总结 提出一种传感器引导的自适应对比学习框架,利用特权LiDAR传感器在训练时引导视觉编码器学习导航相关结构,并通过解耦表征学习与策略优化以及跨阶段域不匹配来提升策略级场景迁移能力。

Comments 8 pages, Accepted to IEEE Robotics and Automation Letters (RA-L)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05365 2026-08-07 cs.RO 新提交 79%

Unified Planning-Learning Framework for Robust UUV Navigation Under Partial Observability

部分可观测条件下用于自主水下航行器(UUV)鲁棒导航的统一规划-学习框架

Md Ether Deowan, Eleni Kelasidi

机构 * NTNU(挪威科技大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 该研究提出统一规划-学习框架,结合占用地图构建、规划与控制,通过行为树蒸馏等技术提升UUV在部分可观测动态水下环境的导航鲁棒性与安全性,经仿真验证优于基线方法。

Comments 8 pages, 6 figures. Accepted for presentation at the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026), Philadelphia, PA, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03699 2026-08-07 cs.RO cs.SY eess.SY 版本更新 79%

Lost in Time? Continuous Symmetry and Identifiability in Aided Inertial Navigation with Unknown Measurement Delays

迷失在时间中?具有未知测量延迟的辅助惯性导航中的连续对称性和可识别性

Jonathan Kelly, Phone Thiha Kyaw, Mattew Giamou

机构 * Space & Terrestrial Autonomous Robotic Systems (STARS) Laboratory at the University of Toronto Institute for Aerospace Studies (UTIAS)(多伦多大学航天研究所空间与地面自主机器人系统(STARS)实验室) Autonomous Robotics & Convex Optimization (ARCO) Laboratory in the Department of Computing and Software, McMaster University(麦克马斯特大学计算与软件系自主机器人与凸优化(ARCO)实验室)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 研究辅助导航中单个辅助传感器测量相对于惯性测量流有未知但恒定延迟时系统的可识别性,利用特殊伽利略群刻画无信息轨迹并与延迟测量模型连续对称性相关,揭示可识别性失败轨迹类别及与线性化分析联系。

Comments Accepted to the IEEE International Conference on Multisensor Fusion and Integration (MFI), Pilsen, Czechia, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08265 2026-08-07 cs.LG 79%

Airborne Magnetic Anomaly Navigation with Neural-Network-Augmented Online Calibration

基于神经网络增强的在线校准航空磁异常导航

Antonia Hager, Sven Nebendahl, Alexej Klushyn, Jasper Krauser, Torleiv H. Bryne, Tor Arne Johansen

专题命中 具身导航 :navigation(title,abstract);分类 cs.LG

AI总结 本文提出一种基于神经网络增强的在线校准航空磁异常导航方法,通过自适应卡尔曼滤波器实时补偿飞机磁干扰,实现高精度导航性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03604 2026-08-07 cs.HC 版本更新 71%

Language Scent: Exploring Cross-Language Information Navigation

语言气味:探索跨语言信息导航

Jiawen Stefanie Zhu, Katharina Reinecke, Tanushree Mitra

专题命中 具身导航 :navigation(title)

AI总结 研究探讨了多语言用户在信息检索中跨语言切换的机制,提出'语言气味'理论,并设计Niffler系统支持跨语言信息导航,通过上下文线索和工具提升探索性搜索策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05797 2026-08-07 cs.LG cs.CL 新提交 57%

Predicting Task Difficulty Without Rollouts

无需展开预测任务难度

Stefan Krsteski, Charlotte Meyer

机构 * Andromede AI(安卓迈德人工智能)

专题命中 具身导航 :navigation(abstract);分类 cs.LG

AI总结 该研究针对17个跨多领域的智能体基准,提出无需展开的任务难度预测方法,发现token级熵是有效预测信号,可通过难度残差暴露环境缺陷,助力校准基准与构建训练课程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05586 2026-08-07 cs.RO 新提交 57%

PathCover: A Fast Convex Decomposition along a Path via Randomized Iterative Space Partitioning (RISP) on Point Clouds

PathCover:基于点云的随机迭代空间划分(RISP)沿路径的快速凸分解

Kunal S. Narkhede, Abhijeet M. Kulkarni, Guoquan Huang, Ioannis Poulakakis

机构 * University of Delaware(特拉华大学) Athena Research Center(雅典娜研究中心) National Technical University of Athens(雅典国家技术大学) HERON–Center of Excellence in Robotics(赫伦机器人卓越中心)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 PathCover是基于点云的快速凸分解框架,采用RISP算法,可高效生成无障碍物多面体,速度较现有方法提升一个数量级,经仿真与实机验证适用于机器人导航。

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02018 2026-08-07 cs.CV 版本更新 57%

Invisible Ink Threats: Adversarial Goals Behind Legitimate Tasks in Computer-Use Agents

隐形墨水威胁:计算机使用智能体中合法任务背后的对抗目标

Jia-Chen Zhang, Ze-Yu Zhang, Kai-Wei Zhang

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 该研究针对计算机使用智能体的隐形墨水威胁,构建II-Bench与HITLCUA框架评估后发现,低危害注入可绕过防御,暴露出现有CUAs的安全风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06169 2026-08-07 physics.atom-ph quant-ph 新提交 50%

Dual-Faraday-laser-pumped cesium beam clock with $7.7\times 10^{-13}/\sqrtτ$ frequency stability

双法拉第激光抽运铯束钟,频率稳定度为$7.7\times 10^{-13}/\sqrt{τ}$

Xiaomin Qin, Suyang Wei, Haijun Chen, Yufei Yan, Qiang Wei, Hangbo Shi, Zhiyang Wang, Zheng Xiao, Zijie Liu, Tiantian Shi, Jingbiao Chen

专题命中 具身导航 :navigation(abstract)

AI总结 该研究开发了基于原子参考低噪声激光架构的双法拉第激光抽运铯束钟,实现$7.7\times 10^{-13}/\sqrt{τ}$的频率稳定度,为可部署精密授时等提供高性能频率参考。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15536 2026-08-07 cs.HC 版本更新 50%

'OpenBloom': A Stigma-Sensitive LLM Design Probe for Navigating Reproductive Well-being Conversations with Young Adults

「OpenBloom」:一种面向生殖健康的污名敏感型大语言模型设计探针

Yang Hong, Ashley Hua, Adya Daruka, Sharifa Sultana

专题命中 具身导航 :navigation(abstract)

AI总结 提出OpenBloom,利用大语言模型将生殖健康文章转为问题提示,通过34名参与者的136次交互研究,探讨AI生成问题如何与社会污名、情境敏感性和反思性互动,并讨论女性主义HCI、可争议性和价值敏感AI框架的应用。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身推理 17 篇

2608.05799 2026-08-07 cs.RO cs.CV 新提交 86%

XEWorld: Can Action-Conditioned World Models Generalize to Unseen Robot Embodiments?

XEWorld:基于动作的世界模型能否泛化至未见过的机器人 embodiment?

Yixiang Chen, Jiabing Yang, Yuan Xu, Qisen Ma, Keji He, Peiyan Li, Kai Wang, Ziheng He, Xiangnan Wu, Jing Liu, Nianfeng Liu, Yan Huang, Liang Wang

专题命中 具身推理 :world model(title,abstract);manipulation(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 该研究针对XEWorld测试平台,发现基于动作的世界模型因视觉与物理动力学解耦不足,难以跨机器人 embodiment 泛化,需架构创新突破瓶颈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06020 2026-08-07 cs.AI cs.LG 新提交 84%

From Economic Agents to Agentic Economies: A Systems Blueprint for Economic World Models

从经济智能体到智能体经济:经济世界模型的系统蓝图

Jiale Han, Xiang Li, Jing Qian, Wenyuan Gu, Pin Gao, Ye Luo, Hongyuan Zha, Dacheng Tao, Benyou Wang, Lin William Cong

机构 * Shenzhen Loop Area Institute(深圳河套学院) School of Data Science, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)数据科学学院) University of Hong Kong(香港大学) Nanyang Technological University(南洋理工大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出经济世界模型(EWM)的六级能力阶梯实施蓝图,旨在加速可作为人类决策沙箱与AI智能体基础的下一代高保真经济模拟环境开发。

Comments Project page: https://github.com/FreedomIntelligence/Awesome-Economic-World-Models

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05371 2026-08-07 cs.LG 新提交 83%

Quantum-Structured World Models (QSWMs) for Predictive Latent Dynamics

用于预测潜在动力学的量子结构化世界模型(QSWMs)

Hailong Jiang, Emran Hossain, Feng Yu, Jianfeng Zhu, Guilin Zhang, Wulan Guo

机构 * Youngstown State University(扬斯敦州立大学) Kent State University(肯特州立大学) George Washington University(乔治·华盛顿大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.LG

AI总结 本文提出量子结构化世界模型(QSWMs),研究量子启发结构对世界建模的作用,在基本元胞自动机上评估其变体,发现复值QSWM局部预测潜力良好但类密度矩阵变体存在长时序预测局限。

Comments 19 pages, 5 figures,

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08991 2026-08-07 cs.CV cs.LG 版本更新 81%

Deterministic World Models for Closed-loop Reachability Analysis of End-to-End Vision-based Control

确定性世界模型用于闭环视觉系统验证

Yuang Geng, Zhongzheng Zhang, Chengzhen Jiang, Yanru Li, Xinyang Wang, Zhuoyang Zhou, Hoang-Dung Tran, Ivan Ruchkin

机构 * University of Florida(佛罗里达大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.CV、cs.LG

AI总结 本文提出确定性世界模型,通过直接映射系统状态到生成图像,消除不可解释的潜在变量,提升闭环视觉系统验证的精度与性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03556 2026-08-07 cs.CV cs.RO 版本更新 81%

Afford-X: Generalizable and Slim Affordance Reasoning for Task-oriented Manipulation

Afford-X:面向任务型操作的通用且轻量化的可供性推理模型

Xiaomeng Zhu, Yuyang Li, Leiyao Cui, Pengfei Li, Huan-ang Gao, Yixin Zhu, Hao Zhao

机构 * Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院) Department of Computer Science and Engineering, Hong Kong University of Science and Technology(香港科技大学计算机科学与工程系) Shenyang Institute of Automation, Chinese Academy of Sciences(中国科学院沈阳自动化研究所) Institute for Al Industry Research, Tsinghua University(清华大学人工智能产业研究院) Department of Computer Science, Tsinghua University(清华大学计算机科学系)

专题命中 具身推理 :manipulation(title);robotics(abstract);分类 cs.RO、cs.CV

AI总结 研究人员推出LVIS-Aff数据集,开发了Afford-X可供性推理模型,其性能优于现有非LLM方法和此前会议论文结果,参数紧凑、推理速度快,可部署于本地设备助力机器人任务导向型操作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05891 2026-08-07 cs.AI cs.CL 新提交 79%

AppDeltaWorld: Transition-Grounded Delta Code World Model for Mobile GUI Agents

AppDeltaWorld:面向移动GUI智能体的基于转换的增量代码世界模型

Weikai Xu, Yunren Feng, Haoxiang Lei, Kun Huang, Yuxuan Liu, Kang Zhao, Xiaolin Hu, Shuo Shang, Bo An

专题命中 具身推理 :world model(title,abstract);分类 cs.AI

AI总结 针对移动GUI智能体轨迹获取难、模拟环境扩展难等问题,提出AppDeltaWorld增量代码世界模型,在CMGUIBench-500评估中表现最优,支撑的AppDeltaAgent在多基准达SOTA,测试时强化学习可进一步提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05720 2026-08-07 cs.CV 新提交 79%

PhyLatent: Learning Dynamics-Relevant Representations for JEPA World Models

PhyLatent:为JEPA世界模型学习与动力学相关的表征

Xi Zeng, Haojie Ren, Ziying Song

机构 * School of Mechanical and Aerospace Engineering, Nanyang Technological University(南洋理工大学机械与航天工程学院) School of Artificial Intelligence (School of Software), Yanshan University(燕山大学人工智能学院(软件学院)) The University of Sheffield(谢菲尔德大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.CV

AI总结 PhyLatent为JEPA世界模型设计训练目标,解决其三类失效模式,在OGBench-Cube等数据集上显著降低失效率、提升MPC成功率,证明全局非坍塌不足以学习可靠的JEPA状态空间。

Comments 16 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05706 2026-08-07 cs.CV 新提交 79%

LAWM-3D: Learning 3D-Aware Latent Actions from Human Videos for Generalizable Robot World Models

LAWM-3D:从人类视频中学习具有3D感知能力的潜在动作以构建可泛化的机器人世界模型

Jiarui Yang, Jiale Zhange, Jiawei Li, Hang Guo, Wen Huang, Jinpeng Wang, Peidong Liu, Shu-Tao Xia

专题命中 具身推理 :world model(title,abstract);分类 cs.CV

AI总结 本研究针对现有潜在动作模型缺乏3D感知能力的问题,提出LAWM-3D模型,通过多视图动作 token 化、几何对齐约束和RGB-D联合重建目标,实现了性能SOTA的机器人世界模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05695 2026-08-07 cs.AI cs.CL cs.CR 新提交 79%

DreamGuard: Efficient Runtime Guardrail for LLM Agents via Risk-Aware World Model

DreamGuard:基于风险感知世界模型的LLM智能体高效运行时护栏

Wenhao Lin, Chenyu Yu, Xingwei Lin, Sicong Cao, Xiang Chen, Lei Xue, Le Yu, Letian Sha, Chunming Wu

专题命中 具身推理 :world model(title,abstract);分类 cs.AI

AI总结 针对LLM智能体运行时护栏的长视野风险盲点问题,提出基于风险感知世界模型的主动式护栏DreamGuard,经实验验证其安全-效用权衡更优且延迟低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05523 2026-08-07 cs.CV 新提交 79%

HERA: Historical Evidence Routing Adapter for Physical Prediction in Latent World Models

HERA:用于潜在世界模型中物理预测的历史证据路由适配器

Yuanruyi, Yue Cao, Haojia Gao, Guanqiu Guo, Ziyuezhang, Shangqin, Junbo Tan, Bokui Chen, Zhuo Zou, Xueqian Wang

专题命中 具身推理 :world model(title,abstract);分类 cs.CV

AI总结 本研究提出 HERA 框架,通过 RRPM 适配器为冻结潜在预测器路由历史证据,在 IntPhys2 数据集上显著提升 V-JEPA 2-G 的物理预测准确率,验证了该策略的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21910 2026-08-07 cs.AI cs.DB 版本更新 79%

TRW: TRACE-RealWorld---An Auditable Consistency Contract for World Models as Materialized Views

TRW: TRACE-RealWorld——作为物化视图的世界模型的可审计一致性契约

Edward Y. Chang

机构 * Stanford University(斯坦福大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI

AI总结 TRACE-RealWorld解决在变化物理世界中维护物化视图的问题,提出承诺级有效性抽象等数据管理方法,通过端到端评估测量多方面指标,贡献是为部署世界表示提供一致性、恢复和问责契约。

Comments v2 propagates declared point and extended hazards through the composition theorem and separates point-event from interval-risk budgets. It aligns Flood-SAR adjudication with each hazard class, sharpens calibration-slack and drift claims, adds bootstrap Monte Carlo error and joint-coverage requirements, revises terminology, and expands related-work context

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13460 2026-08-07 cs.CV 版本更新 79%

VISA: VLM-Guided Instance Semantic Auditing for 3D Occupancy World Models

VISA: VLM引导的实例语义审计用于3D占据世界模型

Ruiqi Xian, Yuehan Xian, Jing Liang, Xuewei Qi, Dinesh Manocha

机构 * University of Maryland College Park(马里兰大学帕克分校) Nanjing University of Posts and Telecommunications(南京邮电大学) Stanford University(斯坦福大学) Motional AD Inc.(Motional AD公司)

专题命中 具身推理 :world model(title,abstract);分类 cs.CV

AI总结 提出VISA方法,利用离线VLM对每个物理对象实例进行结构化语义审计,并通过可靠性加权损失蒸馏到3D占据模型中,无需VLM推理即可提升封闭集占据mIoU。

详情

展开后加载摘要…

URL PDF HTML 收藏