arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-07-27 至 2026-07-27 共收录 8 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 2 篇

2410.00713 2026-07-27 cs.CV 版本更新 57%

RAD: A Dataset and Benchmark for Real-Life Anomaly Detection with Robotic Observations

RAD:面向机器人观测的真实异常检测数据集与基准

Kaichen Zhou, Xinhai Chang, Taewhan Kim, Jiadong Zhang, Yang Cao, Chufei Peng, Fangneng Zhan, Hao Zhao, Hao Dong, Kai Ming Ting, Ye Zhu

机构 * Massachusetts Institute of Technology(麻省理工学院) Peking University(北京大学) Carnegie Mellon University(卡内基梅隆大学) Great Bay University(大湾大学) Harvard University(哈佛大学) Tsinghua University(清华大学) Nanjing University(南京大学) Deakin University(德克萨斯大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出RAD数据集,包含13类日常物体和4种缺陷,从60多个机器人视角在非受控光照下采集,用于评估2D特征、3D重建和视觉语言模型在姿态无关的异常检测中的表现,发现2D方法优于3D和VLM方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13826 2026-07-27 eess.IV cs.CV 版本更新 57%

Latent Interpolation Learning Using Diffusion Models for Cardiac Volume Reconstruction

使用扩散模型进行心脏容积重建的潜在插值学习

Niklas Bubeck, Suprosanna Shit, Chen Chen, Can Zhao, Pengfei Guo, Dong Yang, Georg Zitzlsberger, Daguang Xu, Bernhard Kainz, Daniel Rueckert, Jiazhen Pan

机构 * School of Computation, Information and Technology, Technical University Munich(技术大学慕尼黑计算信息学院) Munich Center for Machine Learning(慕尼黑机器学习中心) Department of Quantitative Biomedicine, University of Zurich(苏黎世大学定量生物医学系) Institute of Biomedical Engineering, Department of Engineering Science, University of Oxford(牛津大学生物医学工程研究所) Imperial College London(伦敦帝国学院) University of Sheffield(谢菲尔德大学) NVIDIA(英伟达) Department of Computing, Imperial College London(伦敦帝国学院计算机系) Department AIBE of Friedrich-Alexander-Universität Erlangen-Nürnberg(埃尔兰根-纽伦堡大学AIBE系) School of Medicine, Klinikum Rechts der Isar, Technical University of Munich(慕尼黑技术大学医学院,莱纳特医院)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 针对心脏磁共振成像二维切片采集稀疏致容积信息不完整、现有重建方法有局限的问题,提出CaLID框架,创新采用基于扩散模型的插值方案、潜在空间高效计算法,仅用稀疏二维图像输入达SOTA,扩展到二维加时间数据,提升了重建质量和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 1 篇

2607.21448 2026-07-27 cs.CV 版本更新 88%

GrainGS: Gradient-Decoupled Gaussian Splatting for Efficient Dynamic Novel View Synthesis

GrainGS:用于高效动态新视图合成的梯度解耦高斯点云渲染

Jiahao He, Yihua Shao, Zhengkai Zhao, Pan Gao, Fei Ma, Jingcai Guo, Hao Tang, Nicu Sebe, Qi Tian

机构 * College of Artificial Intelligence, Nanjing University of Aeronautics and Astronautics(南京航空航天大学人工智能学院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Department of Computing, Hong Kong Polytechnic University(香港理工大学计算学系) School of Computer Science, Peking University(北京大学计算机科学学院) Guangdong Laboratory of Artificial Intelligence and Digital Economy(广东省人工智能与数字经济实验室) Huawei Consumer Business Group, Huawei(华为消费者业务集团) Department of Information Engineering and Computer Science, University of Trento(特伦托大学信息工程与计算机科学系)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);novel view synthesis(title,abstract);分类 cs.CV

AI总结 针对动态场景重建问题,GrainGS结合分层锚点框架与高斯变形,通过静态预热、停止梯度操作等实现各高斯独立预测时间偏移及规范-残差外观分解,在合成和真实多视图基准测试中展现出高重建质量、实时渲染及紧凑存储等优势。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 4 篇

2512.03424 2026-07-27 cs.CV 版本更新 79%

DM3D: Dynamic Mamba via Offset-Guided Feature Resampling for Point Cloud Understanding

DM3D:通过偏移引导的可微扫描实现点云理解的可变形Mamba

Bin Liu, Chunyang Wang, Xuelian Liu, Xuemei Li, Ge Zhang

机构 * Xi'an Key Laboratory of Active Photoelectric Imaging Detection Technology(西安市主动光电成像探测技术重点实验室)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 DM3D提出了一种可变形Mamba架构,通过偏移引导的可微扫描机制实现点云的结构自适应序列化,结合可变形空间采样和可微重新排序,提升点云理解性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14021 2026-07-27 cs.RO 版本更新 57%

Industrial Dexterity Benchmark: A Hardware-Software Benchmarking Platform for Industrial Dexterous Manipulation

工业灵巧性基准测试:一个用于工业灵巧操作的硬件-软件基准测试平台

Honglu He, Jacob Laufer, Zhiwu Zheng, David Elkan-gonzalez, Raman Goyal, Xinyi Li, Su Lu, Mishek Musa, Berke Saat, Nicolas Tan, Colm Prendergast

机构 * Analog Devices, Inc.(亚德诺半导体技术有限公司)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 针对工业灵巧操作瓶颈,提出从经典流程到端到端多模态模仿学习框架的转变,介绍了IDB板、DAG-ROS框架和AG-iDP3策略框架,通过数据中心电缆操作实验表明新策略在多方面优于传统方法,推动向可扩展机器人自动化发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03499 2026-07-27 eess.IV cs.CV 版本更新 57%

GeoDiff-SAR: A Geometric Prior Guided Diffusion Model for SAR Image Generation

GeoDiff-SAR:一种基于几何先验的扩散模型用于SAR图像生成

Fan Zhang, Xuanting Wu, Fei Ma, Qiang Yin, Yuxin Hu

机构 * College of Information Science and Technology, Beijing University of Chemical Technology(信息科学与技术学院,北京化工大学) Aerospace Information Research Institute, Chinese Academy of Sciences(航天信息研究所,中国科学院)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 GeoDiff-SAR通过引入几何先验引导扩散模型,提升SAR图像生成的保真度和分类准确性,尤其在不同方位角识别性能上有显著提升。

Comments 3 pages, 1 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20577 2026-07-27 cs.LG cs.AI 版本更新 50%

AI-Driven Surrogate Models for Predicting Electrode-Scale Discharge Behavior in Lithium-Ion Batteries

用于预测锂离子电池电极尺度放电行为的人工智能驱动替代模型

Mengda Xing, Jean-Marie Lagniez, Alejandro Franco

专题命中 点云 :point cloud(abstract)

AI总结 研究锂离子电池电极尺度放电行为预测难题,提出基于Swin3D Transformer的深度学习替代管道,集成高斯位置编码和时间编码模块,实验表明其预测准确且大幅降低计算开销,为电池设计优化提供高效框架。

Journal ref Lecture Notes in Computer Science, 2027, Lecture Notes in Artificial Intelligence, 16615, pp.120-131

详情

展开后加载摘要…

URL PDF HTML 收藏

4. SLAM与定位 1 篇

2504.19345 2026-07-27 cs.HC 版本更新 67%

Navigating the Last Mile: Evaluating Head- and Cane-Mounted Cameras for Egocentric Spatial Awareness

解决最后一公里问题:评估用于自我中心空间感知的头戴式和手杖式摄像头

Apurv Varshney, Lucas Nadolskis, Tobias Höllerer, Michael Beyeler

专题命中 SLAM与定位 :NeRF(abstract);3D reconstruction(abstract)

AI总结 研究盲人行人“最后一公里”导航问题,通过混合方法,调查盲人使用者习惯并进行案例研究,用SLAM和NeRFs比较头戴与手杖式摄像头,发现核心权衡,为混合XR系统架构提供考量。

详情

展开后加载摘要…

URL PDF HTML 收藏