arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-07-02 至 2026-07-02 共收录 10 信号源:cs.CV, cs.GR, cs.RO

1. 点云 10 篇

2607.01015 2026-07-02 cs.CV 新提交 79%

SuperFlex: Deformable Superquadrics for Point Cloud Decomposition

SuperFlex: 用于点云分解的可变形超二次曲面

Gabriel Tavernini, Elisabetta Fedele, Tiago Novello, Leonidas Guibas, Marc Pollefeys, Francis Engelmann

机构 * ETH Zurich(苏黎世联邦理工学院) Stanford University(斯坦福大学) IMPA(巴西国家纯数学与应用数学研究所) USI Lugano(卢加诺大学)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 提出SuperFlex框架,通过新损失函数、弯曲和锥形变形提升超二次曲面分解精度,并利用高质量分解训练模型以鲁棒处理部分点云。

Comments Project page: https://superflex3d.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00514 2026-07-02 cs.CV cs.AI 新提交 79%

Cross4D-JEPA: Dense Cross-modal Correspondence Distillation for 4D Point Cloud Representation Learning

Cross4D-JEPA: 用于4D点云表示学习的密集跨模态对应蒸馏

Trung Thanh Nguyen, Hai Nguyen-Truong, Tu Vo, Hoang M. Truong, Tuan-Anh Vu

机构 * Nagoya University(名古屋大学) Northeastern University(东北大学) KC Machine Learning Lab(KC机器学习实验室) University of Science, Vietnam National University Ho Chi Minh City(胡志明市越南国立大学理科大学) University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 提出Cross4D-JEPA,通过教师-学生框架将冻结的2D基础模型(如DINOv2或V-JEPA 2)的密集补丁特征蒸馏到4D点编码器,实现每点对应和潜在空间匹配,在四个基准上优于模态内和全局跨模态基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00148 2026-07-02 cs.RO cs.CV 新提交 62%

3D Point World Models: Point Completion Enables More Accurate Dynamics Learning

3D点云世界模型:点云补全实现更准确的动力学学习

Skand Peri, Hung Nguyen, Chanho Kim, Li Fuxin, Stefan Lee

机构 * Oregon State University(俄勒冈州立大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 提出3D点云世界模型(3DPWM),通过先补全部分点云再学习动作条件动力学,实现长时程可靠推演和精确成本评估,支持多种机器人操作任务。

Comments 21 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16813 2026-07-02 cs.GR cs.CV 版本更新 62%

QuadLink: Autoregressive Quad-Dominant Mesh Generation via Point-Relation Learning

QuadLink: 通过点关系学习的自回归四边形主导网格生成

Yiheng Zhang, Zhe Zhu, Tingrui Shen, Zhuojiang Cai, Tianxiao Li, Zixing Zhao, Qiujie Dong, Zhiyang Dou, Jiepeng Wang, Le Wan, Yuwang Wang, Wenping Wang, Yuan Liu, Cheng Lin

机构 * Hong Kong University of Science and Technology(香港科技大学) Tencent VISVISE(腾讯VISVISE) Peking University(北京大学) Technical University of Munich(慕尼黑技术大学) Tsinghua University(清华大学) The University of Hong Kong(香港大学) Massachusetts Institute of Technology(麻省理工学院) Texas A&M University(德克萨斯大学) Macau University of Science and Technology(澳门科技大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV、cs.GR

AI总结 提出QuadLink框架,通过将点云链接成结构化面片,以自回归方式生成各向异性的四边形主导网格,实现高几何保真度和拓扑质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00529 2026-07-02 cs.CV 新提交 57%

NoPA: Non-Parametric Online 3D Scene Graph Generation

NoPA: 非参数化在线3D场景图生成

Qi Xun Yeo, Seungjun Lee, Yan Li, Gim Hee Lee

机构 * Department of Computer Science, National University of Singapore(新加坡国立大学计算机科学系)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 针对现有3D场景图生成方法无法实时运行的问题,提出NoPA,用非参数化分布表示物体,保留几何细节,并通过基于最大均值差异的合并策略和关系传播,实现实时且准确的在线场景图生成。

Comments This paper has been accepted in ECCV 26

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00215 2026-07-02 cs.RO 新提交 57%

ELMP: Efficient Learning for Motion Planning via Analytical Policy Gradients

ELMP: 通过解析策略梯度实现高效运动规划学习

Yixiao Li, Tifanny Portela, Jordis Herrmann, René Zurbrügg, Marco Hutter

机构 * Robotic Systems Lab, ETH Zürich(苏黎世联邦理工学院机器人系统实验室) ABB(ABB公司) ANYbotics(ANYbotics公司)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 提出ELMP框架,利用可微运动学层和自监督微调,通过密集碰撞、目标到达和平滑性目标直接优化策略,避免专家数据收集,实现数据高效的运动规划适应。

Comments 8 pages, 7 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29963 2026-07-02 cs.CV cs.CR 版本更新 57%

Explainability-Aware Frustum Attack: Exposing Structural Vulnerabilities in LiDAR-Based 3D Object Detectors

可解释性感知的视锥攻击:揭示基于LiDAR的3D目标检测器中的结构脆弱性

Chengzeng You, Binbin Xu, Soteris Demetriou

机构 * Imperial College London(帝国理工学院伦敦分校)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出可解释性引导的对抗分析方法,通过SALL方法生成通用显著性图,并设计EFA攻击,仅扰动最关键的视锥区域,在KITTI和nuScenes上使检测召回率下降超15个百分点,同时减少25-50%的扰动视锥数。

Comments European Conference on Computer Vision (ECCV), September 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01001 2026-07-02 cs.CV cs.AI 版本更新 57%

EgoSim: Egocentric World Simulator for Embodied Interaction Generation

EgoSim:用于具身交互生成的视角世界模拟器

Jinkun Hao, Mingda Jia, Ruiyan Wang, Hongrui Zhu, Jiafei Cao, Xihui Liu, Ran Yi, Lizhuang Ma, Jiangmiao Pang, Xudong Xu

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) The University of Hong Kong(香港大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 EgoSim通过建模可更新的世界状态,解决现有视角模拟器在3D grounding和动态更新上的不足,生成空间一致的交互视频并支持跨具身迁移。

Comments Project Page: egosimulator.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17920 2026-07-02 cs.CV 版本更新 57%

SegFly: A Dataset and 2D-3D-2D Paradigm for Aerial RGB-Thermal Semantic Segmentation at Scale

SegFly:大规模航空RGB-热红外语义分割的数据集与2D-3D-2D范式

Markus Gross, Sai Bharadhwaj Matha, Rui Song, Viswanathan Muthuveerappan, Conrad Christoph, Julius Huber, Daniel Cremers

机构 * Fraunhofer Institute IVI(弗劳恩霍夫交通与基础设施系统研究所) TU Munich(慕尼黑工业大学) MCML(慕尼黑机器学习中心) UCLA(加州大学洛杉矶分校) Uni Cambridge(剑桥大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 针对航空RGB-T数据集规模小、标注成本高和对齐困难的问题,提出几何驱动的2D-3D-2D范式,通过少量RGB标注自动生成密集伪标签并实现跨模态对齐,构建含2万+RGB图像和1.5万+RGB-T对的SegFly基准,实验表明该范式有效提升分割性能。

Journal ref ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00750 2026-07-02 physics.comp-ph 新提交 50%

LSR-Net: Long-Short-Range Operator Learning for Pattern Dynamics on Manifolds

LSR-Net: 用于流形上模式动力学的长短程算子学习

Qian Serena Hou, Zecheng Gan

专题命中 点云 :point cloud(abstract)

AI总结 提出LSR-Net框架,通过分解长程(SOE近似傅里叶乘子)和短程算子,结合高斯网格化与FFT,高效学习平面、球面及一般流形上的模式动力学,在多个基准系统上精度和稳定性优于基线模型。

Comments 27 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏