arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-07-02 至 2026-07-02 共收录 37 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 11 篇

2607.00375 2026-07-02 cs.CV 新提交 79%

LIST3R: Long-sequence Instance-aware 3D Reconstruction

LIST3R: 长序列实例感知三维重建

Jing Gao, Wei Wang, Feiran Wang, Yan Yan

机构 * Beijing Jiaotong University(北京交通大学) University of Illinois Chicago(伊利诺伊大学芝加哥分校)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV

AI总结 提出LIST3R框架,通过实例锚点组织长序列三维重建,将子序列局部观测整合为全局一致场景,在长序列基准上实现更优轨迹与重建质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00829 2026-07-02 cs.CV 新提交 57%

Stitched Embeddings: A Unified Latent Space for 3D Garments and 2D Patterns

缝合嵌入:3D服装与2D纸样的统一潜在空间

Andrea Sanchietti, Riccardo Marin, Bharat Lal Bhatnagar, Yuanlu Xu, Gerard Pons-Moll

机构 * University of Tübingen(图宾根大学) Tübingen AI Center(图宾根人工智能中心) Technical University of Munich(慕尼黑工业大学) Munich Center for Machine Learning(慕尼黑机器学习中心) Max Planck Institute for Informatics(马克斯·普朗克信息学研究所) Meta

专题命中 三维重建 :3D vision(abstract);分类 cs.CV

AI总结 提出首个无需模拟的框架Stitched Embeddings,通过BoxMesh中间表示在统一双向潜在空间中实现3D服装重建与2D纸样推断,达到高精度高效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00498 2026-07-02 cs.CV 新提交 57%

Robust 3D Alignment of Generative Reconstructions via Partial Monocular Observations

基于部分单目观测的生成式重建鲁棒3D对齐

Yuchen Zhang, Luanyuan Dai, Yiwei Wang, Xiwei Xu, Jianing Zhang, Johnny. r. zhang, Xianhui Meng, Yanbiao Ma, Jiayi Ma, Xiaoshuai Hao

机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学与技术学院) School of Computer Science and Engineering, Nanjing University of Science and Technology(南京理工大学计算机科学与工程学院) School of Engineering and Applied Science, University of Pennsylvania(宾夕法尼亚大学工程与应用科学学院) School of Tech Electrical and Information Engineering, Tianjin University(天津大学电气与信息工程学院) Independent Researcher(独立研究员) School of Electronic Engineering and Information Science, University of Science and Technology of China(中国科学技术大学电子工程与信息科学学院) Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学高瓴人工智能学院) School of Robotics, Wuhan University(武汉大学机器人学院) Xiaomi EV(小米汽车)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 针对生成式3D重建与部分单目观测对齐的挑战,提出无训练可解释几何对齐框架,通过Sim(3)变换恢复度量尺度与位姿,引入幻觉滤波抑制异常,在基准测试中显著优于传统和学习方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00417 2026-07-02 cs.CV cs.AI 新提交 57%

EO-VGGT: Orbital Ray-Conditioned 3D Foundation Models for Satellite Multi-View Reconstruction

EO-VGGT:用于卫星多视角重建的轨道光线条件化3D基础模型

Qiyan Luo, Yingdong Pi, Lekang Wen, Jie Yang, Xiaoyu Wang, Haiming Zhang, Mi Wang

机构 * State Key Laboratory of Information Engineering in Surveying, Mapping and Remote Sensing, Wuhan University(武汉大学测绘遥感信息工程国家重点实验室) Hubei Luojia Laboratory(湖北珞珈实验室)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 针对卫星遥感中透视模型与轨道几何不匹配的问题,提出EO-VGGT框架,通过几何相关约束选择、传感器射线编码器和射线指向适配器,实现冻结视角驱动模型适应轨道观测,提升多视角卫星3D重建质量。

Comments This article is submitted to journal and under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00382 2026-07-02 cs.CV 新提交 57%

Vitality-Aware Compression for Efficient Image-to-Shape Diffusion Transformers

活力感知压缩:面向高效图像到形状扩散Transformer

Jaeah Lee, Hyunjin Kim, Jaewoong Cho, Gihyun Kwon

机构 * KRAFTON AI, Republic of Korea(KRAFTON AI, 韩国) Amazon, Australia(亚马逊, 澳大利亚)

专题命中 三维重建 :3D generation(abstract);分类 cs.CV

AI总结 提出首个针对图像到形状扩散Transformer的压缩方法,通过活力引导的结构化剪枝、自适应量化和微调,在保持几何保真度下实现高达66%的模型尺寸缩减。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00157 2026-07-02 cs.CV 新提交 57%

Progressive Pose-Guided 4D Animal Reconstruction from Monocular Video

渐进式姿态引导的单目视频4D动物重建

Siyuan Li, Weiying Chen, Yilin Wang, Xinxin Zuo, Xingyu Li, Li Cheng

机构 * University of Alberta(阿尔伯塔大学) Concordia University(康科迪亚大学)

专题命中 三维重建 :Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出一种基于3D高斯溅射的渐进式测试时优化框架,通过解耦关节姿态与非刚性变形,实现从单目视频高保真重建4D动物,在多种物种上优于现有方法。

Comments Accepted to ECCV 2026. Camera-ready author version

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23365 2026-07-02 cs.CV 版本更新 57%

SpatialMosaic: A Multiview VLM Dataset for Partial Visibility

SpatialMosaic:一个多视角VLM数据集用于部分可见性

Kanghee Lee, Jungi Hong, Sion Lee, Injae Lee, Minseok Kwak, Kwonyoung Ryu, Jaesik Park

机构 * Seoul National University(首尔大学) University College London(伦敦大学学院) Kyung Hee University(庆熙大学) POSTECH(浦项科技大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出SpatialMosaic数据集,通过多视角图像生成2M问答对,引入SpatialMosaic-Bench基准测试,结合3D重建模型的混合框架提升空间推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13859 2026-07-02 cs.CV 版本更新 57%

Geo-ID: Test-Time Geometric Consensus for Cross-View Consistent Intrinsics

Geo-ID: 测试时几何一致性用于跨视角一致本征分解

Alara Dirik, Stefanos Zafeiriou

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出Geo-ID框架,利用稀疏几何对应关系在测试时耦合单视角本征预测,实现跨视角一致分解,无需重训练或逆渲染。

Comments Accepted to ECCV 2026. Camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08279 2026-07-02 cs.CV 版本更新 57%

OSCAR: Occupancy-based Shape Completion via Acoustic Neural Implicit Representations

OSCAR: 基于占用率的声学神经隐式表示形状补全

Magdalena Wysocki, Kadir Burak Buldu, Miruna-Alexandra Gafencu, Mohammad Farid Azampour, Nassir Navab

机构 * Chair for Computer Aided Medical Procedures (CAMP) Technical University of Munich(慕尼黑工业大学计算机辅助医疗程序教席(CAMP)) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心(MCML)) Konrad Zuse School of Excellence in Reliable AI (relAI)(康拉德·楚泽可靠人工智能卓越学校(relAI))

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出基于占用率的形状补全方法,利用声学神经隐式表示从部分超声观测中重建完整3D解剖结构,无需标签,在HD95指标上优于现有方法80%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00412 2026-07-02 cs.GR 57%

ViscoReg: Neural Signed Distance Functions via Viscosity Solutions

ViscoReg:通过粘性解的神经符号距离函数

Meenakshi Krishnan, Ramani Duraiswami

专题命中 三维重建 :point cloud(abstract);分类 cs.GR

AI总结 本文提出ViscoReg,通过粘性解理论稳定神经符号距离函数训练,优于SIREN、DiGS和StEik等方法,在ShapeNet和3D场景重建数据集上表现优异。

Comments 21 pages, 7 figures

Journal ref Transactions on Machine Learning Research, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01123 2026-07-02 physics.ins-det eess.SP physics.optics 新提交 50%

Plenoptic imaging of particle interactions in scintillation detectors

闪烁体探测器中粒子相互作用的全光成像

Xiang Dai, Chi-Jui Ho, Kevin Tandi, Chang Lee, Alex Bocchieri, David Parra, Forrest Peterson, Talha Sultan, Felicia Sutanto, Andreas Velten, Jingke Xu, Nicholas Antipa

专题命中 三维重建 :3D reconstruction(abstract)

AI总结 提出PRISM多焦点全光成像系统,通过多焦距微透镜阵列平衡光子收集与深度编码,在光子匮乏条件下实现毫米级3D定位,平均误差约1mm。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 11 篇

2603.08997 2026-07-02 cs.CV 版本更新 92%

SkipGS: Post-Densification Backward Skipping for Efficient 3DGS Training

SkipGS: 用于高效3DGS训练的后致密化反向跳过

Jingxing Li, Yongjae Lee, Deliang Fan

机构 * Arizona State University(亚利桑那州立大学)

专题命中 Gaussian Splatting :3DGS(title,title_cn);NeRF(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 针对3DGS训练后致密化阶段反向传播冗余问题,提出视图自适应反向门控机制SkipGS,通过跳过损失稳定的视图反向传播,在保持重建质量的同时减少42%后致密化时间,端到端训练加速23.1%。

Comments Code is available at https://github.com/ASU-ESIC-FAN-Lab/SkipGS

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00885 2026-07-02 cs.CV cs.AI 新提交 92%

Improving Sparse-View 3DGS Generalization via Flat Minima Optimization

通过平坦极小值优化改进稀疏视角3DGS泛化能力

Kangmin Seo, Sangeek Hyun, MinKyu Lee, Jae-Pil Heo

机构 * Sungkyunkwan University(成均馆大学)

专题命中 Gaussian Splatting :3DGS(title,title_cn);Gaussian Splatting(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 针对稀疏视角下3DGS过拟合问题,提出基于平坦极小值优化的轻量训练框架,通过各向异性高斯扰动和周期性重初始化提升泛化性能。

Comments Accepted to ECCV 2026. Project Page: https://kangrnin.github.io/FlatMinGS

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01200 2026-07-02 cs.RO 新提交 85%

FastBridge: Closing the Model-Based Realization Gap in Safety Filters on 3D Gaussian Splatting for Fast Quadrotor Flight

FastBridge: 缩小基于模型的安全滤波器在3D高斯泼溅用于快速四旋翼飞行中的实现差距

Tscholl Dario, Nakka Yashwanth Kumar, Gunter Brian

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn);分类 cs.RO

AI总结 针对快速四旋翼飞行中安全滤波器的模型实现差距,提出一种基于全四旋翼动力学的非线性、执行器感知安全滤波器,利用碰撞锥指数障碍函数和备份CBF,在保持QP可行性的同时降低轨迹加加速度47%并提速2.25倍。

Comments preprint, 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00959 2026-07-02 cs.CV 新提交 79%

GaussianEmoTalker: Real-Time Emotional Talking Head Synthesis with Audio-Driven and Blendshape-Based 3D Gaussian Splatting

GaussianEmoTalker:基于音频驱动和混合形状的3D高斯泼溅实时情感说话头合成

Haijie Yang, Zhenyu Zhang, Yixuan Dong, Jianjun Qian, Jian Yang

机构 * PCA Lab, Key Lab of Intelligent Perception and Systems for High-Dimensional Information of Ministry of Education, School of Computer Science and Engineering, Nanjing University of Science and Technology(南京理工大学计算机科学与工程学院,教育部高维信息智能感知与系统重点实验室,PCA实验室) Tsientang Institute for Advanced Study(浙江大学前沿交叉研究院) School of Intelligence Science and Technology, Nanjing University(南京大学智能科学与技术学院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 提出GaussianEmoTalker框架,利用3D高斯泼溅和混合形状,通过中性到情感残差变形实现实时、可控强度的情感说话头合成,兼顾唇同步与渲染质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.03337 2026-07-02 cs.CV cs.AI 版本更新 79%

FreeTimeGS++: Secrets of Dynamic Gaussian Splatting and Their Principles

FreeTimeGS++:动态高斯泼溅的秘密及其原理

Lucas Yunkyu Lee, Soonho Kim, Youngwook Kim, Sangmin Kim, Jaesik Park

机构 * Seoul National University(首尔国立大学) POSTECH

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 本文通过建立控制基线FreeTimeGS_ours,系统分析4D高斯泼溅框架中的隐藏因素,揭示高斯持续时间驱动的时态分区和光度保真度与时空一致性之间的差异等关键秘密,并提出FreeTimeGS++方法,采用门控边缘化和神经速度场实现更稳定的动态表示。

Comments Project page: https://yklcs.com/ftgspp

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16943 2026-07-02 cs.CV cs.AI 版本更新 79%

KGS-GCN: Kinematics-Driven Gaussian Splatting and Probabilistic Topology for Skeleton-Based Action Recognition

KGS-GCN: 基于运动学驱动的高斯泼溅与概率拓扑的骨架动作识别

Yuhan Chen, Yicui Shi, Guofa Li, Liping Zhang, Jie Li, Jiaxin Gao, Wenbo Chu

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 提出KGS-GCN,通过运动学驱动的高斯泼溅模块将稀疏骨架序列渲染为多视角连续热图,并利用概率拓扑策略构建自适应先验邻接矩阵,以轻量级参数实现高效动作识别。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.16982 2026-07-02 cs.CV cs.GR 版本更新 79%

2DGH: 2D Gaussian-Hermite Splatting for High-quality Rendering and Better Geometry Features

2DGH: 二维高斯-埃尔米特泼溅用于高质量渲染和更好的几何特征

Ruihan Yu, Tianyu Huang, Jingwang Ling, Feng Xu

机构 * Department of Physics, Tsinghua University(清华大学物理系) School of Software and BNRist, Tsinghua University(清华大学软件学院与北京信息科学与技术国家研究中心)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3D reconstruction(abstract);novel view synthesis(abstract);分类 cs.CV、cs.GR

AI总结 提出高斯-埃尔米特核作为新基元,增强各向异性和变形能力,在几何重建和新视角合成上优于传统高斯泼溅。

Comments 12 pages, 11 figures

Journal ref IEEE Transactions on Visualization and Computer Graphics, vol. 32, no. 2, pp. 1513-1524, Feb. 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06852 2026-07-02 cs.CV 版本更新 77%

Active View Selection with Perturbed Gaussian Ensemble for Tomographic Reconstruction

基于扰动高斯集成的主动视角选择用于层析重建

Yulun Wu, Ruyi Zha, Wei Cao, Yingying Li, Yuanhao Cai, Yaoyao Liu

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Australian National University(澳大利亚国立大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 针对稀疏视角CT重建中视角选择问题,提出扰动高斯集成框架,通过不确定性建模和密度引导扰动选择最优视角,有效消除几何伪影。

Comments Accepted to ECCV 2026. Project page: https://perturbed-gaussian-ensemble.cvmlgroup.web.illinois.edu/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01202 2026-07-02 cs.CV cs.AI cs.GR 新提交 73%

World from Motion: Generative Dynamic Gaussian Reconstruction from Monocular Video

世界源于运动:从单目视频生成动态高斯重建

Liyuan Zhu, Shengyu Huang, Amrita Mazumdar, Tianye Li, Zan Gojcic, Gordon Wetzstein, Iro Armeni, Shalini De Mello, Alex Trevithick

机构 * Stanford University(斯坦福大学) NVIDIA(英伟达)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);分类 cs.CV、cs.GR

AI总结 提出World from Motion方法,利用视频模型从单目视频生成可自由渲染的动态3D高斯表示,通过像素对齐渲染校正伪影并填充缺失区域,实现4D重建新高度。

Comments Project page: https://research.nvidia.com/labs/amri/projects/world-from-motion/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26661 2026-07-02 cs.CV 版本更新 57%

GaussianGPT: Towards Autoregressive 3D Gaussian Scene Generation

GaussianGPT:迈向自回归3D高斯场景生成

Nicolas von Lützow, Barbara Rössle, Katharina Schmid, Matthias Nießner

机构 * Technical University of Munich, Germany(德国慕尼黑工业大学)

专题命中 Gaussian Splatting :3D generation(abstract);分类 cs.CV

AI总结 本文提出GaussianGPT,一种基于Transformer的自回归模型,通过逐词预测生成3D高斯分布,实现可控的3D场景生成,支持逐步构建场景并支持完成、外推等操作。

Comments Project page: https://nicolasvonluetzow.github.io/GaussianGPT/ - Project video: https://youtu.be/zVnMHkFzHDg - Accepted at ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01164 2026-07-02 cs.LG 新提交 50%

Efficient Compression of Structured and Unstructured Volumes via Learned 3D Gaussian Representation

基于学习的三维高斯表示对结构化与非结构化体积的高效压缩

Landon Dyken, Sharmistha Chakrabarti, Nathan Debardeleben, Steve Petruzza, Qi Wu, Will Usher, Sidharth Kumar

专题命中 Gaussian Splatting :novel view synthesis(abstract)

AI总结 提出基于三维高斯原语的显式模型压缩体积数据,通过加权聚合重建标量场,无需网格存储,在非结构化体积上全面超越隐式神经表示。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 10 篇

2607.01015 2026-07-02 cs.CV 新提交 79%

SuperFlex: Deformable Superquadrics for Point Cloud Decomposition

SuperFlex: 用于点云分解的可变形超二次曲面

Gabriel Tavernini, Elisabetta Fedele, Tiago Novello, Leonidas Guibas, Marc Pollefeys, Francis Engelmann

机构 * ETH Zurich(苏黎世联邦理工学院) Stanford University(斯坦福大学) IMPA(巴西国家纯数学与应用数学研究所) USI Lugano(卢加诺大学)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 提出SuperFlex框架,通过新损失函数、弯曲和锥形变形提升超二次曲面分解精度,并利用高质量分解训练模型以鲁棒处理部分点云。

Comments Project page: https://superflex3d.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00514 2026-07-02 cs.CV cs.AI 新提交 79%

Cross4D-JEPA: Dense Cross-modal Correspondence Distillation for 4D Point Cloud Representation Learning

Cross4D-JEPA: 用于4D点云表示学习的密集跨模态对应蒸馏

Trung Thanh Nguyen, Hai Nguyen-Truong, Tu Vo, Hoang M. Truong, Tuan-Anh Vu

机构 * Nagoya University(名古屋大学) Northeastern University(东北大学) KC Machine Learning Lab(KC机器学习实验室) University of Science, Vietnam National University Ho Chi Minh City(胡志明市越南国立大学理科大学) University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 提出Cross4D-JEPA,通过教师-学生框架将冻结的2D基础模型(如DINOv2或V-JEPA 2)的密集补丁特征蒸馏到4D点编码器,实现每点对应和潜在空间匹配,在四个基准上优于模态内和全局跨模态基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00148 2026-07-02 cs.RO cs.CV 新提交 62%

3D Point World Models: Point Completion Enables More Accurate Dynamics Learning

3D点云世界模型:点云补全实现更准确的动力学学习

Skand Peri, Hung Nguyen, Chanho Kim, Li Fuxin, Stefan Lee

机构 * Oregon State University(俄勒冈州立大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 提出3D点云世界模型(3DPWM),通过先补全部分点云再学习动作条件动力学,实现长时程可靠推演和精确成本评估,支持多种机器人操作任务。

Comments 21 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16813 2026-07-02 cs.GR cs.CV 版本更新 62%

QuadLink: Autoregressive Quad-Dominant Mesh Generation via Point-Relation Learning

QuadLink: 通过点关系学习的自回归四边形主导网格生成

Yiheng Zhang, Zhe Zhu, Tingrui Shen, Zhuojiang Cai, Tianxiao Li, Zixing Zhao, Qiujie Dong, Zhiyang Dou, Jiepeng Wang, Le Wan, Yuwang Wang, Wenping Wang, Yuan Liu, Cheng Lin

机构 * Hong Kong University of Science and Technology(香港科技大学) Tencent VISVISE(腾讯VISVISE) Peking University(北京大学) Technical University of Munich(慕尼黑技术大学) Tsinghua University(清华大学) The University of Hong Kong(香港大学) Massachusetts Institute of Technology(麻省理工学院) Texas A&M University(德克萨斯大学) Macau University of Science and Technology(澳门科技大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV、cs.GR

AI总结 提出QuadLink框架,通过将点云链接成结构化面片,以自回归方式生成各向异性的四边形主导网格,实现高几何保真度和拓扑质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00529 2026-07-02 cs.CV 新提交 57%

NoPA: Non-Parametric Online 3D Scene Graph Generation

NoPA: 非参数化在线3D场景图生成

Qi Xun Yeo, Seungjun Lee, Yan Li, Gim Hee Lee

机构 * Department of Computer Science, National University of Singapore(新加坡国立大学计算机科学系)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 针对现有3D场景图生成方法无法实时运行的问题,提出NoPA,用非参数化分布表示物体,保留几何细节,并通过基于最大均值差异的合并策略和关系传播,实现实时且准确的在线场景图生成。

Comments This paper has been accepted in ECCV 26

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00215 2026-07-02 cs.RO 新提交 57%

ELMP: Efficient Learning for Motion Planning via Analytical Policy Gradients

ELMP: 通过解析策略梯度实现高效运动规划学习

Yixiao Li, Tifanny Portela, Jordis Herrmann, René Zurbrügg, Marco Hutter

机构 * Robotic Systems Lab, ETH Zürich(苏黎世联邦理工学院机器人系统实验室) ABB(ABB公司) ANYbotics(ANYbotics公司)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 提出ELMP框架,利用可微运动学层和自监督微调,通过密集碰撞、目标到达和平滑性目标直接优化策略,避免专家数据收集,实现数据高效的运动规划适应。

Comments 8 pages, 7 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29963 2026-07-02 cs.CV cs.CR 版本更新 57%

Explainability-Aware Frustum Attack: Exposing Structural Vulnerabilities in LiDAR-Based 3D Object Detectors

可解释性感知的视锥攻击:揭示基于LiDAR的3D目标检测器中的结构脆弱性

Chengzeng You, Binbin Xu, Soteris Demetriou

机构 * Imperial College London(帝国理工学院伦敦分校)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出可解释性引导的对抗分析方法,通过SALL方法生成通用显著性图,并设计EFA攻击,仅扰动最关键的视锥区域,在KITTI和nuScenes上使检测召回率下降超15个百分点,同时减少25-50%的扰动视锥数。

Comments European Conference on Computer Vision (ECCV), September 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01001 2026-07-02 cs.CV cs.AI 版本更新 57%

EgoSim: Egocentric World Simulator for Embodied Interaction Generation

EgoSim:用于具身交互生成的视角世界模拟器

Jinkun Hao, Mingda Jia, Ruiyan Wang, Hongrui Zhu, Jiafei Cao, Xihui Liu, Ran Yi, Lizhuang Ma, Jiangmiao Pang, Xudong Xu

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) The University of Hong Kong(香港大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 EgoSim通过建模可更新的世界状态,解决现有视角模拟器在3D grounding和动态更新上的不足,生成空间一致的交互视频并支持跨具身迁移。

Comments Project Page: egosimulator.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏