arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

共收录 3137 信号源:cs.CV, cs.GR, cs.RO

1. Gaussian Splatting 3137 篇

2608.12860 2026-08-14 cs.RO 新提交 70%

HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments

HumanoidVLN:面向多种人形机器人形态的基于物理的视觉语言导航模拟器与基准

Quan-Dung Pham, Anh Dao, The-Anh Nguyen, Minh Nguyen-Dinh, Phuong Nam Dang, Tri Pham, Hung Tran, Bach Dao, Tuyen P. Le, Truong Nguyen, Quan Nguyen

机构 * VinMotion, Inc.(VinMotion公司) University of Southern California(南加州大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract,abstract_cn);分类 cs.RO

AI总结 本研究针对人形机器人VLN的物理约束与形态差异问题,提出基于NVIDIA Isaac Sim的HumanoidVLN模拟器与基准,验证其与多种模型、机器人的兼容性,实验揭示了VLN模型、控制器与人形形态的交互关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11077 2026-08-12 cs.CV 新提交 70%

Learning Gaussian Structure: Intervention-Guided Density Control for Feed-Forward Driving Reconstruction

学习高斯结构:用于前向驾驶重建的干预引导密度控制

Hang Li, Jiahe Li, Meiying Gu, Jin Zheng, Lina Yu, Xiao Bai

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);分类 cs.CV

AI总结 本文提出Learning Gaussian Structure(LGS)框架,通过干预引导的高斯结构调整与跨时间点查询,在Waymo Open Dataset和PandaSet上实现了优于现有方法的驾驶场景重建效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10712 2026-08-12 cs.CV 新提交 70%

Compact Feed-Forward 3D Gaussians via Saliency-Guided Primitive Merging

基于显著性引导基元合并的紧凑前馈三维高斯模型

Tim-Felix Fassch, Jochen Kall, Cyrill Stachniss

机构 * Bosch Research(博世研究院) University of Bonn(波恩大学) Lamarr Institute for Machine Learning and Artificial Intelligence(拉马尔机器学习与人工智能研究院)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract,abstract_cn);分类 cs.CV

AI总结 该研究针对前馈三维高斯方法基元冗余问题,提出显著性引导的基元合并流水线,可在仅1/20高斯数量下保留视觉质量,实现高效紧凑的三维场景表示与渲染。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10682 2026-08-12 cs.CV 新提交 70%

Visual Geometry Foundation-Aware Gaussians for Single-Frame Surround-View Driving Reconstruction

面向单帧环视驾驶场景重建的视觉几何基础感知高斯模型

Junhong Lin, Jinlong Wang, Xianda Guo, Yanlun Peng, Wei Zheng, Guoqing Liu, Hanli Wang, Tiesong Zhao, Wei Gao

机构 * Guangdong Provincial Key Laboratory of Ultra High Definition Immersive Media Technology(广东省超高清沉浸式媒体技术重点实验室) School of Electronic and Computer Engineering, Peking University(北京大学电子与计算机工程学院) Peng Cheng Laboratory(鹏城实验室) Wuhan University(武汉大学) Great Wall Motor(长城汽车) Minieye Corporation(Minieye公司) Tongji University(同济大学) Fuzhou University(福州大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract,abstract_cn);分类 cs.CV

AI总结 本文提出VGGD框架,通过引入视觉几何先验、双路径颈部等模块,在nuScenes基准上实现了单帧环视驾驶场景重建的最优渲染质量与几何一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04224 2026-08-11 cs.CV 版本更新 70%

SplitGaussian: Reconstructing Dynamic Scenes via Visual Geometry Decomposition

SplitGaussian:通过视觉几何分解重建动态场景

Lechao Cheng, Jiahui Li, Jingxuan He, Shengeng Tang, Gang Huang, Tianrui Hui, Yaxiong Wang, Zhun Zhong

专题命中 Gaussian Splatting :Gaussian Splatting(abstract,abstract_cn);分类 cs.CV

AI总结 SplitGaussian将场景表示分解为静态与动态分量,解耦运动建模与背景几何,提升动态场景重建的时间一致性、保真度与收敛速度,性能优于现有SOTA方法。

Comments version 2. Accepted By ACM MM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05482 2026-08-07 cs.CV 新提交 70%

CDSeg: A Renderable Gaussian Carrier for Image-to-3D Label Transfer

CDSeg:用于图像到3D标签迁移的可渲染高斯载体

Wentao Sun, Yiping Chen, Zhengsen Xu, Jonathan Li, John S. Zelek

机构 * University of Waterloo(滑铁卢大学) Sun Yat-sen University(中山大学) University of Calgary(卡尔加里大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);point cloud(abstract);分类 cs.CV

AI总结 CDSeg是基于高斯溅射的跨域分割接口,无需特定任务3D分割训练,可复用2D掩码实现多视图标签迁移,在多个数据集上取得高mIoU,能快速处理大规模场景。

Comments 15 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02006 2026-08-07 cs.CV 版本更新 70%

ASTRA: Asynchronous Spatio-Temporal Reconstruction via Trajectory Alignment

ASTRA:基于轨迹对齐的异步时空重建

Junyu Zhu, Hao Zhu, Xinzhuo Zhang, Hongdong Li, Zhan Ma, Xun Cao

机构 * School of Electronic Science and Engineering, Nanjing University(南京大学电子科学与工程学院)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract,abstract_cn);分类 cs.CV

AI总结 针对动态三维场景重建中多相机异步导致的问题,提出ASTRA框架,通过轨迹对齐联合优化时间偏移与三维表示,在实验中实现了显著的性能提升。

Comments We wish to withdraw this preprint because the current statistical analysis of the experimental data is incomplete and requires re-verification. We plan to submit a revised and thoroughly checked version in the near future

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01726 2026-08-04 cs.CV 新提交 70%

G-Skin: Learning to Bind 3D Gaussians with Generative Visual Priors

G-Skin:学习结合生成式视觉先验的3D高斯绑定方法

Yuxin Yao, Kendong Liu, Shiqi Zhou, Jiazhi Xia, Junhui Hou

机构 * City University of Hong Kong(香港城市大学) Central Media Technology Institute, Huawei(华为中央媒体技术研究院) Central South University(中南大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract,abstract_cn);分类 cs.CV

AI总结 本文针对3D高斯资产绑定的难题,提出生成式蒙皮框架G-Skin,利用2D视觉基础模型提炼运动先验构建优化流程,可灵活泛化并优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01053 2026-08-04 cs.CV 新提交 70%

Struct-GStream: Towards Efficient Free-Viewpoint Video Streaming at Low-Bitrates with Structured 3D Gaussians

Struct-GStream:基于结构化3D高斯的低码率高效自由视点视频流技术

Han Jiao, Jiakai Sun, Lei Zhao, Wei Xing, Huaizhong Lin, Zhanjie Zhang, Ao Ma

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) Chinese Academy of Sciences(中国科学院) University of Science and Technology Beijing(北京科技大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);分类 cs.CV

AI总结 本文针对现有自由视点视频在线训练方法存储与训练时间不足的问题,提出Struct-GStream,通过结构化3D高斯等技术实现低码率下的高效视频流,性能优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28032 2026-07-31 cs.CV 新提交 70%

Split and Drive: Dual-Axis Disentanglement for Real-Time Gaussian Head Avatars

Split and Drive:用于实时高斯头像的双轴解耦

MD Wahiduzzaman Khan, Mingshan Jia, Xiaolin Zhang, En Yu, Kaska Musial-Gabrys

机构 * University of Technology Sydney(悉尼科技大学) Shandong University of Science and Technology(山东科技大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract,abstract_cn);分类 cs.CV

AI总结 该研究针对单图像生成可动画头部头像的挑战,提出双轴解耦的SpiD框架,通过内化逐帧驱动、分解面部高斯分支,实现了性能优且速度快的实时高斯头像生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23189 2026-07-28 cs.CV cs.AI 新提交 70%

Fashion-3DLR: A Controllable 3D Garment Generation Using Pairwise Fashion Elements for Intelligent Design

Fashion-3DLR:一种使用成对时尚元素进行智能设计的可控3D服装生成方法

Shenghao Yang, Hongtao Zhang, Yuhan Yi, Zhihao Tang, Zihao Cui, Lian Wen, Han Yan, Yuan Gao, Mingbo Zhao

机构 * Donghua University(东华大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);分类 cs.CV

AI总结 研究针对3D服装生成难题,提出Fashion-3DLR框架,通过GFF-DiT模块融合2D时尚设计元素,利用整流流Transformer生成几何潜在值,实现多种3D服装表示,并集成到下游任务,实验证明其超越现有方法,有成为通用3D服装设计工具的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13310 2026-07-23 cs.CV 版本更新 70%

InstantSfM: Towards GPU-Native SfM for the Deep Learning Era

InstantSfM: 向深度学习时代迈进的GPU原生SfM

Jiankun Zhong, Zitong Zhan, Quankai Gao, Ziyu Chen, Haozhe Lou, Jiageng Mao, Ulrich Neumann, Chen Wang, Yue Wang

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 InstantSfM通过深度约束的雅可比结构实现GPU原生SfM,解决尺度模糊问题,提升大规模场景下的效率和精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10489 2026-07-14 cs.CV 新提交 70%

Grassmannian Splatting I: Moving rank-2 Spacetime Surfels for Dynamic Scene Rendering

格拉斯曼体点云绘制 I:用于动态场景渲染的移动秩-2时空表面元素

Aaron Maurice Berman, Shantanu Dave

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);分类 cs.CV

AI总结 该研究提出格拉斯曼体点云绘制用于动态场景渲染,其基元为特定高斯分布,运动模型封闭,无需学习变形场和自定义CUDA。在17个HyperNeRF场景训练速度最快,PSNR、MS-SSIM和LPIPS排名第二。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08769 2026-07-10 cs.CV 新提交 70%

Geometry and Gradient-based Partitioning for Panoramic Outdoor Reconstruction

基于几何和梯度的全景户外重建分区方法

Weijian Chen, Weibo Yao, Yuhang Zhang, Xiaolin Tang, Guo Wang, Weijun Zhang, Xitong Gao, Yihao Chen, Hongde Qin, Lu Qi

机构 * Insta360 Research(Insta360研究机构) Sun Yat-sen University(中山大学) South China University of Technology(华南理工大学) University of Chinese Academy of Sciences(中国科学院大学) Harbin Engineering University(哈尔滨工程大学) Wuhan University(武汉大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);分类 cs.CV

AI总结 针对大规模全景3D高斯点云重建成本高问题,提出PanoLOG两阶段框架,利用几何和梯度进行分区,粗阶段用天球建模等,细化阶段构建自适应边界体积等,还构建数据集,实现了高质量渲染和可扩展训练。

Comments Project Webpage: https://insta360-research-team.github.io/GGPS-Website

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29303 2026-07-01 cs.CV 版本更新 70%

Occlusion-Robust Multi-Object Decoupling for Physics-Based Robotic Interaction

基于物理的机器人交互的遮挡鲁棒多对象解耦

Xin Dong, Lihan Zhang, Tianru Dai, Wenfeng Deng, Yansong Tang

机构 * Pengcheng Laboratory(鹏城实验室) Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 提出一种无掩码方法,从稀疏遮挡视角实现无损多对象3D重建,通过MPM模拟实现物理合理的机器人交互,核心是利用联合SDS过程结合扩散先验实现对象解耦。

Comments 7 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31050 2026-07-01 cs.CV cs.AI 新提交 70%

Learning Video Dynamics with Predictive Differentiable Rendering

基于预测可微渲染的视频动态学习

Yujin Tang, Tian Zhou, Xin Lin, Cheng Tan, Yifan Hu, Rong Jin, SouYoung Jin, Liang Sun

机构 * Dartmouth College(达特茅斯学院) DAMO Academy, Alibaba Group(阿里巴巴达摩院) University of California, San Diego(加州大学圣地亚哥分校) Westlake University(西湖大学) Tsinghua University(清华大学) Ant Group(蚂蚁集团)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 提出预测可微渲染(PDR)框架,通过2D高斯表示的轻量适配器PredGS和CUDA加速渲染器predgsplat,结合L1和SSIM损失优化,在离散像素与连续表示间架桥,显著提升视频预测的细节保真度和准确性。

Comments Accepted by ECCV 2026. 18 pages, 5 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29976 2026-06-30 cs.CV 70%

Learning Efficient 4D Gaussian Representations from Monocular Videos with Flow Splatting

利用流溅射从单目视频学习高效4D高斯表示

Shengjun Zhang, Jinzhao Li, Xin Fei, Yueqi Duan

机构 * Tsinghua University(清华大学) National University of Singapore(新加坡国立大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 提出Flow Splatting方法,通过构建速度场并扩展溅射技术渲染光流,从单目视频中高效学习4D高斯表示,实现高质量动态场景重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04860 2026-06-30 cs.CV 70%

DivAS: Interactive 3D Segmentation by Depth-Weighted Voxel Aggregation

DivAS:通过深度加权体素聚合实现交互式3D分割

Ayush Pande, Mayank Vatsa

机构 * Indian Institute of Technology Kanpur(印度理工学院坎普尔分校) Indian Institute of Technology Jodhpur(印度理工学院焦特布尔分校)

专题命中 Gaussian Splatting :NeRF(abstract);Gaussian Splatting(abstract);分类 cs.CV

AI总结 DivAS通过深度加权体素聚合实现交互式3D分割,无需优化循环,基于GAussian Splatting和NeRF框架,实现高效且高质量的3D分割。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13910 2026-06-29 cs.CV 版本更新 70%

Scene Generation at Absolute Scale: Utilizing Semantic and Geometric Guidance From Text for Accurate and Interpretable 3D Indoor Scene Generation

绝对尺度下的场景生成:利用文本的语义和几何引导实现精确且可解释的3D室内场景生成

Stefan Ainetter, Thomas Deixelberger, Edoardo A. Dominici, Philipp Drescher, Konstantinos Vardis, Markus Steinberger

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3D generation(abstract);分类 cs.CV

AI总结 提出GuidedSceneGen框架,通过文本预测全局3D布局并利用全景扩散模型和视频扩散模型生成绝对尺度的室内场景,实现高一致性、可导航的3D重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19594 2026-06-29 cs.CV cs.GR 70%

Tortho-Gaussian: Splatting True Digital Orthophoto Maps

Tortho-Gaussian:真数字正射地图的生成

Xin Wang, Wendi Zhang, Hong Xie, Haibin Ai, Qiangqiang Yuan, Zongqian Zhan

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);分类 cs.CV

AI总结 本文提出Tortho-Gaussian方法,通过优化各向异性高斯核的正交撒点生成真数字正射地图,解决了传统方法中DSM不准确、遮挡检测失效等问题,提升了大范围场景重建的精度和效率。

Comments This work has been submitted to the IEEE Transactions on Geoscience and Remote Sensing for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17796 2026-06-25 cs.CV cs.AI 版本更新 70%

CustomX: Unified Character, Action, and Scene Customization in Video World Models

CustomX: 视频世界模型中的统一角色、动作与场景定制

Yitong Wang, Fangyun Wei, Hongyang Zhang, Bo Dai, Yan Lu

机构 * Fudan University(复旦大学) Microsoft Research(微软研究院) University of Waterloo(滑铁卢大学) The University of Hong Kong(香港大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);分类 cs.CV

AI总结 提出CustomX,结合静态世界生成与可控实体模型,支持用户指定角色在3D场景中执行开放动作,通过条件自回归视频生成保持视觉保真度。

Comments Accepted to ECCV 2026. Project page: https://snowflakewang.github.io/CustomX_Page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24876 2026-06-24 cs.CV 新提交 70%

FLAT: Feedforward Latent Triangle Splatting for Geometrically Accurate Scene Generation

FLAT: 前馈潜在三角形泼溅用于几何精确的场景生成

Orest Kupyn, Goutam Bhat, Philipp Henzler, Fabian Manhardt, Christian Rupprecht, Federico Tombari

机构 * Google Research(谷歌研究院) University of Oxford, Visual Geometry Group(牛津大学视觉几何组) TU Munich(慕尼黑工业大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);分类 cs.CV

AI总结 提出FLAT方法,首次从视频扩散潜在表示中直接解码三角形泼溅,通过射线中心旋转参数化和乘积窗口函数解决梯度流问题,在保持视觉质量的同时显著提升几何精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26262 2026-06-01 cs.CV 70%

Semantic Foam: Unifying Spatial and Semantic Scene Decomposition

Semantic Foam:统一空间与语义场景分解

Amr Sharafeldin, Shrisudhan Govindarajan, Thomas Walker, Aryan Mikaeili, Daniel Rebain, Kwang Moo Yi, Andrea Tagliasacchi

机构 * Simon Fraser University(西蒙弗雷泽大学) University of Toronto(多伦多大学) Wayve Technologies(Wayve技术公司) University of British Columbia(不列颠哥伦比亚大学) University of Edinburgh(爱丁堡大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 提出Semantic Foam,通过扩展Radiant Foam表示,结合Voronoi网格的空间分解和显式语义特征场,实现高质量、一致性的语义分割。

Comments 15 pages, 10 figures, Accepted to CVPR 2026 (Highlight) , Project page: http://semanticfoam.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30268 2026-05-29 cs.CV cs.AI 70%

PhyGenHOI: Physically-Aware 4D Generation of Dynamic Human-Object Interactions

PhyGenHOI:物理感知的动态人-物交互4D生成

Omer Benishu, Gal Fiebelman, Sagie Benaim

机构 * Hebrew University of Jerusalem(耶路撒冷希伯来大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);分类 cs.CV

AI总结 提出PhyGenHOI框架,结合运动扩散模型和物质点方法,通过窗口吸引损失、接触驱动重模拟和掩码视频SDS目标,生成物理一致且视觉逼真的4D人-物交互动态场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15151 2026-05-29 eess.IV cs.CV 70%

Zero-shot CT Super-Resolution using Diffusion-based 2D Projection Priors and Signed 3D Gaussians

基于扩散的二维投影先验和有符号三维高斯的零样本CT超分辨率

Jeonghyun Noh, Hyun-Jic Oh, Won-Ki Jeong

机构 * Department of Computer Science and Engineering(计算机科学与工程系) Korea University(韩国大学) Seoul, Korea(韩国首尔)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 提出一种零样本三维CT超分辨率框架,通过扩散模型上采样二维投影先验并结合有符号三维高斯溅射(NAB-GS)重建高分辨率CT体积,在公开数据集上实现4倍超分辨率的优越性能。

Comments MICCAI 2026 early accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23845 2026-05-25 cs.CV 70%

Learning a Particle Dynamics Model with Real-world Videos

利用真实世界视频学习粒子动力学模型

Chanho Kim, Suhas V. Sumukh, Li Fuxin

机构 * Oregon State University(俄勒冈州立大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);point cloud(abstract);分类 cs.CV

AI总结 提出一种从无标签真实视频直接训练神经物体动力学模型的框架,结合高斯溅射技术,通过渲染监督学习粒子位置和旋转变化,避免对合成数据的依赖。

Comments CVPR 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21258 2026-05-21 cs.RO cs.AI 70%

Learning Structural Latent Points for Efficient Visual Representations in Robotic Manipulation

为机器人操作中的高效视觉表征学习结构潜在点

Yicheng Jiang, Jiaxu Wang, Junhao He, Zesen Gan, Junhao Li, Qiang Zhang, Jingkai Sun, Jiahang Cao, Mingyuan Sun, Xiangyu Yue, Qiming Shao

机构 * The Hong Kong University of Science and Technology(香港科技大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) MMLab, The Chinese University of Hong Kong(香港中文大学MMLab) X-Humanoid Robots(X-Humanoid机器人) The University of Hong Kong(香港大学) Tsinghua University(清华大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);分类 cs.RO

AI总结 本文提出了一种新的预训练框架,通过学习混合表示-结构潜在点,结合隐式表示的表达能力和显式表示的结构先验,以提高机器人操作中的视觉表征效率和鲁棒性。

Journal ref International Conference on Robotics and Automation 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21112 2026-05-21 cs.CV 70%

RCGDet3D: Rethinking 4D Radar-Camera Fusion-based 3D Object Detection with Enhanced Radar Feature Encoding

RCGDet3D: 重新思考基于增强雷达特征编码的4D雷达-相机融合3D目标检测

Weiyi Xiong, Bing Zhu

机构 * School of Automation Science and Electrical Engineering, Beihang University(北京航空航天大学自动化科学与电气工程学院)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);point cloud(abstract);分类 cs.CV

AI总结 本文提出RCGDet3D,通过增强雷达特征编码而非复杂的多模态融合策略,实现了在3D目标检测中更高的准确性和实时性,为实时部署设定了新标准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20910 2026-05-21 cs.CV 70%

FlowLong: Inference-time Long Video Generation via Manifold-constrained Tweedie Matching

FlowLong: 通过流形约束的 Tweedie 匹配实现推理时的长视频生成

Jangho Park, Geon Yeong Park, Gihyun Kwon, Jong Chul Ye

机构 * KAIST(韩国科学技术院) Amazon(亚马逊)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);分类 cs.CV

AI总结 本文提出了一种新的推理时长视频生成方法,通过流形约束的Tweedie匹配在重叠滑动窗口中生成长视频,同时保持时间和空间一致性,并且无需额外训练。

Comments Project Page: https://flowlong-video.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12494 2026-05-13 cs.CV 70%

Revisiting Photometric Ambiguity for Accurate Gaussian-Splatting Surface Reconstruction

重新审视光度歧义以实现高精度高斯-散射表面重建

Jiahe Li, Jiawei Zhang, Xiao Bai, Jin Zheng, Xiaohan Yu, Lin Gu, Gim Hee Lee

机构 * School of Computer Science Engineering, State Key Laboratory of Complex Critical \& Software Environment, Jiangxi Research Institute, Beihang University State Key Laboratory of Virtual Reality Technology Macquarie University Tohoku University School of Computing, National University of Singapore

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出AmbiSuR框架,通过高斯散射内在解决方案解决光度歧义问题,提升3D表面重建性能,实验显示在多种挑战场景中表现优异。

Comments Accepted at ICML 2026. Project page: https://fictionarry.github.io/AmbiSuR-Proj/

详情

展开后加载摘要…

URL PDF HTML 收藏