arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

共收录 3137 信号源:cs.CV, cs.GR, cs.RO

1. Gaussian Splatting 3137 篇

2511.22793 2026-04-29 cs.LG 78%

GSpaRC: Gaussian Splatting for Real-time Reconstruction of RF Channels

GSpaRC:高斯点云用于射频信道的实时重建

Bhavya Sai Nukapotula, Rishabh Tripathi, Seth Pregler, Dileep Kalathil, Srinivas Shakkottai, Theodore S. Rappaport

机构 * Texas A&M University(德克萨斯A&M大学) New York University(纽约大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract)

AI总结 GSpaRC通过高斯点云技术实现射频信道的高精度实时重建,显著降低训练和推理时间,适用于5G及未来无线系统。

Comments Project website: https://nbhavyasai.github.io/GSpaRC/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21980 2026-03-24 physics.med-ph 78%

Fast undersampled dynamic MRI reconstruction using explicit representation learning with Gaussian splatting

快速动态MRI重建:利用显式表示学习与高斯点溅射

M. L. Terpstra, C. A. T. van den Berg

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract)

AI总结 本文提出利用显式表示学习与高斯点溅射方法,实现高效个性化动态MRI重建,可在60秒内训练高斯点并以0.5ms/d的推理时间获得高质量心脏MRI。

Comments Accepted at ISMRM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14510 2026-02-27 cs.MM 78%

Structured Image-based Coding for Efficient Gaussian Splatting Compression

基于结构化图像的高效高斯溅射压缩

Pedro Martin, Antonio Rodrigues, Joao Ascenso, Maria Paula Queluz

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract)

AI总结 本文提出GSICO,通过结构化图像编码实现高效高斯溅射压缩,达到20.2x压缩率且视觉质量损失小。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15822 2025-11-21 stat.ML cs.LG 78%

Atlas Gaussian processes on restricted domains and point clouds

受限域和点云上的Atlas高斯过程

Mu Niu, Yue Zhang, Ke Ye, Pokman Cheung, Yizhu Wang, Xiaochen Yang

机构 * School of Mathematics and Statistics, University of Glasgow(数学与统计学学院,格拉斯哥大学) KLMM, Academy of Mathematics and Systems Science, Chinese Academy of Sciences, China(数学与系统科学研究院,中国科学院)

专题命中 Gaussian Splatting :point cloud(title,abstract)

AI总结 本文提出了一种改进的Atlas高斯过程,通过结合全局热核与局部RBF核,提升高维点云和受限域中的回归性能和热核估计精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26166 2025-10-31 eess.SP 78%

6D Channel Knowledge Map Construction via Bidirectional Wireless Gaussian Splatting

Juncong Zhou, Chao Hu, Guanlin Wu, Zixiang Ren, Han Hu, Juyong Zhang, Rui Zhang, Jie Xu

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20774 2025-09-26 physics.optics math.OC physics.comp-ph 78%

Gaussian splatting holography

Shuhe Zhang, Liangcai Cao

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12138 2025-09-16 cs.DC 78%

Distributed 3D Gaussian Splatting for High-Resolution Isosurface Visualization

Mengjiao Han, Andres Sewell, Joseph Insley, Janet Knowles, Victor A. Mateevitsi, Michael E. Papka, Steve Petruzza, Silvio Rizzi

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract)

Journal ref Super Computing 2025 Research Poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05216 2025-09-08 cs.DC 78%

Toward Distributed 3D Gaussian Splatting for High-Resolution Isosurface Visualization

Mengjiao Han, Andres Sewell, Joseph Insley, Janet Knowles, Victor A. Mateevitsi, Michael E. Papka, Steve Petruzza, Silvio Rizzi

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract)

Journal ref IEEE eScience 2025 Poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06684 2025-07-10 eess.IV cs.AI 78%

Photometric Stereo using Gaussian Splatting and inverse rendering

Matéo Ducastel, David Tschumperlé, Yvain Quéau

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract)

Comments in French language. GRETSI 2025, Association GRETSI, Aug 2025, Strasbourg, France

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19459 2025-05-28 cs.CV cs.GR cs.LG cs.RO 78%

ArtGS: Building Interactable Replicas of Complex Articulated Objects via Gaussian Splatting

Yu Liu, Baoxiong Jia, Ruijie Lu, Junfeng Ni, Song-Chun Zhu, Siyuan Huang

机构 * Tsinghua University(清华大学) State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室) Peking University(北京大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title);分类 cs.CV、cs.GR、cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04832 2025-03-25 cs.NI cs.AI cs.LG 78%

Neural Representation for Wireless Radiation Field Reconstruction: A 3D Gaussian Splatting Approach

Chaozheng Wen, Jingwen Tong, Yingdong Hu, Zehong Lin, Jun Zhang

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract)

Comments This is an extended journal version of our previous conference paper that was accepted to the IEEE INFOCOM 2025 at arXiv:2412.04832v2. The code for this version is available at https://github.com/wenchaozheng/WRF-GSplus

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11782 2025-02-18 cs.AR 78%

Exploring the Versal AI Engine for 3D Gaussian Splatting

Kotaro Shimamura, Ayumi Ohno, Shinya Takamaeda-Yamazaki

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05145 2026-08-10 cs.CV cs.MM cs.SD 交叉投稿 77%

Objects as Audio-Visual Modal Sound Fields

作为视听模态声场的物体

Zisen Shao, Zihao Wei, Derong Jin, Ruohan Gao

机构 * University of Maryland, College Park(马里兰大学帕克分校)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract,abstract_cn);3D reconstruction(abstract);分类 cs.CV

AI总结 本文针对现有碰撞声建模方法成本高或需大量数据的问题,提出AV-MSF表示,结合3D高斯溅射与模态参数实现少样本重建,在真实数据集上达最优渲染性能,还支持接触定位等下游应用。

Comments ECCV 2026, Project page: https://zisenshao.github.io/AV-MSF/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15169 2026-08-05 cs.CV 版本更新 77%

MeSS: City Mesh-Guided Outdoor Scene Generation with Cross-View Consistent Diffusion

MeSS: 基于城市网格的户外场景生成与跨视角一致扩散

Xuyang Chen, Zhijun Zhai, Kaixuan Zhou, Zengmao Wang, Jianan He, Dong Wang, Yanfeng Zhang, mingwei Sun, Rüdiger Westermann, Konrad Schindler, Liqiu Meng

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 MeSS通过改进跨视角一致性,利用城市网格模型生成高质量且风格一致的户外场景,并结合3D高斯点划重建技术提升生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00463 2026-08-04 cs.CV cs.MM cs.SD 新提交 77%

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds

Scene2Sound:面向3D高斯世界的听觉锚定声景生成

Masaki Yoshida, Ren Togo, Takahiro Ogawa, Miki Haseyama

机构 * Hokkaido University(北海道大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 Scene2Sound是一个无训练框架,通过听觉锚定和高斯集匹配为3D高斯世界生成空间一致的声景,在保留音频质量的同时解决了现有方法空间不一致的问题,经实验和用户研究验证有效。

Comments 14 pages. Project page: https://masaki-lmd.github.io/scene2sound/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01207 2026-08-03 cs.CV 版本更新 77%

TRACE: High-Fidelity 3D Scene Editing via Tangible Reconstruction and Geometry-Aligned Contextual Video Masking

TRACE:通过可触觉重建和几何对齐的上下文视频遮罩实现高保真的3D场景编辑

Jiyuan Hu, Zechuan Zhang, Zongxin Yang, Yi Yang

机构 * ReLER Lab, CCAI, Zhejiang University(浙江大学计算机辅助设计与图形学全国重点实验室(CCAI)ReLER实验室) DBMI, HMS, Harvard University(哈佛大学医学院生物医学信息学系(DBMI))

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 TRACE通过可触觉重建和几何对齐的上下文视频遮罩,实现高保真的3D场景编辑,解决了现有方法在局部姿态调整和组件替换时结构完整性不足的问题。

Comments 9 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25219 2026-07-29 cs.RO 新提交 77%

SONG: A Photorealistic 3D Gaussian Simulation Platform for Benchmarking Social Navigation

SONG:用于基准测试社会导航的逼真3D高斯模拟平台

Weiqi Huang, Dianyi Yang, Jiaxin Li, Shuangyi Dong, Hao Xu, Zan Wang, Wei Liang

机构 * School of Computer Science & Technology, Beijing Institute of Technology(北京理工大学计算机科学与技术学院)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.RO

AI总结 研究针对社会导航模拟平台不足的问题,介绍了基于3D高斯点云渲染的SONG平台,利用其进行场景和化身表示等,还策划了SONG-Bench及评估套件,通过评估发现相关问题,证明微调数据可提高现实环境成功率,为研究提供测试平台。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22717 2026-07-28 cs.CV 新提交 77%

TOM-GS: Editable Video Representation via Temporal Opacity Modulation of Static 3D Gaussians

TOM-GS:通过静态3D高斯的时间不透明度调制实现可编辑视频表示

Marek Lisowski, Łukasz Smoliński, Kornel Howil, Piotr Biliński, Marcin Mazur, Przemysław Spurek

机构 * University of Warsaw(华沙大学) Jagiellonian University(雅盖隆大学) IDEAS Research Institute(IDEAS 研究所)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 研究针对视频表示难以编辑的问题,提出TOM-GS方法,通过为3D高斯的不透明度赋予可学习参数,结合姿态估计保持静态空间几何,实现可编辑视频表示,在视觉保真度上超越同类,且与3D编辑工具兼容。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13335 2026-07-28 cs.CV 版本更新 77%

Deblur-Avatar: Animatable Avatars from Motion-Blurred Monocular Videos

Deblur-Avatar:从运动模糊单目视频生成可动画化头像

Xianrui Luo, Juewen Peng, Zhongang Cai, Lei Yang, Fan Yang, Zhiguo Cao, Guosheng Lin

机构 * School of Artificial Intelligence and Automation, Huazhong University of Science and Technology(华中科技大学人工智能与自动化学院) S-Lab for Advanced Intelligence, Nanyang Technological University(南洋理工大学先进智能实验室) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院) SenseTime Research(商汤科技研究院)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 该研究针对运动模糊单目视频输入,提出将基于人类运动的运动模糊模型集成到3D高斯平铺的框架,通过优化轨迹和高斯分布重建高质量可动画化头像,实验证明其在渲染质量等方面显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20628 2026-07-24 cs.CV cs.AI 新提交 77%

RealVDeblur: One-Step Diffusion for Generalizable Real-World Video Deblurring

RealVDeblur:用于通用真实世界视频去模糊的一步扩散法

Renbiao Jin, Mingxin Yang, Yutian Chen, Junhao Zhuang, Xin Cai, Mulin Yu, Linning Xu, Wenxian Yu, Danping Zou, Shi Guo, Tianfan Xue

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) CUHK MMLab(香港中文大学多媒体实验室) CPII under InnoHK(创新香港研究院下的CPII) Tsinghua University(清华大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 针对真实世界视频去模糊难题,提出RealVDeblur框架。构建模糊合成管道提供数据,利用视频扩散先验恢复,采用逐帧编码并简化采样为一步生成器,还有时间窗口掩码稳定推理,在多方面表现出色且提升3D重建鲁棒性。

Comments Project page with code: https://rbjin.github.io/RealVDeblur/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10792 2026-07-14 cs.CV 新提交 77%

MAC-Splat: Multi-Attribute Consistency for High-Fidelity Sparse-View Reconstruction

MAC-Splat:用于高保真稀疏视图重建的多属性一致性

Jinqian Yang, Yichen Wu, Wanhua Li, Haokun Lin, Renzhen Wang, Xiangchu Feng, Xixi Jia

机构 * Xidian University(西安电子科技大学) Harvard University(哈佛大学) Nanyang Technological University(南洋理工大学) City University of Hong Kong(香港城市大学) Xi’an Jiaotong University(西安交通大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 针对稀疏视图重建中现有方法存在几何伪影的问题,提出MAC-Splat训练框架,利用MASt3R和DINOv3获取2D对应关系并定义MAC损失,联合正则化3D属性,实验证明该方法能有效解决不适定的稀疏视图重建问题,性能优于基线。

Comments Accepted to the European Conference on Computer Vision (ECCV 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03875 2026-07-07 cs.CV 新提交 77%

MACRO: Training-free Multi-plane Attention for Closeup Render Optimization

MACRO:用于特写渲染优化的免训练多平面注意力

Nitzan Hodos, Roy Amoyal, Lior Fritz, Ianir Ideses, Sagie Benaim, Netalee Efrat

机构 * Amazon Prime Video(亚马逊Prime视频) Technion, Israel Institute of Technology(以色列理工学院) Ben Gurion University(本古里安大学) Hebrew University of Jerusalem(耶路撒冷希伯来大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 针对特写渲染难题,分析现有方法失败原因,提出MACRO,利用场景3D结构解决比例差距,无需架构改变和额外训练,贡献新基准和评估协议,取得领先成果。

Comments Project page: https://nitzanhod.github.io/MACRO

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26092 2026-07-07 cs.CV 新提交 77%

TryOnCrafter: Unleashing Camera Trajectories for Realistic Video Virtual Try-on via a Renderable 4D Try-on Proxy

TryOnCrafter: 通过可渲染的4D试穿代理释放相机轨迹以实现逼真的视频虚拟试穿

Hao Sun, Hao Yan, Mengting Chen, Quanjian Song, Yu Li, Juan Cao, Jinsong Lan, Xiaoyong Zhu, Bo Zheng, Sheng Tang

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学) Xiamen University(厦门大学) Alibaba Group(阿里巴巴集团)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);point cloud(abstract);分类 cs.CV

AI总结 提出TryOnCrafter,首个基于DiT的统一框架,通过可渲染4D试穿代理解耦人体与环境,实现相机可控的视频虚拟试穿,支持任意视角合成和下游应用。

Comments Project Page: https://sunhao242.github.io/TryOnCrafter_web.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19822 2026-07-07 cs.CV 版本更新 77%

HUGE-Bench: A Benchmark for High-Level UAV Vision-Language-Action Tasks

HUGE-Bench: 面向高级无人机视觉-语言-动作任务的基准测试

Jingyu Guo, Ziye Chen, Ziwen Li, Zhengqing Gao, Jiaxin Huang, Hanlue Zhang, Fengming Huang, Yu Yao, Tongliang Liu, Mingming Gong

机构 * The University of Melbourne(墨尔本大学) Melsy Tech(Melsy科技) MBZUAI Navlyn The University of Sydney(悉尼大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出HUGE-Bench基准,通过4个数字孪生场景和8个高级任务,评估无人机在简洁语言指令下执行安全、过程导向的复杂轨迹能力,并引入过程导向和碰撞感知指标,揭示现有VLA模型在高级语义完成和安全执行上的显著差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01628 2026-07-03 cs.CV 新提交 77%

Online Segment 3D Gaussians via Launching Virtual Drones

通过发射虚拟无人机在线分割3D高斯体

Liwei Liao, Rongjie Wang, Ronggang Wang

机构 * Guangdong Provincial Key Laboratory of Ultra High Definition Immersive Media Technology, Shenzhen Graduate School, Peking University(广东省超高清沉浸式媒体技术重点实验室,北京大学深圳研究生院) Pengcheng Laboratory(鹏城实验室) Peking University(北京大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出SAGO框架,通过虚拟无人机将3D分割转化为在线最佳视角规划任务,无需预设置即可在亚秒内从3D高斯体中提取干净3D资产。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06852 2026-07-02 cs.CV 版本更新 77%

Active View Selection with Perturbed Gaussian Ensemble for Tomographic Reconstruction

基于扰动高斯集成的主动视角选择用于层析重建

Yulun Wu, Ruyi Zha, Wei Cao, Yingying Li, Yuanhao Cai, Yaoyao Liu

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Australian National University(澳大利亚国立大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 针对稀疏视角CT重建中视角选择问题,提出扰动高斯集成框架,通过不确定性建模和密度引导扰动选择最优视角,有效消除几何伪影。

Comments Accepted to ECCV 2026. Project page: https://perturbed-gaussian-ensemble.cvmlgroup.web.illinois.edu/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30638 2026-06-30 cs.CV 77%

Open-Vocabulary and Referring Segmentation for 3D Gaussians Using 2D Detectors

开放词汇与指代分割:利用2D检测器实现3D高斯

Jameel Hassan, Yasiru Ranasinghe, Vishal Patel

机构 * Johns Hopkins University(约翰霍普金斯大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出GaussDet方法,利用离散的2D开放词汇检测器与指代表达能力,通过视图聚合语义标签分布实现3D场景的开放词汇分割和指代分割,在零样本设置下显著提升指代分割性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28840 2026-06-30 cs.CV 77%

DLGStream: Dynamic Language-embedded Guassian Splatting for Open-vocabulary Enabled Free-viewpoint Video Streaming

DLGStream: 动态语言嵌入高斯泼溅用于开放词汇的自由视点视频流

Zhihui Ke, Yuyang Liu, Xiaobo Zhou, Tie Qiu

机构 * School of Computer Science and Technology, Tianjin University, China(天津大学计算机科学与技术学院)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出DLGStream,一种动态语言嵌入高斯表示,通过双不透明度属性联合优化颜色和语言特征,并引入插值变形场减少时间冗余,实现低帧大小、高帧率的开放词汇自由视点视频流。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24874 2026-06-24 cs.CV cs.AI 新提交 77%

FLUX3D: High-Fidelity 3D Gaussian Generation with Diffusion-Aligned Sparse Representation

FLUX3D: 基于扩散对齐稀疏表示的高保真3D高斯生成

Haorui Ji, Weizhe Liu, Hongdong Li, Hengkai Guo

机构 * The Australian National University(澳大利亚国立大学) ByteDance(字节跳动)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出FLUX3D框架,通过扩散对齐结构化潜变量(DA-SLAT)和稀疏结构感知扩散变压器(SMDiT)解决稀疏体素表示中高频细节丢失和跨模态对齐问题,实现高保真图像到3D高斯生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24361 2026-06-24 cs.CV 新提交 77%

SignNet-1M: Large-Scale Multilingual Sign Language Video Dataset with Downstream Benchmarks

SignNet-1M:大规模多语言手语视频数据集及下游基准

Zhewen He, Junyi Hu, Haomian Huang, Zhenhua Li, Yu-Shen Liu, Yi Fang

机构 * New York University Abu Dhabi(纽约大学阿布扎比分校) ChatSign Technology(ChatSign 技术公司) Tsinghua University(清华大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出SignNet-1M,通过3D高斯泼溅、扩散模型和后期渲染增强合成多样化手语视频,提升模型在跨视角、背景和身份等分布偏移下的泛化能力。

Comments 25 pages. Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏