arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

共收录 233 信号源:cs.CV, cs.GR, cs.RO

1. Gaussian Splatting 233 篇

2606.10656 2026-06-10 cs.CV 新提交 74%

Envision4D: Envisioning Visual Futures via Feed-forward 4D Gaussian Splatting for Autonomous Driving

Envision4D: 通过前馈4D高斯泼溅展望自动驾驶的视觉未来

Qi Song, Yifei He, Chi Zhang, Zheng Fu, Xuhe Zhao, Mengmeng Yang, Kun Jiang, Rui Huang, Diange Yang

机构 * Tsinghua University(清华大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

专题命中 Gaussian Splatting :Gaussian Splatting(title);分类 cs.CV

AI总结 提出Envision4D,一种全自监督前馈框架,通过未来姿态预测、层内时间注意力和条件运动提升,实现无位姿的未来外推,在自动驾驶动态场景预测中达到最先进性能。

Comments Project Page: https://maggiesong7.github.io/research/Envision4D/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22997 2026-07-28 cs.RO cs.AI cs.GR cs.LG 新提交 73%

Real2Sim2Real for Vision-Language-Action Manipulation: An AMD ROCm-Based Pipeline

用于视觉-语言-动作操纵的Real2Sim2Real:基于AMD ROCm的管道

Qing Yang, Xun Wang, Ziguan Wang, Zhenjiang Li, Hongqiang Wang, Dongdong Weng

机构 * AMD AIG Team(AMD人工智能团队) Beijing Institute of Technology(北京理工大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);分类 cs.GR、cs.RO

AI总结 本文针对视觉-语言-动作操纵提出基于AMD ROCm的Real2Sim2Real技术栈,涵盖多硬件计算,由开放软件栈统一。通过四个演示表明无需CUDA锁定生态系统,展示了在多硬件平台上的相关成果,且管道可在特定硬件和平台上原生运行并重现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20789 2026-07-24 cs.CV cs.GR 新提交 73%

3D-GIMP: When 3D Gaussian Inpainting Meets PatchMatch

3D-GIMP:当3D高斯图像修复与PatchMatch相遇

Xuening Tian, Dieter Schmalstieg, Shohei Mori

机构 * University of Stuttgart(斯图加特大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3D reconstruction(abstract);分类 cs.CV、cs.GR

AI总结 针对3D场景编辑中迭代扩散模型的问题,提出3D-GIMP混合范式,通过在关键参考视图进行图像修复并利用3D感知PatchMatch算法传播纹理,优先保证重建一致性,在渲染速度和视图一致性上表现更优。

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01202 2026-07-02 cs.CV cs.AI cs.GR 新提交 73%

World from Motion: Generative Dynamic Gaussian Reconstruction from Monocular Video

世界源于运动:从单目视频生成动态高斯重建

Liyuan Zhu, Shengyu Huang, Amrita Mazumdar, Tianye Li, Zan Gojcic, Gordon Wetzstein, Iro Armeni, Shalini De Mello, Alex Trevithick

机构 * Stanford University(斯坦福大学) NVIDIA(英伟达)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);分类 cs.CV、cs.GR

AI总结 提出World from Motion方法,利用视频模型从单目视频生成可自由渲染的动态3D高斯表示,通过像素对齐渲染校正伪影并填充缺失区域,实现4D重建新高度。

Comments Project page: https://research.nvidia.com/labs/amri/projects/world-from-motion/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12860 2026-08-14 cs.RO 新提交 70%

HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments

HumanoidVLN:面向多种人形机器人形态的基于物理的视觉语言导航模拟器与基准

Quan-Dung Pham, Anh Dao, The-Anh Nguyen, Minh Nguyen-Dinh, Phuong Nam Dang, Tri Pham, Hung Tran, Bach Dao, Tuyen P. Le, Truong Nguyen, Quan Nguyen

机构 * VinMotion, Inc.(VinMotion公司) University of Southern California(南加州大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract,abstract_cn);分类 cs.RO

AI总结 本研究针对人形机器人VLN的物理约束与形态差异问题,提出基于NVIDIA Isaac Sim的HumanoidVLN模拟器与基准,验证其与多种模型、机器人的兼容性,实验揭示了VLN模型、控制器与人形形态的交互关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11077 2026-08-12 cs.CV 新提交 70%

Learning Gaussian Structure: Intervention-Guided Density Control for Feed-Forward Driving Reconstruction

学习高斯结构:用于前向驾驶重建的干预引导密度控制

Hang Li, Jiahe Li, Meiying Gu, Jin Zheng, Lina Yu, Xiao Bai

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);分类 cs.CV

AI总结 本文提出Learning Gaussian Structure(LGS)框架,通过干预引导的高斯结构调整与跨时间点查询,在Waymo Open Dataset和PandaSet上实现了优于现有方法的驾驶场景重建效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10712 2026-08-12 cs.CV 新提交 70%

Compact Feed-Forward 3D Gaussians via Saliency-Guided Primitive Merging

基于显著性引导基元合并的紧凑前馈三维高斯模型

Tim-Felix Fassch, Jochen Kall, Cyrill Stachniss

机构 * Bosch Research(博世研究院) University of Bonn(波恩大学) Lamarr Institute for Machine Learning and Artificial Intelligence(拉马尔机器学习与人工智能研究院)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract,abstract_cn);分类 cs.CV

AI总结 该研究针对前馈三维高斯方法基元冗余问题,提出显著性引导的基元合并流水线,可在仅1/20高斯数量下保留视觉质量,实现高效紧凑的三维场景表示与渲染。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10682 2026-08-12 cs.CV 新提交 70%

Visual Geometry Foundation-Aware Gaussians for Single-Frame Surround-View Driving Reconstruction

面向单帧环视驾驶场景重建的视觉几何基础感知高斯模型

Junhong Lin, Jinlong Wang, Xianda Guo, Yanlun Peng, Wei Zheng, Guoqing Liu, Hanli Wang, Tiesong Zhao, Wei Gao

机构 * Guangdong Provincial Key Laboratory of Ultra High Definition Immersive Media Technology(广东省超高清沉浸式媒体技术重点实验室) School of Electronic and Computer Engineering, Peking University(北京大学电子与计算机工程学院) Peng Cheng Laboratory(鹏城实验室) Wuhan University(武汉大学) Great Wall Motor(长城汽车) Minieye Corporation(Minieye公司) Tongji University(同济大学) Fuzhou University(福州大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract,abstract_cn);分类 cs.CV

AI总结 本文提出VGGD框架,通过引入视觉几何先验、双路径颈部等模块,在nuScenes基准上实现了单帧环视驾驶场景重建的最优渲染质量与几何一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05482 2026-08-07 cs.CV 新提交 70%

CDSeg: A Renderable Gaussian Carrier for Image-to-3D Label Transfer

CDSeg:用于图像到3D标签迁移的可渲染高斯载体

Wentao Sun, Yiping Chen, Zhengsen Xu, Jonathan Li, John S. Zelek

机构 * University of Waterloo(滑铁卢大学) Sun Yat-sen University(中山大学) University of Calgary(卡尔加里大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);point cloud(abstract);分类 cs.CV

AI总结 CDSeg是基于高斯溅射的跨域分割接口,无需特定任务3D分割训练,可复用2D掩码实现多视图标签迁移,在多个数据集上取得高mIoU,能快速处理大规模场景。

Comments 15 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01726 2026-08-04 cs.CV 新提交 70%

G-Skin: Learning to Bind 3D Gaussians with Generative Visual Priors

G-Skin:学习结合生成式视觉先验的3D高斯绑定方法

Yuxin Yao, Kendong Liu, Shiqi Zhou, Jiazhi Xia, Junhui Hou

机构 * City University of Hong Kong(香港城市大学) Central Media Technology Institute, Huawei(华为中央媒体技术研究院) Central South University(中南大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract,abstract_cn);分类 cs.CV

AI总结 本文针对3D高斯资产绑定的难题,提出生成式蒙皮框架G-Skin,利用2D视觉基础模型提炼运动先验构建优化流程,可灵活泛化并优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01053 2026-08-04 cs.CV 新提交 70%

Struct-GStream: Towards Efficient Free-Viewpoint Video Streaming at Low-Bitrates with Structured 3D Gaussians

Struct-GStream:基于结构化3D高斯的低码率高效自由视点视频流技术

Han Jiao, Jiakai Sun, Lei Zhao, Wei Xing, Huaizhong Lin, Zhanjie Zhang, Ao Ma

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) Chinese Academy of Sciences(中国科学院) University of Science and Technology Beijing(北京科技大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);分类 cs.CV

AI总结 本文针对现有自由视点视频在线训练方法存储与训练时间不足的问题,提出Struct-GStream,通过结构化3D高斯等技术实现低码率下的高效视频流,性能优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28032 2026-07-31 cs.CV 新提交 70%

Split and Drive: Dual-Axis Disentanglement for Real-Time Gaussian Head Avatars

Split and Drive:用于实时高斯头像的双轴解耦

MD Wahiduzzaman Khan, Mingshan Jia, Xiaolin Zhang, En Yu, Kaska Musial-Gabrys

机构 * University of Technology Sydney(悉尼科技大学) Shandong University of Science and Technology(山东科技大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract,abstract_cn);分类 cs.CV

AI总结 该研究针对单图像生成可动画头部头像的挑战,提出双轴解耦的SpiD框架,通过内化逐帧驱动、分解面部高斯分支,实现了性能优且速度快的实时高斯头像生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23189 2026-07-28 cs.CV cs.AI 新提交 70%

Fashion-3DLR: A Controllable 3D Garment Generation Using Pairwise Fashion Elements for Intelligent Design

Fashion-3DLR:一种使用成对时尚元素进行智能设计的可控3D服装生成方法

Shenghao Yang, Hongtao Zhang, Yuhan Yi, Zhihao Tang, Zihao Cui, Lian Wen, Han Yan, Yuan Gao, Mingbo Zhao

机构 * Donghua University(东华大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);分类 cs.CV

AI总结 研究针对3D服装生成难题,提出Fashion-3DLR框架,通过GFF-DiT模块融合2D时尚设计元素,利用整流流Transformer生成几何潜在值,实现多种3D服装表示,并集成到下游任务,实验证明其超越现有方法,有成为通用3D服装设计工具的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10489 2026-07-14 cs.CV 新提交 70%

Grassmannian Splatting I: Moving rank-2 Spacetime Surfels for Dynamic Scene Rendering

格拉斯曼体点云绘制 I:用于动态场景渲染的移动秩-2时空表面元素

Aaron Maurice Berman, Shantanu Dave

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);分类 cs.CV

AI总结 该研究提出格拉斯曼体点云绘制用于动态场景渲染,其基元为特定高斯分布,运动模型封闭,无需学习变形场和自定义CUDA。在17个HyperNeRF场景训练速度最快,PSNR、MS-SSIM和LPIPS排名第二。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08769 2026-07-10 cs.CV 新提交 70%

Geometry and Gradient-based Partitioning for Panoramic Outdoor Reconstruction

基于几何和梯度的全景户外重建分区方法

Weijian Chen, Weibo Yao, Yuhang Zhang, Xiaolin Tang, Guo Wang, Weijun Zhang, Xitong Gao, Yihao Chen, Hongde Qin, Lu Qi

机构 * Insta360 Research(Insta360研究机构) Sun Yat-sen University(中山大学) South China University of Technology(华南理工大学) University of Chinese Academy of Sciences(中国科学院大学) Harbin Engineering University(哈尔滨工程大学) Wuhan University(武汉大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);分类 cs.CV

AI总结 针对大规模全景3D高斯点云重建成本高问题,提出PanoLOG两阶段框架,利用几何和梯度进行分区,粗阶段用天球建模等,细化阶段构建自适应边界体积等,还构建数据集,实现了高质量渲染和可扩展训练。

Comments Project Webpage: https://insta360-research-team.github.io/GGPS-Website

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31050 2026-07-01 cs.CV cs.AI 新提交 70%

Learning Video Dynamics with Predictive Differentiable Rendering

基于预测可微渲染的视频动态学习

Yujin Tang, Tian Zhou, Xin Lin, Cheng Tan, Yifan Hu, Rong Jin, SouYoung Jin, Liang Sun

机构 * Dartmouth College(达特茅斯学院) DAMO Academy, Alibaba Group(阿里巴巴达摩院) University of California, San Diego(加州大学圣地亚哥分校) Westlake University(西湖大学) Tsinghua University(清华大学) Ant Group(蚂蚁集团)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 提出预测可微渲染(PDR)框架,通过2D高斯表示的轻量适配器PredGS和CUDA加速渲染器predgsplat,结合L1和SSIM损失优化,在离散像素与连续表示间架桥,显著提升视频预测的细节保真度和准确性。

Comments Accepted by ECCV 2026. 18 pages, 5 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24876 2026-06-24 cs.CV 新提交 70%

FLAT: Feedforward Latent Triangle Splatting for Geometrically Accurate Scene Generation

FLAT: 前馈潜在三角形泼溅用于几何精确的场景生成

Orest Kupyn, Goutam Bhat, Philipp Henzler, Fabian Manhardt, Christian Rupprecht, Federico Tombari

机构 * Google Research(谷歌研究院) University of Oxford, Visual Geometry Group(牛津大学视觉几何组) TU Munich(慕尼黑工业大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);分类 cs.CV

AI总结 提出FLAT方法,首次从视频扩散潜在表示中直接解码三角形泼溅,通过射线中心旋转参数化和乘积窗口函数解决梯度流问题,在保持视觉质量的同时显著提升几何精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28049 2026-07-31 eess.IV cs.CV cs.GR 新提交 62%

TSOG: A Format For Temporally And Spatially Ordered Gaussians

TSOG:时空有序高斯格式

Shady Gmira, Evangelos Alexiou, Emmanouil Potetsianakis, Emmanuel Thomas

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV、cs.GR

AI总结 该研究提出TSOG格式,扩展SOG框架至时间域以高效表示4DGS内容,经评估其文件大小缩减超90%且质量下降极小,可实现动态4D内容的高效存储与传输。

Comments 2026 IEEE International Conference on Image Processing (ICIP). IEEE, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18466 2026-07-22 cs.CV cs.GR 新提交 62%

ECoNGS: Efficient Compressive Neural Gaussian Splats for Volume Visualization

ECoNGS:用于体数据可视化的高效压缩神经高斯点云

Kaiyuan Tang, Chaoli Wang

机构 * University of Notre Dame(圣母大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV、cs.GR

AI总结 研究针对大型数据集体数据可视化,提出ECoNGS框架,用轻量级神经网络从显式锚点预测隐式高斯点云,结合联合学习策略、神经熵模型压缩及特定初始化策略,相比iVR-GS在多方面性能更优。

Comments To be published in Proceedings of IEEE VIS 2026, IEEE Transactions on Visualization and Computer Graphics

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13451 2026-07-16 cs.RO cs.AI cs.CV 新提交 62%

Learning Physics-Guided Residual Dynamics for Deformable Object Simulation

学习用于可变形物体模拟的物理引导残差动力学

Shivansh Patel, Kaifeng Zhang, Sanjay Pokkali, Svetlana Lazebnik, Yunzhu Li

机构 * UIUC(伊利诺伊大学厄巴纳 - 香槟分校) Columbia University(哥伦比亚大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV、cs.RO

AI总结 研究针对可变形物体模拟中动力学预测难的问题,提出物理引导残差动力学(PGRD)框架,结合物理与学习方法优势,采用特定架构和公式,在多物体模拟上结果更准,还展示了其在操作规划和交互式模拟中的应用效用。

Comments Website: https://pgrd-robot.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08948 2026-07-13 cs.RO cs.CV 新提交 62%

SplatCtrl: Perception-Action Coupling via Gaussian Scene Representations and Reactive Robot Control

SplatCtrl:通过高斯场景表示和反应式机器人控制实现感知-动作耦合

Siddarth Jain, Ho Jin Choi

机构 * Mitsubishi Electric Research Laboratories (MERL)(三菱电机研究实验室) University of Pennsylvania(宾夕法尼亚大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV、cs.RO

AI总结 针对机器人在非结构化动态环境控制难题,提出SplatCtrl框架。基于3D高斯溅射,引入混合滤波和重定位策略用于场景重建,还提出从高斯推导距离函数的方法,纳入控制障碍函数,实现感知-动作耦合,经实验验证有效。

Comments Published in 2026 International Conference on Robotics and Automation (ICRA). 8 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11314 2026-06-11 cs.CV cs.GR 新提交 62%

TRON: Tracing Rays to Orchestrate a Neural Renderer for 3D Gaussian Reconstructions

TRON:追踪光线以编排用于3D高斯重建的神经渲染器

Or Perel, Hassan Abu Alhaija, Zian Wang, Jacob Munkberg, Matan Atzmon, Sanja Fidler, Masha Shugrina

机构 * NVIDIA(英伟达) University of Toronto(多伦多大学) Vector Institute(向量研究所)

专题命中 Gaussian Splatting :3D reconstruction(abstract);分类 cs.CV、cs.GR

AI总结 提出TRON框架,结合3D高斯光线追踪与神经渲染,实现真实世界3D场景在新光照、动态物体运动、物体插入和材质编辑下的逼真可控渲染,通过内在分解先验和光线追踪辐射引导,弥合物理渲染与神经渲染的差距。

Comments Project page: https://research.nvidia.com/labs/sil/projects/tron/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03023 2026-08-05 cs.CV cs.AI 新提交 57%

Standalone DINOv3 for Training-Free Open-Vocabulary Semantic Segmentation in Remote Sensing

用于遥感领域无需训练的开放词汇语义分割的独立DINOv3模型

Changhao Zhao, Haoxiang Li, Yuke Li, Hai Liu, LingLin Zeng

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 针对遥感语义分割标注成本高的问题,提出无需训练的DinoSplat-OV框架,结合DINOv3的文本感知拉普拉斯传播与高斯溅射上采样模块,在多数据集上取得优于现有方法的性能,填补了DINO系列模型在该领域的空白。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02206 2026-08-04 cs.CV 新提交 57%

CLEAR: Conflict-aware Learning via Evidence-guided Adaptive Routing for Unified Sparse-View 3D Gaussian Super-Resolution

CLEAR:面向统一稀疏视图三维高斯超分辨率的证据引导自适应路由的冲突感知学习

Hantang Li, Qiang Zhu, Xiandong Meng, Debin Zhao, Xiaopeng Fan

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 针对稀疏视图三维高斯超分辨率的误差累积问题,提出首个统一单阶段框架CLEAR,通过冲突感知优化、证据引导路由等技术,在4×超分辨率基准上实现了最优渲染质量与几何保真度。

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27634 2026-07-31 cs.CV 新提交 57%

4DHumanDiff: Direct Text-to-4DGS Generation for Consistent 360-Degree Dynamic Humans

4DHumanDiff:直接基于文本生成4DGS以实现一致的360度动态人类

Renlong Wu, Haoran Chen, Yuxiang Wei, Xiaowei Jin, Wangmeng Zuo, Hui Li

机构 * School of Computer Science and Technology, Harbin Institute of Technology(哈尔滨工业大学计算机科学与技术学院)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 针对文本生成360度动态人类的现有方法存在成本高、一致性差的问题,本文提出4DHumanDiff扩散框架,直接基于文本生成4DGS表示的动态人类,结合新数据集与技术,实现高效且一致性更好的生成。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19100 2026-07-22 cs.CV 新提交 57%

FlexiAvatar: Unified 3D Gaussian Human Avatars Under Arbitrary Body Visibility

FlexiAvatar:任意身体可见性下的统一3D高斯人体头像

Yihalem Yimolal Tiruneh, Muhammad Salman Ali, Uyoung Jeong, Muneeb A. Khan, MD Khalequzzaman Chowdhury Sayem, Allanur Bayramgeldiyev, Binod Bhattarai, Seungryul Baek

机构 * UNIST(韩国蔚山科学技术院) University of Aberdeen(阿伯丁大学) University College London(伦敦大学学院) Fogsphere(雾球公司)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 研究从单目视频重建3D人体头像问题,提出FlexiAvatar框架,结合遮挡鲁棒跟踪与特定部分残差细化捕捉细节,用扩散方法处理不可见区域,实验表明其重建质量高,还能减少运行时和内存开销。

Comments Accepted in ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17896 2026-07-21 cs.CV 新提交 57%

Locality-Aware Density Control for Efficient Gaussian-based Image Representation

用于高效基于高斯的图像表示的局部感知密度控制

Jiacong Chen, Qingyu Mao, Xiandong Meng, Shuai Liu, Chao Li, Fanyang Meng, Youneng Bao, Yongsheng Liang

机构 * Shenzhen University(深圳大学) Pengcheng Laboratory(鹏城实验室) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 研究二维高斯喷溅图像表示中高斯容量分配低效问题,提出局部感知密度控制框架LocoADC,通过区域高斯致密化和相似性驱动高斯合并策略及局部颜色一致性约束,有效提升高斯容量利用率,改进图像表示。

Comments Accepted by ACMMM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16362 2026-07-21 cs.CV 新提交 57%

OmniStyle-INR: Universal and Multimodal Style Transfer for INRs

OmniStyle-INR:用于隐式神经表示的通用多模态风格迁移

Rafał Kajca, Michał Miziołek, Kornel Howil, Rafał Tobiasz, Przemysław Spurek

机构 * Jagiellonian University(雅盖隆大学) IDEAS Research Institute(IDEAS 研究所)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 研究针对不同数据模态的风格迁移问题,提出OmniStyle-INR框架,利用基于网络的连续表示作为通用域,实现了在文本提示和视觉示例引导下跨视觉模态的高质量风格迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16309 2026-07-21 cs.CV 新提交 57%

SaaF: Scene-Specific Ambiguity-Aware 3D Language Fields towards Interactive Real-World Object Retrieval

SaaF:面向交互式现实世界对象检索的特定场景模糊感知3D语言场

Yuga Yano, Daiju Kanaoka, Hakaru Tamukoh, Yasutomo Kawanishi

机构 * Kyushu Institute of Technology(九州工业大学) RIKEN(理化学研究所) Research Center for Neuromorphic AI Hardware(神经形态人工智能硬件研究中心)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 研究针对现实世界场景中交互式对象检索问题,提出SaaF方法。通过引入度量学习策略构建统一特征空间,增强实例辨别性与模糊感知能力,提升了检索准确性,还能稳健处理查询模糊性。

Comments 8 pages, accepted as a conference paper for IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15806 2026-07-20 cs.CV 新提交 57%

HybridSim: A Physics-Learning Hybrid Digital Twin for mmWave Human Sensing

HybridSim:用于毫米波人体感知的物理学习混合数字孪生

Weitao Xiong, Tianyu Liu, Peng Li, Kok Chung Chua, Toa Chean Khim, Pu Wang, Hongfei Xue

机构 * Xiamen University Malaysia(厦门大学马来西亚分校) The Hong Kong University of Science and Technology(香港科技大学) University of North Carolina at Charlotte(北卡罗来纳大学夏洛特分校)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 研究针对毫米波雷达信号模拟成本高问题,提出HybridSim混合模拟器,用三平面和图卷积网络等提取人体特征、稳定优化,通过逆渲染等建模信号路径,实验显示其能有效增强特定地点数据,提升人体感知任务表现。

Comments Accepted to ECCV 2026. Project Page: https://weitao-xiong.github.io/HybridSim/

详情

展开后加载摘要…

URL PDF HTML 收藏