arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

共收录 447 信号源:cs.CV, cs.GR, cs.RO

1. 3D生成 447 篇

2603.18782 2026-04-01 cs.CV cs.AI 88%

Points-to-3D: Structure-Aware 3D Generation with Point Cloud Priors

Points-to-3D: 基于点云先验的结构感知3D生成

Jiatong Xia, Zicheng Duan, Anton van den Hengel, Lingqiao Liu

机构 * Australian Institute for Machine Learning, University of Adelaide, Australia(澳大利亚阿德莱德大学澳大利亚机器学习研究所)

专题命中 3D生成 :point cloud(title,abstract);3D generation(title,abstract);分类 cs.CV

AI总结 本文提出Points-to-3D框架,利用点云先验生成可控的3D资产和场景,通过结构修复网络和分阶段采样策略提升几何精度和渲染质量。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09110 2026-08-11 cs.CV cs.GR 新提交 88%

View-Adaptive Renderer for View-Consistent 2D-to-3D Generation

适用于视图一致的2D到3D生成的视图自适应渲染器

U-Chae Jun, Jaeeun Ko, Jiwoo Kang

专题命中 3D生成 :3D generation(title,abstract);NeRF(abstract,abstract_cn);3D reconstruction(abstract);分类 cs.CV、cs.GR

AI总结 针对单目2D转3D生成的视图不一致与计算负担问题,提出视图自适应神经渲染框架,结合自注意力融合模块,在无扩散SDS监督下实现高效高保真3D重建,性能接近当前最优。

Journal ref Multimedia Systems, vol.32, pp. 511, Aug 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18866 2024-12-02 cs.CV 87%

RIGI: Rectifying Image-to-3D Generation Inconsistency via Uncertainty-aware Learning

Jiacheng Wang, Zhedong Zheng, Wei Xu, Ping Liu

专题命中 3D生成 :3D generation(title,abstract);Gaussian Splatting(abstract);3DGS(abstract);3D reconstruction(abstract)

Comments Project Page: https://rigi3d.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.07452 2024-09-12 cs.CV cs.MM 87%

Hi3D: Pursuing High-Resolution Image-to-3D Generation with Video Diffusion Models

Haibo Yang, Yang Chen, Yingwei Pan, Ting Yao, Zhineng Chen, Chong-Wah Ngo, Tao Mei

专题命中 3D生成 :3D generation(title,abstract);Gaussian Splatting(abstract);3D reconstruction(abstract);novel view synthesis(abstract)

Comments ACM Multimedia 2024. Source code is available at \url{https://github.com/yanghb22-fdu/Hi3D-Official}

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.09981 2025-02-11 cs.CV 86%

Controllable Text-to-3D Generation via Surface-Aligned Gaussian Splatting

Zhiqi Li, Yiming Chen, Lingzhe Zhao, Peidong Liu

专题命中 3D生成 :3D generation(title,abstract);Gaussian Splatting(title);分类 cs.CV

Comments 3DV-2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11777 2025-11-19 cs.RO cs.CV 86%

Large Language Models and 3D Vision for Intelligent Robotic Perception and Autonomy

Vinit Mehta, Charu Sharma, Karthick Thiyagarajan

机构 * Machine Learning Lab IIIT Hyderabad(IIIT Hyderabad 机器学习实验室) SensR Lab Western Sydney University(Western Sydney University SensR实验室)

专题命中 3D生成 :3D vision(title,abstract);3D generation(abstract);spatial understanding(abstract);分类 cs.CV、cs.RO

Comments 45 pages, 15 figures, MDPI Sensors Journal

Journal ref Sensors 2025, 25(20), 6394

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12019 2025-12-22 cs.CV 85%

LN3DIFF++: Scalable Latent Neural Fields Diffusion for Speedy 3D Generation

LN3DIFF++: 可扩展的潜在神经场扩散用于快速3D生成

Yushi Lan, Fangzhou Hong, Shangchen Zhou, Shuai Yang, Xuyi Meng, Yongwei Chen, Zhaoyang Lyu, Bo Dai, Xingang Pan, Chen Change Loy

专题命中 3D生成 :3D generation(title,abstract);3D vision(abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 LN3DIFF++通过3D感知架构和变分自编码器实现快速高质量的3D生成,优于现有方法在推理速度和生成质量上。

Comments TPAMI 2025 version of LN3Diff. Project webpage: https://nirvanalan.github.io/projects/ln3diff/ Code: https://github.com/NIRVANALAN/LN3Diff

Journal ref IEEE Transactions on Pattern Analysis and Machine Intelligence, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.05008 2024-10-10 cs.CV 85%

FlowDreamer: Exploring High Fidelity Text-to-3D Generation via Rectified Flow

Hangyu Li, Xiangxiang Chu, Dingyuan Shi, Wang Lin

专题命中 3D生成 :3D generation(title,abstract);NeRF(abstract);Gaussian Splatting(abstract);分类 cs.CV

Comments Tech Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.13584 2024-07-23 cs.CV 85%

Connecting Consistency Distillation to Score Distillation for Text-to-3D Generation

Zongrui Li, Minghui Hu, Qian Zheng, Xudong Jiang

专题命中 3D生成 :3D generation(title,abstract);Gaussian Splatting(abstract);3DGS(abstract);分类 cs.CV

Comments Paper accepted by ECCV2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12957 2024-07-17 cs.CV 85%

GVGEN: Text-to-3D Generation with Volumetric Representation

Xianglong He, Junyi Chen, Sida Peng, Di Huang, Yangguang Li, Xiaoshui Huang, Chun Yuan, Wanli Ouyang, Tong He

专题命中 3D生成 :3D generation(title,abstract);Gaussian Splatting(abstract);3D reconstruction(abstract);分类 cs.CV

Comments ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.13908 2023-07-27 cs.CV 85%

Points-to-3D: Bridging the Gap between Sparse Points and Shape-Controllable Text-to-3D Generation

Chaohui Yu, Qiang Zhou, Jingliang Li, Zhe Zhang, Zhibin Wang, Fan Wang

专题命中 3D生成 :3D generation(title,abstract);NeRF(abstract);point cloud(abstract);分类 cs.CV

Comments Accepted by ACMMM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21572 2026-05-22 cs.CV cs.RO 84%

PhysX-Omni: Unified Simulation-Ready Physical 3D Generation for Rigid, Deformable, and Articulated Objects

PhysX-Omni: 为刚体、变形体和关节物体统一的模拟准备物理3D生成

Ziang Cao, Yinghao Liu, Haitian Li, Runmao Yao, Fangzhou Hong, Zhaoxi Chen, Liang Pan, Ziwei Liu

机构 * S-Lab, Nanyang Technological University(南洋理工大学S实验室)

专题命中 3D生成 :3D generation(title,abstract);分类 cs.CV、cs.RO

AI总结 本文提出PhysX-Omni,一种统一的模拟准备物理3D生成框架,通过开发针对视觉-语言模型的高效几何表示和首个通用模拟准备3D数据集PhysXVerse,以及评估生成和理解能力的PhysX-Bench,显著提升了生成和理解性能,推动下游应用如具身AI和物理模拟的发展。

Comments Project page: https://physx-omni.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.05099 2024-09-20 cs.CV cs.GR 84%

DreamMapping: High-Fidelity Text-to-3D Generation via Variational Distribution Mapping

Zeyu Cai, Duotun Wang, Yixun Liang, Zhijing Shao, Ying-Cong Chen, Xiaohang Zhan, Zeyu Wang

专题命中 3D生成 :3D generation(title,abstract);Gaussian Splatting(abstract);分类 cs.CV、cs.GR

Comments 15 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.00588 2024-08-12 cs.CV cs.GR 84%

LucidDreaming: Controllable Object-Centric 3D Generation

Zhaoning Wang, Ming Li, Chen Chen

专题命中 3D生成 :3D generation(title,abstract);NeRF(abstract);分类 cs.CV、cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17237 2024-03-27 cs.CV cs.AI cs.GR 84%

DreamPolisher: Towards High-Quality Text-to-3D Generation via Geometric Diffusion

Yuanze Lin, Ronald Clark, Philip Torr

专题命中 3D生成 :3D generation(title,abstract);Gaussian Splatting(abstract);分类 cs.CV、cs.GR

Comments Project webpage: https://yuanze-lin.me/DreamPolisher_page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.17807 2024-02-01 cs.CV cs.GR 84%

Advances in 3D Generation: A Survey

Xiaoyu Li, Qi Zhang, Di Kang, Weihao Cheng, Yiming Gao, Jingbo Zhang, Zhihao Liang, Jing Liao, Yan-Pei Cao, Ying Shan

专题命中 3D生成 :3D generation(title,abstract);novel view synthesis(abstract);分类 cs.CV、cs.GR

Comments 33 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.11284 2023-12-05 cs.CV cs.GR cs.MM 84%

LucidDreamer: Towards High-Fidelity Text-to-3D Generation via Interval Score Matching

Yixun Liang, Xin Yang, Jiantao Lin, Haodong Li, Xiaogang Xu, Yingcong Chen

专题命中 3D生成 :3D generation(title,abstract);Gaussian Splatting(abstract);分类 cs.CV、cs.GR

Comments The first two authors contributed equally to this work. Our code will be available at: https://github.com/EnVision-Research/LucidDreamer

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02711 2026-08-14 cs.CV 版本更新 83%

Hunyuan3D-Buffalo 1.0: A Unified Multimodal Model for Scalable 3D Generation, Understanding, and Editing

Hunyuan3D-Buffalo 1.0:用于可扩展3D生成、理解与编辑的统一多模态模型

Junliang Ye, Kenkun Liu, Guocun Wang, Yang Li, Yansong Qu, Chunshi Wang, Jingwei Xu, Yunhan Yang, Zibo Zhao, Jiachen Xu, Jiaao Yu, Lifu Wang, Zhihao Liang, Xin Huang, Zhuo Chen, Chunchao Guo

机构 * Tencent Hunyuan(腾讯混元)

专题命中 3D生成 :3D generation(title,abstract);spatial understanding(abstract);分类 cs.CV

AI总结 Hunyuan3D-Buffalo 1.0是支持3D理解、文本到3D生成等功能的统一多模态模型,构建87M规模语料库训练,在相关基准上达SOTA或领先性能,验证了统一训练的有效性。

Comments Project Page: https://tencent-hunyuan.github.io/Hunyuan3D-Buffalo1.0

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14271 2026-06-29 cs.CV 版本更新 83%

Let Language Constrain Geometry: Vision-Language Models as Semantic and Spatial Critics for 3D Generation

让语言约束几何:视觉-语言模型作为3D生成的语义和空间评判者

Weimin Bai, Yubo Li, Weijian Luo, Zeqiang Lai, Yequan Wang, Wenzheng Chen, He Sun

机构 * Peking University(北京大学) hi-lab, Xiaohongshu Inc.(小红书科技公司 hi-lab) MMLab, CUHK(香港中文大学 MMLab) Beijing Academy of Artificial Intelligence(北京人工智能研究院)

专题命中 3D生成 :3D generation(title,abstract);spatial understanding(abstract);分类 cs.CV

AI总结 提出VLM3D框架,利用视觉-语言模型作为可微分的语义和空间评判者,通过双查询评判信号改善文本到3D生成的语义对齐和几何一致性。

Comments arXiv admin note: substantial text overlap with arXiv:2509.15772

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15228 2026-06-19 cs.CV 版本更新 83%

Collaborative Multi-Modal Coding for High-Quality 3D Generation

协作多模态编码用于高质量3D生成

Ziang Cao, Zhaoxi Chen, Liang Pan, Ziwei Liu

机构 * S-Lab, Nanyang Technological University, Singapore(南洋理工大学S实验室) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 3D生成 :3D generation(title,abstract);point cloud(abstract);分类 cs.CV

AI总结 提出TriMM,首个前馈式3D原生生成模型,通过协作多模态编码融合RGB、RGBD和点云特征,结合辅助2D/3D监督和三平面潜在扩散模型,实现高质量3D资产生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10922 2026-05-12 cs.CV 83%

Pixal3D: Pixel-Aligned 3D Generation from Images

Pixal3D: 从图像生成像素对齐的3D内容

Dong-Yang Li, Wang Zhao, Yuxin Chen, Wenbo Hu, Meng-Hao Guo, Fang-Lue Zhang, Ying Shan, Shi-Min Hu

机构 * BNRist, Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系BNRist) Tencent ARC Lab(腾讯ARC实验室) Victoria University of Wellington(惠灵顿维多利亚大学)

专题命中 3D生成 :3D generation(title,abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 Pixal3D通过像素对齐方法提升3D生成的保真度,解决2D-3D对应问题,实现高保真3D资产生成。

Comments SIGGRAPH 2026. Project page: https://ldyang694.github.io/projects/pixal3d/

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02316 2026-04-28 cs.CV cs.AI 83%

ConsDreamer: Advancing Multi-View Consistency for Zero-Shot Text-to-3D Generation

ConsDreamer:推进多视图一致性以实现零样本文本到3D生成

Yuan Zhou, Shilong Jin, Litao Hua, Wanjun Lv, Haoran Duan, Jungong Han

机构 * School of Artificial Intelligence, Nanjing University of Information Science and Technology(南京信息工程大学人工智能学院) Department of Automation, Tsinghua University(清华大学自动化系) Lenovo(联想)

专题命中 3D生成 :3D generation(title,abstract);Gaussian Splatting(abstract);分类 cs.CV

AI总结 ConsDreamer通过消除视图偏差和几何一致性约束,解决多面Janus问题,提升零样本文本到3D生成的多视图一致性。

Comments Accepted by IEEE Transactions on Image Processing, Code is available at: https://github.com/GAInuist/ConsDreamer

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29387 2026-04-01 cs.CV cs.AI 83%

Extend3D: Town-Scale 3D Generation

Extend3D:城镇级3D生成

Seungwoo Yoon, Jinmo Kim, Jaesik Park

机构 * Seoul National University(首尔国立大学)

专题命中 3D生成 :3D generation(title,abstract);point cloud(abstract);分类 cs.CV

AI总结 本文提出Extend3D,一种无需训练的3D场景生成方法,通过扩展潜在空间并结合SDEdit实现3D补全与优化。

Comments CVPR 2026, Project Page: http://seungwoo-yoon.github.io/extend3d-page

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01601 2026-03-26 cs.CV 83%

Dehallu3D: Hallucination-Mitigated 3D Generation from Single Image via Cyclic View Consistency Refinement

Dehallu3D:通过循环视图一致性细化实现单图像hallucination抑制的3D生成

Xiwen Wang, Shichao Zhang, Hailun Zhang, Ruowei Wang, Mao Li, Chenyu Zhou, Qijun Zhao, Ji-Zhe Zhou

机构 * Sichuan University(四川大学)

专题命中 3D生成 :3D generation(title,abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 Dehallu3D通过设计平衡的多视图连续性约束和Outlier Risk Measure指标,有效抑制单图像3D生成中的hallucination,提升生成结构的几何精度和细节保留能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23150 2025-11-26 cs.CV 83%

AlignCVC: Aligning Cross-View Consistency for Single-Image-to-3D Generation

AlignCVC: 为单图像到3D生成对齐跨视图一致性

Xinyue Liang, Zhiyuan Ma, Lingchen Sun, Yanjun Guo, Lei Zhang

专题命中 3D生成 :3D generation(title,abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 AlignCVC通过分布对齐而非回归损失,提升单图像到3D生成的跨视图一致性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15772 2025-09-22 cs.CV 83%

Vision-Language Models as Differentiable Semantic and Spatial Rewards for Text-to-3D Generation

Weimin Bai, Yubo Li, Weijian Luo, Wenzheng Chen, He Sun

机构 * Peking University(北京大学) Xiaohongshu Inc(小红书公司)

专题命中 3D生成 :3D generation(title,abstract);spatial understanding(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00428 2025-08-04 cs.GR cs.HC 83%

Sel3DCraft: Interactive Visual Prompts for User-Friendly Text-to-3D Generation

Nan Xiang, Tianyi Liang, Haiwen Huang, Shiqi Jiang, Hao Huang, Yifei Huang, Liangyu Chen, Changbo Wang, Chenhui Li

专题命中 3D生成 :3D generation(title,abstract);spatial understanding(abstract);分类 cs.GR

Comments IEEE VIS VAST 2025 ACM 2012 CCS - Human-centered computing, Visualization, Visualization design and evaluation methods

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.03184 2025-05-02 cs.CV 83%

Ouroboros3D: Image-to-3D Generation via 3D-aware Recursive Diffusion

Hao Wen, Zehuan Huang, Yaohui Wang, Xinyuan Chen, Lu Sheng

机构 * School of Software, Beihang University(北航软件学院) Shanghai AI Laboratory(上海人工智能实验室) VAST(中国科学院软件研究所)

专题命中 3D生成 :3D generation(title,abstract);3D reconstruction(abstract);分类 cs.CV

Comments See our project page at https://costwen.github.io/Ouroboros3D/

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.18974 2025-02-21 cs.CV cs.AI 83%

3D-Adapter: Geometry-Consistent Multi-View Diffusion for High-Quality 3D Generation

Hansheng Chen, Bokui Shen, Yulin Liu, Ruoxi Shi, Linqi Zhou, Connor Z. Lin, Jiayuan Gu, Hao Su, Gordon Wetzstein, Leonidas Guibas

专题命中 3D生成 :3D generation(title,abstract);Gaussian Splatting(abstract);分类 cs.CV

Comments Project page: https://lakonik.github.io/3d-adapter/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04470 2024-12-06 cs.CV 83%

Turbo3D: Ultra-fast Text-to-3D Generation

Hanzhe Hu, Tianwei Yin, Fujun Luan, Yiwei Hu, Hao Tan, Zexiang Xu, Sai Bi, Shubham Tulsiani, Kai Zhang

专题命中 3D生成 :3D generation(title,abstract);Gaussian Splatting(abstract);分类 cs.CV

Comments project page: https://turbo-3d.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏