arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-07-31 至 2026-07-31 共收录 6 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 2 篇

2605.20290 2026-07-31 cs.GR cs.CV 版本更新 82%

PhysOmni: Physics-Grounded Multi-Object Scene Generation from a Single Image with Real-Time Interaction

TelePhysics: 从单张图像生成物理一致的多物体场景 with 实时交互

Xin Zhang, Yabo Chen, Yijie Fang, Wanying Qu, Haibin Huang, Chi Zhang, Feng Xu, Xuelong Li

机构 * Fudan University(复旦大学) Institute of Artificial Intelligence, China Telecom (TeleAI)(中国电信人工智能研究院(TeleAI))

专题命中 三维重建 :3D reconstruction(abstract,abstract_cn);3D generation(abstract,abstract_cn);分类 cs.CV、cs.GR

AI总结 本文提出TelePhysics,一种无需训练的框架,通过整体场景级3D重建将单张图像转换为物理一致且可控的视频。该方法通过统一的空间坐标系统表示完整场景几何,解决物体穿透和对齐模糊问题,实现准确的多物体交互和更丰富的复杂控制类型,从而在保持逼真视觉保真度的同时实现实时物理交互预览。

Comments ACMMM 2026. Project page: https://physomni.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18801 2026-07-31 cs.CV 版本更新 57%

PartDiffuser: Part-wise 3D Mesh Generation via Discrete Diffusion

PartDiffuser:通过离散扩散实现部件级3D网格生成

Yichen Yang, Hong Li, Haodong Zhu, Linin Yang, Guojun Lei, Sheng Xu, Baochang Zhang

机构 * Beihang University(北航) Communication University of China(中国通信大学) Zhejiang University(浙江大学)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 PartDiffuser提出一种半自回归扩散框架,通过部件级方法生成高保真3D网格,有效平衡全局结构与局部细节。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 1 篇

2606.24353 2026-07-31 cs.CV cs.LG 版本更新 57%

Open-Vocabulary BEV Segmentation with 3D-Aware Geometric Constraints

开放词汇BEV分割:基于3D感知几何约束的方法

Hojun Choi, Seulbin Hwang, Daejung Kim, Kisung Kim, Hyunjung Shim, Jinhan Lee

机构 * KAIST AI(韩国科学技术院人工智能) NAVER LABS(NAVER实验室)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 针对开放词汇BEV分割中2D VLM语义到BEV的3D几何不一致问题,提出OVBEVSeg框架,通过三阶段几何约束(伪标签、场景优化、知识蒸馏)实现高效在线推理,在nuScenes上未见类别mIoU超越闭集方法15.3,推理速度提升2.5倍。

Comments This paper has been accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 2 篇

2510.14584 2026-07-31 cs.RO 版本更新 57%

A Robust Placeability Metric for Model-Free Unified Pick-and-Place Reasoning

一种针对无模型统一抓取放置推理的鲁棒放置性度量

Benno Wingender, Nils Dengler, Rohit Menon, Sicong Pan, Maren Bennewitz

机构 * Anonymous Authors(匿名作者) Benno Wingender(伯恩诺·温格德尔) Nils Dengler(尼尔·登格尔) Rohit Menon(罗希特·梅农) Sicong Pan(斯冰·潘) Maren Bennewitz(马伦·本内维茨)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 本文提出一种鲁棒的概率放置性度量,通过联合评估稳定性、抓取性和空隙,实现无模型的统一抓取放置推理,并在仿真和真实机器人实验中验证其有效性。

Comments IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.06947 2026-07-31 eess.IV cs.CV 版本更新 57%

BCNet: Bronchus Classification via Structure Guided Representation Learning

BCNet:基于结构引导表征学习的支气管分类

Wenhao Huang, Haifan Gong, Huan Zhang, Yu Wang, Xiang Wan, Haofeng Li, Guanbin Li, Hong Shen

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 该研究针对自动支气管分类的个体拓扑差异挑战,提出结构引导的BCNet框架,在BronAtlas基准上F1分数超现有最优方法8%以上,还发布了支气管成像分析开放基准BronAtlas。

Comments The benchmark is available at https://osf.io/pskr9/?viewonly=94fa3d87274b4095ac9a4b88cc9a1341

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 3D生成 1 篇

2506.21076 2026-07-31 cs.CV 版本更新 57%

PoseMaster: A Unified 3D Native Framework for Stylized Pose Generation

PoseMaster: 一个统一的3D原生框架用于风格化姿态生成

Hongyu Yan, Kunming Luo, Weiyu Li, Kaiyi Zhang, Yixun Liang, Jingwei Huang, Chunchao Guo, Ping Tan

机构 * Hong Kong University of Science and Technology(香港科技大学) Tencent Hunyuan(腾讯文脉)

专题命中 3D生成 :3D generation(abstract);分类 cs.CV

AI总结 本文提出PoseMaster框架,通过统一姿态风格化与3D生成,提升3D姿态风格化的精度和多样性,采用3D骨架直接指导生成,增强模型在姿态风格化中的表现。

Comments Accepted by CVPR 2026, Code: https://github.com/hanryyan/PoseMaster

详情

展开后加载摘要…

URL PDF HTML 收藏