arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Horizon Robotics(地平线机器人)

共收录 64
2604.04406 2026-04-07 cs.CV

3D-Fixer: Coarse-to-Fine In-place Completion for 3D Scenes from a Single Image

3D-Fixer:从单张图像生成3D场景的粗到细就地补全

Ze-Xin Yin, Liu Liu, Xinjie Wang, Wei Sui, Zhizhong Su, Jian Yang, Jin Xie

机构 * College of Computer Science, Nankai University(南开大学计算机科学学院) School of Intelligence Science and Technology, Nanjing University(南京大学智能科学与技术学院) Horizon Robotics(地平线机器人) D-Robotics

AI总结 本文提出3D-Fixer,通过粗到细的生成方案解决单张图像生成3D场景的布局和3D资产恢复问题,结合双分支条件网络和Occlusion-Robust Feature Alignment策略,提升生成精度和效率,同时引入ARSG-110K数据集提升训练效果。

Comments 17 pages, 10 figures, CVPR 2026, project page: https://zx-yin.github.io/3dfixer

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07435 2026-04-07 cs.CV

DreamLifting: A Plug-in Module Lifting MV Diffusion Models for 3D Asset Generation

DreamLifting:一种插件模块用于提升MV扩散模型以生成3D资产

Ze-Xin Yin, Jiaxiong Qiu, Liu Liu, Xinjie Wang, Wei Sui, Zhizhong Su, Jian Yang, Jin Xie

机构 * PCA Lab, VCIP, College of Computer Science, Nankai University(南开大学计算机学院VCIP实验室PCA Lab) School of Intelligence Science and Technology, Nanjing University(南京大学智能科学与技术学院) Horizon Robotics(地平线机器人) D-Robotics

AI总结 本文提出LGAA框架,通过多视角扩散先验统一几何与PBR材质建模,结合模块化设计和改进的VAE实现高效3D资产生成,实验表明其在文本和图像条件下均表现优异。

Comments 16 pages, 9 figures, TVCG 2026, project page: https://zx-yin.github.io/dreamlifting/

Journal ref IEEE Transactions on Visualization and Computer Graphics 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08829 2026-04-01 cs.CV cs.AI

InfiniteVL: Synergizing Linear and Sparse Attention for Highly-Efficient, Unlimited-Input Vision-Language Models

InfiniteVL: 融合线性与稀疏注意力以实现高效率、无限输入的视觉-语言模型

Hongyuan Tao, Bencheng Liao, Shaoyu Chen, Haoran Yin, Qian Zhang, Wenyu Liu, Xinggang Wang

机构 * Huazhong University of Science and Technology(华中科技大学) Horizon Robotics(地平线机器人)

AI总结 InfiniteVL通过融合线性与稀疏注意力机制,实现高效率和无限输入的视觉-语言模型,提升解码速度和长上下文处理能力。

Comments 20 pages, 8 figures, conference or other essential info

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18532 2026-03-31 cs.RO cs.AI cs.LG

Scaling Sim-to-Real Reinforcement Learning for Robot VLAs with Generative 3D Worlds

在生成3D世界中扩展机器人视觉语言动作的强化学习

Andrew Choi, Xinjie Wang, Zhizhong Su, Wei Xu

机构 * Horizon Robotics(地平线机器人)

AI总结 本文提出利用生成3D世界模型来提升机器人视觉语言动作模型的泛化能力,通过生成多样化的交互场景,提高模拟到现实的迁移效果,并展示在真实世界中的性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20565 2026-03-25 cs.CV

DINO-Tok: Adapting DINO for Visual Tokenizers

DINO-Tok:为视觉分词器适应DINO

Mingkai Jia, Mingxiao Li, Zhijian Shu, Anlin Zheng, Liaoyuan Fan, Jiaxin Guo, Tianxing Shi, Dongyue Lu, Zeming Li, Xiaoyang Guo, Xiaojuan Qi, Xiao-Xiao Long, Qian Zhang, Ping Tan, Wei Yin

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) Horizon Robotics(Horizon机器人) Nanjing University(南京大学) Hong Kong University(香港大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 本文提出DINO-Tok,一种基于冻结DINO编码器的视觉分词器,结合连续自编码和离散向量量化方法,提升高维潜在空间中的语义一致性和生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03643 2026-03-25 cs.CV

Uni3R: Unified 3D Reconstruction and Semantic Understanding via Generalizable Gaussian Splatting from Unposed Multi-View Images

Uni3R:通过通用高斯喷射从无序多视角图像实现统一的3D重建与语义理解

Xiangyu Sun, Haoyi Jiang, Liu Liu, Seungtae Nam, Gyeongjin Kang, Xinjie Wang, Wei Sui, Zhizhong Su, Wenyu Liu, Xinggang Wang, Eunbyung Park

机构 * Sungkyunkwan University(顺天乡大学) Huazhong University of Science & Technology(华中科技大学) Yonsei University(延世大学) Horizon Robotics(Horizon机器人) D-Robotics

AI总结 本文提出Uni3R框架,通过统一的3D场景表示实现高保真视角合成和开放词汇语义分割,展示了其在多个基准上的优越性能。

Comments The code is available at https://github.com/HorizonRobotics/Uni3R

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03887 2026-03-19 cs.CV

OccTENS: 3D Occupancy World Model via Temporal Next-Scale Prediction

OccTENS: 通过时间下一尺度预测实现的3D占用世界模型

Bu Jin, Songen Gu, Xiaotao Hu, Yupeng Zheng, Xiaoyang Guo, Qian Zhang, Xiaoxiao Long, Wei Yin

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) University of Chinese Academy of Sciences(中国科学院大学) Horizon Robotics(地平线机器人) Nanjing University(南京大学)

AI总结 本文提出OccTENS,一种能高效生成高质量长期占用场景的生成模型,通过时间下一尺度预测任务解决效率、时间退化和可控性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13172 2026-03-16 cs.CV

LongStream: Long-Sequence Streaming Autoregressive Visual Geometry

LongStream: 长序列流式自回归视觉几何

Chong Cheng, Xianda Chen, Tao Xie, Wei Yin, Weiqiang Ren, Qian Zhang, Xiaoyang Guo, Hao Wang

机构 * HKUST (GZ)(香港科技大学(广州)) Horizon Robotics ZJU(浙江大学) CSU(中国科学技术大学)

AI总结 LongStream通过抛弃首帧锚点、引入正交尺度学习和缓存一致性训练,解决长序列流式3D重建中的姿态漂移和注意力偏差问题,实现千帧级稳定重建。

Comments CVPR2026 accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12864 2026-03-16 cs.CV

Composing Driving Worlds through Disentangled Control for Adversarial Scenario Generation

通过解耦控制合成驾驶世界以生成对抗性场景

Yifan Zhan, Zhengqing Chen, Qingjie Wang, Zhuo He, Muyao Niu, Xiaoyang Guo, Wei Yin, Weiqiang Ren, Qian Zhang, Yinqiang Zheng

机构 * The University of Tokyo(东京大学) Horizon Robotics University of Glasgow(格拉斯哥大学)

AI总结 本文提出CompoSIA,通过解耦交通因素实现对对抗性驾驶场景的精细控制,提升生成质量并减少误差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11219 2026-03-13 cs.CV

Senna-2: Aligning VLM and End-to-End Driving Policy for Consistent Decision Making and Planning

Senna-2:对齐视觉语言模型与端到端驾驶策略以实现一致的决策与规划

Yuehao Song, Shaoyu Chen, Hao Gao, Yifan Zhu, Weixiang Yue, Jialv Zou, Bo Jiang, Zihao Lu, Yu Wang, Qian Zhang, Xinggang Wang

机构 * Huazhong University of Science & Technology(华中科技大学) Horizon Robotics

AI总结 Senna-2通过三阶段训练范式对齐视觉语言模型与端到端驾驶策略,提升决策与规划的一致性,增强驾驶安全性和效率。

Comments 15 pages, 8 figures. Project page: https://ambitious-idiot.github.io/senna2-project

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26796 2026-03-13 cs.CV cs.GR

See4D: Pose-Free 4D Generation via Auto-Regressive Video Inpainting

See4D: 通过自回归视频修复实现无姿态4D生成

Dongyue Lu, Ao Liang, Tianxin Huang, Xiao Fu, Yuyang Zhao, Baorui Ma, Liang Pan, Wei Yin, Lingdong Kong, Wei Tsang Ooi, Ziwei Liu

机构 * NUS(新加坡国立大学) HKU(香港大学) CUHK(香港中文大学) THU(清华大学) Shanghai AI Lab(上海人工智能实验室) Horizon Robotics(地平线机器人) NTU(国立科技大学)

AI总结 See4D通过自回归视频修复实现无姿态4D生成,提升从随意视频到4D世界建模的实用性。

Comments Eurographics2026; 26 pages; 21 figures; 3 tables; project page: https://see-4d.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01007 2026-03-06 cs.CV

Dr.Occ: Depth- and Region-Guided 3D Occupancy from Surround-View Cameras for Autonomous Driving

Dr.Occ: 从环绕视图摄像头获取3D占用的深度和区域引导方法用于自动驾驶

Xubo Zhu, Haoyang Zhang, Fei He, Rui Wu, Yanhu Shan, Wen Yang, Huai Yu

机构 * School of Electronic Information, Wuhan University(武汉大学电子信息学院) Horizon Robotics Wuhan University Shenzhen Research Institute(武汉大学深圳研究院)

AI总结 Dr.Occ通过深度和区域引导方法提升自动驾驶中3D占用预测的几何对齐和语义学习效果。

Comments 10 pages, 6 figures. Accepted at CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12062 2026-02-13 cs.RO

HoloBrain-0 Technical Report

HoloBrain-0 技术报告

Xuewu Lin, Tianwei Lin, Yun Du, Hongyu Xie, Yiwei Jin, Jiawei Li, Shijie Wu, Qingze Wang, Mengdi Li, Mengao Zhao, Ziang Li, Chaodong Huang, Hongzhe Bi, Lichao Huang, Zhizhong Su

机构 * Horizon Robotics

AI总结 HoloBrain-0 提出了一种融合视觉、语言和动作的框架,通过预训练和后训练范式,在模拟和现实任务中取得领先性能,并开源完整生态系统促进机器人研究。

Comments 32 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19488 2026-02-02 cs.CV

Entropy-Guided k-Guard Sampling for Long-Horizon Autoregressive Video Generation

熵引导的k-guard采样用于长 Horizon 自回归视频生成

Yizhao Han, Tianxing Shi, Zhao Wang, Zifan Xu, Zhiyuan Pu, Mingxiao Li, Qian Zhang, Wei Yin, Xiao-Xiao Long

机构 * Nanjing University(南京大学) Horizon Robotics China Mobile(中国移动)

AI总结 熵引导的k-guard采样用于长Horizon自回归视频生成,通过自适应调整令牌候选集大小以提升视频生成的质量和稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23171 2026-01-07 cs.CV

RoboTransfer: Controllable Geometry-Consistent Video Diffusion for Manipulation Policy Transfer

RoboTransfer: 可控的几何一致视频扩散用于操控策略迁移

Liu Liu, Xiaofeng Wang, Guosheng Zhao, Keyu Li, Wenkang Qin, Jiagang Zhu, Jiaxiong Qiu, Zheng Zhu, Guan Huang, Zhizhong Su

机构 * Horizon Robotics GigaAI CASIA

AI总结 RoboTransfer通过可控的几何一致视频扩散技术,提升机器人操控策略在真实环境中的泛化能力。

Comments 20 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.01850 2026-01-06 cs.LG cs.RO

ManiBox: Enhancing Embodied Spatial Generalization via Scalable Simulation Data Generations

ManiBox: 通过可扩展的模拟数据生成增强具身空间泛化

Hengkai Tan, Xuezhou Xu, Chengyang Ying, Xinyi Mao, Zeyuan Wang, Songming Liu, Xingxing Zhang, Zhizhong Su, Hang Su, Jun Zhu

机构 * Tsinghua University(清华大学) National University of Singapore(新加坡国立大学) Horizon Robotics

AI总结 ManiBox通过可扩展的模拟数据生成提升具身智能体的空间泛化能力,有效减少仿真到现实的差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13030 2025-12-29 cs.CV cs.LG cs.RO

Motus: A Unified Latent Action World Model

Motus:一个统一的潜在动作世界模型

Hongzhe Bi, Hengkai Tan, Shenghao Xie, Zeyuan Wang, Shuhe Huang, Haitian Liu, Ruowen Zhao, Yao Feng, Chendong Xiang, Yinze Rong, Hongyan Zhao, Hanyu Liu, Zhizhong Su, Lei Ma, Hang Su, Jun Zhu

机构 * Dept. of Comp. Sci. and Tech., Institute for AI, BNRist Center, THBI Lab, Tsinghua-Bosch Joint ML Center, Tsinghua University(计算机科学与技术系,人工智能研究院,BNRist中心,THBI实验室,清华-博世联合机器学习中心,清华大学) Peking University(北京大学) Horizon Robotics

AI总结 Motus通过统一的潜在动作世界模型整合理解、视频生成和动作模块,利用光流和三阶段训练流程提升大规模动作预训练效果,实现模拟与现实场景中的性能突破。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18386 2025-12-23 cs.CV

RecurGS: Interactive Scene Modeling via Discrete-State Recurrent Gaussian Fusion

RecurGS: 通过离散状态递归高斯融合实现交互式场景建模

Wenhao Hu, Haonan Zhou, Zesheng Li, Liu Liu, Jiacheng Dong, Zhizhong Su, Gaoang Wang

机构 * Zhejiang University(浙江大学) Horizon Robotics Nanyang Technological University(南洋理工大学)

AI总结 RecurGS通过递归融合框架实现离散状态的交互式场景建模,提升3D环境的更新效率和逼真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07745 2025-12-09 cs.CV

DiffusionDriveV2: Reinforcement Learning-Constrained Truncated Diffusion Modeling in End-to-End Autonomous Driving

DiffusionDriveV2: 结束到结束自动驾驶中的强化学习约束截断扩散建模

Jialv Zou, Shaoyu Chen, Bencheng Liao, Zhiyu Zheng, Yuehao Song, Lefei Zhang, Qian Zhang, Wenyu Liu, Xinggang Wang

机构 * School of Electronic Information and Communications, Huazhong University of Science & Technology(华中科技大学电子信息与通信学院) Institute of Artificial Intelligence, Huazhong University of Science & Technology(华中科技大学人工智能研究院) Horizon Robotics(地平线科技) School of Computer Science, Wuhan University(武汉大学计算机学院)

AI总结 DiffusionDriveV2通过强化学习约束和探索,解决了自动驾驶中截断扩散模型在多样性和高质量之间的平衡问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04939 2025-12-05 cs.CV

LiteVGGT: Boosting Vanilla VGGT via Geometry-aware Cached Token Merging

LiteVGGT: 通过几何感知的缓存标记合并提升基础VGGT

Zhijian Shu, Cheng Lin, Tao Xie, Wei Yin, Ben Li, Zhiyuan Pu, Weize Li, Yao Yao, Xun Cao, Xiaoyang Guo, Xiao-Xiao Long

机构 * Nanjing University of Posts and Telecommunications(南京邮电大学) Horizon Robotics Nanjing University(南京大学) Zhejiang University(浙江大学) Macau University of Science and Technology(澳门科技大学) TARS Robotics China Mobile Zijin Innovation Institute(中国移动吉林创新研究院)

AI总结 LiteVGGT通过几何感知的缓存标记合并提升基础VGGT的效率,实现10倍加速和内存减少,适用于大规模3D重建场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02549 2025-12-01 cs.CV cs.RO

MonoDream: Monocular Vision-Language Navigation with Panoramic Dreaming

MonoDream:基于全景梦境的单目视觉-语言导航

Shuo Wang, Yongcai Wang, Zhaoxin Fan, Yucheng Wang, Maiyue Chen, Kaihui Wang, Zhizhong Su, Wanting Li, Xudong Cai, Yeying Jin, Deying Li

机构 * Horizon Robotics

AI总结 MonoDream通过轻量级VLA框架和潜在全景梦境任务,提升单目视觉-语言导航的性能,缩小与全景方法的差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12981 2025-11-27 cs.CV

UniUIR: Considering Underwater Image Restoration as An All-in-One Learner

UniUIR:将水下图像恢复视为一个全合一学习者

Xu Zhang, Huan Zhang, Guoli Wang, Qian Zhang, Lefei Zhang, Bo Du

机构 * National Engineering Research Center for Multimedia Software, School of Computer Science, Wuhan University(国家多媒体软件工程研究中心,计算机学院,武汉大学) School of Information Engineering, Guangdong University of Technology(信息工程学院,广东工业大学) Horizon Robotics

AI总结 UniUIR通过全合一学习框架,综合处理水下图像中的多种退化问题,提升恢复精度和泛化能力。

Comments Accepted by IEEE Transactions on Image Processing. Project page at https://house-yuyu.github.io/UniUIR/

Journal ref IEEE Transactions on Image Processing, vol. 34, pp. 6963-6977, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13733 2025-11-26 cs.RO

FSR-VLN: Fast and Slow Reasoning for Vision-Language Navigation with Hierarchical Multi-modal Scene Graph

基于分层多模态场景图的视觉语言导航:快速与慢速推理

Xiaolin Zhou, Tingyang Xiao, Liu Liu, Yucheng Wang, Maiyue Chen, Xinrui Meng, Xinjie Wang, Wei Feng, Wei Sui, Zhizhong Su

机构 * Horizon Robotics D-Robotics Robotics

AI总结 FSR-VLN通过分层多模态场景图与快速-慢速推理机制,提升视觉语言导航的效率与准确性,实现低延迟高成功率的导航性能。

Comments Demo video are available at https://horizonrobotics.github.io/robot_lab/fsr-vln/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08562 2025-11-25 cs.CV cs.RO

ResAD: Normalized Residual Trajectory Modeling for End-to-End Autonomous Driving

ResAD:用于端到端自动驾驶的归一化残差轨迹建模

Zhiyu Zheng, Shaoyu Chen, Haoran Yin, Xinbang Zhang, Jialv Zou, Xinggang Wang, Qian Zhang, Lefei Zhang

机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) Horizon Robotics School of EIC, Huazhong University of Science & Technology(华中科技大学电子信息学院)

AI总结 ResAD通过归一化残差轨迹建模简化端到端自动驾驶学习任务,提升规划性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01767 2025-11-20 cs.CV cs.AI

Wonder3D++: Cross-domain Diffusion for High-fidelity 3D Generation from a Single Image

Yuxiao Yang, Xiao-Xiao Long, Zhiyang Dou, Cheng Lin, Yuan Liu, Qingsong Yan, Yuexin Ma, Haoqian Wang, Zhiqiang Wu, Wei Yin

机构 * Tsinghua University(清华大学) Nanjing University(南京大学) Wright State University(威斯汀大学) Horizon Robotics University of Hong Kong(香港大学) Macau University of Science and Technology(澳门科技大学) Hong Kong University of Science and Technology(香港科学大学) Wuhan University(武汉大学) ShanghaiTech University(上海科技大学)

Comments 21 pages, 19 figures, accepted by TPAMI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14224 2025-11-11 eess.AS cs.SD

Adaptive Convolution for CNN-based Speech Enhancement Models

Dahan Wang, Xiaobin Rong, Shiruo Sun, Yuxiang Hu, Changbao Zhu, Jing Lu

机构 * Key Laboratory of Modern Acoustics, Institute of Acoustics, Nanjing University(现代声学关键实验室,声学研究所,南京大学) NJU-Horizon Intelligent Audio Lab, Horizon Robotics(南京大学-Horizon智能音频实验室,Horizon机器人)

Comments Published in IEEE/ACM Transactions on Audio, Speech, and Language Processing

Journal ref IEEE Transactions on Audio, Speech and Language Processing, vol. 33, pp. 4400-4413, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23351 2025-07-04 cs.RO cs.AI cs.LG cs.MA

Benchmarking Generalizable Bimanual Manipulation: RoboTwin Dual-Arm Collaboration Challenge at CVPR 2025 MEIS Workshop

Tianxing Chen, Kaixuan Wang, Zhaohui Yang, Yuhao Zhang, Zanxin Chen, Baijun Chen, Wanxi Dong, Ziyuan Liu, Dong Chen, Tianshuo Yang, Haibao Yu, Xiaokang Yang, Yusen Qin, Zhiqiang Xie, Yao Mu, Ping Luo, Tian Nian, Weiliang Deng, Yiheng Ge, Yibin Liu, Zixuan Li, Dehui Wang, Zhixuan Liang, Haohui Xie, Rijie Zeng, Yunfei Ge, Peiqing Cong, Guannan He, Zhaoming Han, Ruocheng Yin, Jingxiang Guo, Lunkai Lin, Tianling Xu, Hongzhe Bi, Xuewu Lin, Tianwei Lin, Shujie Luo, Keyu Li, Ziyan Zhao, Ke Fan, Heyang Xu, Bo Peng, Wenlong Gao, Dongjiang Li, Feng Jin, Hui Shen, Jinming Li, Chaowei Cui, Yu Chen, Yaxin Peng, Lingdong Zeng, Wenlong Dong, Tengfei Li, Weijie Ke, Jun Chen, Erdemt Bao, Tian Lan, Tenglong Liu, Jin Yang, Huiping Zhuang, Baozhi Jia, Shuai Zhang, Zhengfeng Zou, Fangheng Guan, Tianyi Jia, Ke Zhou, Hongjiu Zhang, Yating Han, Cheng Fang, Yixian Zou, Chongyang Xu, Qinglun Zhang, Shen Cheng, Xiaohe Wang, Ping Tan, Haoqiang Fan, Shuaicheng Liu, Jiaheng Chen, Chuxuan Huang, Chengliang Lin, Kaijun Luo, Boyu Yue, Yi Liu, Jinyu Chen, Zichang Tan, Liming Deng, Shuo Xu, Zijian Cai, Shilong Yin, Hao Wang, Hongshan Liu, Tianyang Li, Long Shi, Ran Xu, Huilin Xu, Zhengquan Zhang, Congsheng Xu, Jinchang Yang, Feng Xu

机构 * HKU MMLab(香港大学多模态实验室) SJTU(上海交通大学) D-Robotics(D机器人) AgileX Robotics(AgileX机器人) Huawei Germany(华为德国分公司) SZU(深圳大学) THU(清华大学) NJU(南京大学) VIVO Jingdong Technology Information Technology Co., Ltd.(京东科技信息技术有限公司) Horizon Robotics SUST(上海大学) USST(上海理工大学) SYSU(南方科技大学) UESTC(电子科技大学) SCU(四川大学) Dexmal SWJTU(西南交通大学) HKUST(香港理工大学) BJTU(北京交通大学) BUAA(北京航空航天大学) NEU(东北大学) SHU(上海大学) Sangfor Technologies Inc.(深信服技术有限公司) CAUC(中国科学院大学) HUST(华中科技大学) Reconova Technologies Co.(Reconova技术有限公司)

Comments Challenge Webpage: https://robotwin-benchmark.github.io/cvpr-2025-challenge/

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.24113 2025-07-01 cs.CV

Epona: Autoregressive Diffusion World Model for Autonomous Driving

Kaiwen Zhang, Zhenyu Tang, Xiaotao Hu, Xingang Pan, Xiaoyang Guo, Yuan Liu, Jingwei Huang, Li Yuan, Qian Zhang, Xiao-Xiao Long, Xun Cao, Wei Yin

机构 * Horizon Robotics Tsinghua University(清华大学) Peking University(北京大学) Nanjing University(南京大学) The Hong Kong University of Science and Technology(香港科学与技术大学) Nanyang Technological University(南洋理工大学) Tencent Hunyuan(腾讯文心)

Comments ICCV2025, Project Page: https://kevin-thu.github.io/Epona/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18066 2025-07-01 cs.CV

GLS: Geometry-aware 3D Language Gaussian Splatting

Jiaxiong Qiu, Liu Liu, Xinjie Wang, Tianwei Lin, Wei Sui, Zhizhong Su

机构 * Horizon Robotics D-Robotics

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10600 2025-06-17 cs.RO cs.CV

EmbodiedGen: Towards a Generative 3D World Engine for Embodied Intelligence

Xinjie Wang, Liu Liu, Yu Cao, Ruiqi Wu, Wenkang Qin, Dehui Wang, Wei Sui, Zhizhong Su

机构 * Horizon Robotics GigaAI D-Robotics Shanghai Jiao Tong University(上海交通大学) VCIP, CS, Nankai University(VCIP, CS, 南开大学)

详情

展开后加载摘要…

URL PDF HTML 收藏