arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

2026-04-03 至 2026-04-03 共收录 1 信号源:cs.CV, eess.IV, cs.MM

1. 视频数据与评测 1 篇

2604.02329 2026-04-03 cs.CV 57%

Generative World Renderer

生成世界渲染器

Zheng-Hui Huang, Zhixiang Wang, Jiaming Tan, Ruihan Yu, Yidan Zhang, Bo Zheng, Yu-Lun Liu, Yung-Yu Chuang, Kaipeng Zhang

机构 * Alaya Studio, Shanda AI Research Tokyo(Alaya工作室,盛大人工智能研究院东京) National Taiwan University(国立台湾大学) The University of Tokyo(东京大学) National Yang Ming Chiao Tung University(国立阳明交通大学)

专题命中 视频数据与评测 :video generation(abstract);分类 cs.CV

AI总结 本文提出一个大规模动态数据集,用于解决生成逆向和正向渲染在现实场景中的限制,通过双屏拼接方法提取400万帧数据,提升渲染真实性和时间一致性,并提出新的评估协议。

Comments Project page: https://alaya-studio.github.io/renderer/

详情

展开后加载摘要…

URL PDF HTML 收藏