arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

共收录 1299 信号源:cs.CV, eess.IV, cs.MM

1. 视频扩散模型 1299 篇

2409.13908 2024-10-01 cs.AI cs.CE 50%

Nonlinear Inverse Design of Mechanical Multi-Material Metamaterials Enabled by Video Denoising Diffusion and Structure Identifier

Jaewan Park, Shashank Kushwaha, Junyan He, Seid Koric, Qibang Liu, Iwona Jasiuk, Diab Abueidda

专题命中 视频扩散模型 :video diffusion(abstract)

Comments 26 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14709 2024-09-24 eess.AS cs.SD 50%

Video-to-Audio Generation with Fine-grained Temporal Semantics

Yuchen Hu, Yu Gu, Chenxing Li, Rilin Chen, Dong Yu

专题命中 视频扩散模型 :video generation(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.01851 2024-06-05 cs.HC 50%

Turning Text and Imagery into Captivating Visual Video

Mingming Wang, Elijah Miller

专题命中 视频扩散模型 :video diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.04384 2024-02-13 cs.LG stat.ML 50%

Denoising Diffusion Probabilistic Models in Six Simple Steps

Richard E. Turner, Cristiana-Diana Diaconu, Stratis Markou, Aliaksandra Shysheya, Andrew Y. K. Foong, Bruno Mlodozeniec

专题命中 视频扩散模型 :video generation(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.19836 2024-02-02 cs.CE 50%

Inverse-design of nonlinear mechanical metamaterials via video denoising diffusion models

Jan-Hendrik Bastek, Dennis M. Kochmann

专题命中 视频扩散模型 :video diffusion(abstract)

Comments 21 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.08587 2023-09-22 cs.LG cs.AI cs.RO 50%

Compositional Foundation Models for Hierarchical Planning

Anurag Ajay, Seungwook Han, Yilun Du, Shuang Li, Abhi Gupta, Tommi Jaakkola, Josh Tenenbaum, Leslie Kaelbling, Akash Srivastava, Pulkit Agrawal

专题命中 视频扩散模型 :video diffusion(abstract)

Comments Website: https://hierarchical-planning-foundation-model.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.07896 2023-09-12 stat.ML cs.LG math.DS stat.CO 50%

SciRE-Solver: Accelerating Diffusion Models Sampling by Score-integrand Solver with Recursive Difference

Shigui Li, Wei Chen, Delu Zeng

专题命中 视频扩散模型 :video generation(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.02591 2023-08-29 cs.LG cs.AI cs.SI 50%

Generative Diffusion Models on Graphs: Methods and Applications

Chengyi Liu, Wenqi Fan, Yunqing Liu, Jiatong Li, Hang Li, Hui Liu, Jiliang Tang, Qing Li

专题命中 视频扩散模型 :video generation(abstract)

Comments This survey paper is accepted by IJCAI 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.10325 2023-05-23 cs.CL 50%

SeqDiffuSeq: Text Diffusion with Encoder-Decoder Transformers

Hongyi Yuan, Zheng Yuan, Chuanqi Tan, Fei Huang, Songfang Huang

专题命中 视频扩散模型 :video generation(abstract)

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏