arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

2026-03-13 至 2026-03-13 共收录 4 信号源:cs.CV, eess.IV, cs.MM

1. 视频生成 4 篇

2603.12146 2026-03-13 cs.CV cs.AI cs.LG cs.MM 81%

FlashMotion: Few-Step Controllable Video Generation with Trajectory Guidance

FlashMotion: 通过轨迹引导的少步可控视频生成

Quanhao Li, Zhen Xing, Rui Wang, Haidong Cao, Qi Dai, Daoguo Dong, Zuxuan Wu

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV、cs.MM

AI总结 FlashMotion通过轨迹引导和蒸馏方法实现了少步可控视频生成,提升了视频质量和轨迹准确性。

Comments Accepted by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01685 2026-03-13 cs.CV 79%

FastLightGen: Fast and Light Video Generation with Fewer Steps and Parameters

FastLightGen: 用更少的步骤和参数实现快速轻量视频生成

Shitong Shao, Yufei Gu, Zeke Xie

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

AI总结 FastLightGen通过同时压缩模型大小和推理步骤,实现快速轻量视频生成,实验表明其在受限预算下达到最优视觉质量并超越现有方法。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12267 2026-03-13 cs.CV 57%

EVATok: Adaptive Length Video Tokenization for Efficient Visual Autoregressive Generation

EVATok: 适应性长度视频分块化以实现高效的视觉自回归生成

Tianwei Xiong, Jun Hao Liew, Zilong Huang, Zhijie Lin, Jiashi Feng, Xihui Liu

专题命中 视频生成 :video generation(abstract);分类 cs.CV

AI总结 EVATok通过自适应分块器提升视频重建和自回归生成的效率与质量,实现令牌使用量减少24.4%。

Comments Accepted by CVPR 2026. Project page: https://silentview.github.io/EVATok/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26796 2026-03-13 cs.CV cs.GR 57%

See4D: Pose-Free 4D Generation via Auto-Regressive Video Inpainting

See4D: 通过自回归视频修复实现无姿态4D生成

Dongyue Lu, Ao Liang, Tianxin Huang, Xiao Fu, Yuyang Zhao, Baorui Ma, Liang Pan, Wei Yin, Lingdong Kong, Wei Tsang Ooi, Ziwei Liu

机构 * NUS(新加坡国立大学) HKU(香港大学) CUHK(香港中文大学) THU(清华大学) Shanghai AI Lab(上海人工智能实验室) Horizon Robotics(地平线机器人) NTU(国立科技大学)

专题命中 视频生成 :video generation(abstract);分类 cs.CV

AI总结 See4D通过自回归视频修复实现无姿态4D生成,提升从随意视频到4D世界建模的实用性。

Comments Eurographics2026; 26 pages; 21 figures; 3 tables; project page: https://see-4d.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏