arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

2026-07-16 至 2026-07-16 共收录 1 信号源:cs.CV, eess.IV, cs.MM

1. 其他视频模型 1 篇

2605.16366 2026-07-16 cs.CV cs.AI 版本更新 57%

Fre-Res: Frequency-Residual Video Token Compression for Efficient Video MLLMs

Fre-Res: 频率-残差视频令牌压缩用于高效的视频多模态大语言模型

Yigui Feng, Qinglin Wang, Yang Liu, Jie Liu

机构 * College of Computer Science, National University of Defense Technology(计算机科学学院,国防科技大学) Shien-Ming Wu School of Intelligent Engineering, South China University of Technology(智能工程谢民明伍学院,华南理工大学)

专题命中 其他视频模型 :video reasoning(abstract);分类 cs.CV

AI总结 Fre-Res通过分离空间和时间信息,实现视频令牌压缩,在保持细节精度的同时提升效率,适用于短时事件和长视频推理。

Comments 24 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏