arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

2026-03-23 至 2026-03-23 共收录 2 信号源:cs.CV, eess.IV, cs.MM

1. 视频生成 2 篇

2603.20192 2026-03-23 cs.CV cs.AI 83%

LumosX: Relate Any Identities with Their Attributes for Personalized Video Generation

LumosX:通过身份与属性的关系实现个性化视频生成

Jiazheng Xing, Fei Du, Hangjie Yuan, Pengwei Liu, Hongbin Xu, Hai Ci, Ruigang Niu, Weihua Chen, Fan Wang, Yong Liu

机构 * Zhejiang University(浙江大学) DAMO Academy, Alibaba Group(阿里云达摩院) Hupan Lab(虎斑实验室) National University of Singapore(新加坡国立大学)

专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract);分类 cs.CV

AI总结 LumosX通过结合身份与属性关系,提升多主体个性化视频生成的精细度和一致性,采用数据与模型双改进策略,构建了全面的基准测试平台。

Comments ICLR 2026 Camera Ready Version. Code and Models: https://jiazheng-xing.github.io/lumosx-home/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07901 2026-03-23 cs.CV 79%

Stand-In: A Lightweight and Plug-and-Play Identity Control for Video Generation

Stand-In: 一种轻量级且即插即用的身份控制方法用于视频生成

Bowen Xue, Zheng-Peng Duan, Qixin Yan, Wenjing Wang, Hao Liu, Chun-Le Guo, Chongyi Li, Chen Li, Jing Lyu

机构 * WeChat Vision, Tencent Inc.(腾讯微信视觉实验室) VCIP, CS, Nankai University(南开大学计算机科学与技术学院)

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

AI总结 本文提出Stand-In框架,通过引入条件图像分支和受限自注意力机制,实现轻量级身份控制,仅用1%额外参数和2000训练对即可提升视频质量和身份保持性,并支持多种视频生成任务。

详情

展开后加载摘要…

URL PDF HTML 收藏