arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

2026-04-06 至 2026-04-06 共收录 3 信号源:cs.CV, eess.IV, cs.MM

1. 视频生成 3 篇

2504.17180 2026-04-06 cs.CV cs.AI 88%

We'll Fix it in Post: Improving Text-to-Video Generation with Neuro-Symbolic Feedback

事后修复:通过神经符号反馈改进文本到视频生成

Minkyu Choi, S P Sharan, Harsh Goel, Sahil Shah, Sandeep Chinchali

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 视频生成 :video generation(title,abstract);text-to-video(title,abstract);分类 cs.CV

AI总结 本文提出NeuS-E框架,通过神经符号反馈提升文本到视频生成的语义和时间一致性,实验显示其在多种提示下提升了40%的对齐度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16933 2026-04-06 cs.CV cs.LG 79%

Reward-Forcing: Autoregressive Video Generation with Reward Feedback

基于奖励的强制:利用奖励反馈的自回归视频生成

Jingran Zhang, Ning Li, Yuanhao Ban, Andrew Bai, Justin Cui

机构 * University of California, San Diego(加利福尼亚大学圣迭戈分校) University of California, Los Angeles(加利福尼亚大学洛杉矶分校)

专题命中 视频生成 :video generation(title,abstract);分类 cs.CV

AI总结 本文提出一种利用奖励信号指导生成的自回归视频生成方法,提升了生成效率和可扩展性,实验表明其性能与现有自回归模型相当,甚至在某些情况下超越了双向模型。

Comments https://openreview.net/forum?id=K8Qjsxxl7y&noteId=K8Qjsxxl7y

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02867 2026-04-06 cs.CV 57%

HairOrbit: Multi-view Aware 3D Hair Modeling from Single Portraits

HairOrbit: 从单人像中基于多视角的3D毛发建模

Leyang Jin, Yujian Zheng, Bingkui Tong, Yuda Qiu, Zhenyu Xie, Hao Li

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) SSE, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)理工学院) Pinscreen

专题命中 视频生成 :video generation(abstract);分类 cs.CV

AI总结 本文提出HairOrbit框架,利用视频生成模型的3D先验知识,将单视角毛发重建转化为校准的多视角重建任务,并设计两阶段毛发生长算法,实现高质量的3D毛发合成。

Comments 17 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏