arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

2026-04-24 至 2026-04-24 共收录 2 信号源:cs.CV, eess.IV, cs.MM

1. 长视频与时序推理 2 篇

2604.20311 2026-04-24 cs.MM cs.AI 57%

Seeing Further and Wider: Joint Spatio-Temporal Enlargement for Micro-Video Popularity Prediction

看得更远且更广:面向微视频流行度预测的联合时空放大

Dali Wang, Yunyao Zhang, Junqing Yu, Yi-Ping Phoebe Chen, Chen Xu, Zikai Song

机构 * Huazhong University of Science and Technology(华中科技大学) La Trobe University(拉特罗布大学) Beijing Institute of Computer Technology and Applications(北京计算机技术与应用研究所)

专题命中 长视频与时序推理 :long video(abstract);分类 cs.MM

AI总结 本文提出联合时空放大框架,通过时空增强模块提升微视频流行度预测的精度与可扩展性,实验表明其在主流指标上优于11个基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21154 2026-04-24 cs.AI 50%

Agentic AI for Personalized Physiotherapy: A Multi-Agent Framework for Generative Video Training and Real-Time Pose Correction

代理AI用于个性化物理治疗:一种多代理框架用于生成视频训练和实时姿态校正

Abhishek Dharmaratnakar, Srivaths Ranganathan, Anushree Sinha, Debanshu Das

专题命中 长视频与时序推理 :video generation(abstract)

AI总结 本文提出多代理系统框架,结合生成AI和计算机视觉,解决家庭物理治疗依从性低的问题,通过生成个性化视频和实时姿态校正提升康复效果。

Comments 3 pages, 2 figures, submitted to ICDH IEEE conference

详情

展开后加载摘要…

URL PDF HTML 收藏