arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

视频大模型

视频理解、视频生成、视频语言模型和时序视觉推理。

2026-03-11 至 2026-03-11 共收录 2 信号源:cs.CV, eess.IV, cs.MM

1. 视频理解 2 篇

2603.07071 2026-03-11 cs.CV 88%

VirtueBench: Evaluating Trustworthiness under Uncertainty in Long Video Understanding

VirtueBench: 在长视频理解中评估在不确定性下的可信度

Xueqing Yu, Bohan Li, Yan Li, Zhenheng Yang

专题命中 视频理解 :video understanding(title,abstract);long video(title,abstract);分类 cs.CV

AI总结 VirtueBench通过评估模型在不确定性下的可信度,揭示了长视频理解中模型拒绝行为的差异及可靠性问题。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09496 2026-03-11 cs.CV 79%

SurgFed: Language-guided Multi-Task Federated Learning for Surgical Video Understanding

SurgFed: 基于语言引导的多任务联邦学习用于手术视频理解

Zheng Fang, Ziwei Niu, Ziyue Wang, Zhu Zhuo, Haofeng Liu, Shuyang Qian, Jun Xia, Yueming Jin

机构 * National University of Singapore(国立新加坡大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Zhejiang University(浙江大学) Nanyang Technological University(南洋理工大学)

专题命中 视频理解 :video understanding(title,abstract);分类 cs.CV

AI总结 SurgFed通过语言引导的通道选择和超聚合方法,提升手术视频多任务联邦学习的跨站点和跨任务适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏