Reinforce to Learn, Elect to Reason: A Dual Paradigm for Video Reasoning
强化以学习,选择以推理:视频推理的双范式
机构 * National University of Defense Technology(国防科技大学) ; Sun Yat-sen University(中山大学)
专题命中 其他视频模型 :video reasoning(title,abstract);分类 cs.CV
AI总结 本文提出RLER双范式,通过强化学习生成证据并验证推理一致性,提升视频推理的可靠性和可解释性,实验表明其在多个基准上均取得最佳性能。
Comments Accepted at CVPR 2026. Camera-ready version