LaViDa-R1: Advancing Reasoning for Unified Multimodal Diffusion Language Models
LaViDa-R1:推进统一多模态扩散语言模型的推理
机构 * Adobe ; UCLA(加州大学洛杉矶分校) ; Georgia Tech(佐治亚理工学院)
AI总结 研究提出多模态通用推理dLLM LaViDa-R1,不同于现有工作,它以统一方式整合多任务,采用新颖统一训练后框架,集成监督微调与多任务强化学习,并运用多种训练技术,在多模态任务上展现强大性能。
Comments 28 pages, 11 figures