TraMP-LLaMA: Generative Interpretability with Decoupled Instruction Tuning for Facial Expression Quality Assessment
TraMP-LLaMA: 基于解耦指令微调的生成式可解释性用于面部表情质量评估
机构 * School of Computer Science University of Bristol(布里斯托大学计算机科学学院) ; Translational Health Sciences University of Bristol(布里斯托大学转化健康科学学院) ; School of Computing and Communications Lancaster University(兰卡斯特大学计算与通信学院)
专题命中 动作与事件理解 :video-language(abstract);分类 cs.CV
AI总结 提出TraMP-LLaMA多模态框架,融合外观和轨迹特征,采用解耦指令微调策略,联合预测严重度并生成结构化文本报告,在PFED5-plus数据集上优于基线方法。