Inference-Time Concept Suppression and Video-Centric Evaluation for Text-to-Video Models
文本到视频模型的推理时概念抑制和以视频为中心的评估
机构 * University of Science and Technology of China(中国科学技术大学)
专题命中 图像生成评测 :text-to-image(abstract);分类 cs.CV
AI总结 研究文本到视频模型中可控去除目标概念的问题,提出无训练推理时框架SIRUS,通过定位目标相关提示证据抑制目标表达,引入视频导向评估框架,在多个概念上实验表现出色,能在不同骨干上泛化。
Comments 29 pages, 9 figures, 11 tables