UniTemp: Unlocking Video Generation in Any Temporal Order via Bidirectional Distillation
UniTemp: 通过双向蒸馏实现任意时间顺序的视频生成
Lin Zhang, Sicheng Mo, Zefan Cai, Jinhong Lin, Zihao Lin, Jiuxiang Gu, Krishna Kumar Singh, Yuheng Li, Yin Li
机构
*
University of Wisconsin Madison(威斯康星大学麦迪逊分校)
;
Adobe Research(Adobe 研究院)
;
University of California Los Angeles(加利福尼亚大学洛杉矶分校)
;
University of California Davis(加利福尼亚大学戴维斯分校)
Montreal Forced Aligner and the state of speech-to-text alignment in 2026
Montreal Forced Aligner 与 2026 年语音到文本对齐的现状
Michael McAuliffe, Kaylynn Gunter, Michael Wagner, Morgan Sonderegger
机构
*
University of Wisconsin--Madison(威斯康星大学麦迪逊分校)
;
McGill University(麦吉尔大学)
;
Centre for Brain, Language, and Music(大脑、语言与音乐中心)
;
University of Oregon(俄勒冈大学)
AI总结
本文介绍 MFA 3.0 自 1.0 版本以来的发展,并在英语、日语和韩语上评估其性能,在四个基准数据集上达到平均边界误差低于 15 ms 的最优或接近最优性能。