arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-03-03 至 2026-03-03 共收录 2 信号源:cs.CV, cs.GR, cs.MM

1. 个性化与一致性 2 篇

2603.01418 2026-03-03 cs.CV cs.MM cs.SD 62%

UniTalking: A Unified Audio-Video Framework for Talking Portrait Generation

UniTalking: 一种统一的音频-视频框架用于说话肖像生成

Hebeizi Li, Zihao Liang, Benyuan Sun, Zihao Yin, Xiao Sha, Chenliang Wang, Yi Yang

机构 * Central Media Technology Institute, Huawei(华为中央媒体技术研究所) School of Computer Science and Engineering, Beihang University(北航计算机科学与工程学院)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.MM

AI总结 UniTalking提出了一种统一的端到端扩散框架,用于生成高质量的语音和唇同步视频,通过多模态Transformer块和个性化语音克隆技术,提升了视觉保真度和训练效率。

Comments Accepted at CVPR 2026 (Findings Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11450 2026-03-03 math.AP 50%

Sharp decay characterization for partially dissipative hyperbolic systems of balance laws

部分耗散双曲系统衰减特性刻画

Ling-Yun Shou, Jiang Xu, Ping Zhang

专题命中 个性化与一致性 :diffusion(abstract)

AI总结 本文通过L^p能量方法,提出新有效量Ψ(t,x),揭示部分耗散双曲系统解在dot B^{σ}_{p,1}范数下的衰减速率及耗散部分的增强衰减速率。

Comments 56 pages. Any comments or suggestions are welcome. The title "Decay character theory for partially dissipative hyperbolic systems of balance laws" has been replaced by the current title in contrast to the first version

详情

展开后加载摘要…

URL PDF HTML 收藏