RAP: Real-time Audio-driven Portrait Animation with Video Diffusion Transformer
RAP: 基于音频的实时人物动画与视频扩散变换器
专题命中 扩散模型 :diffusion(title);分类 cs.CV、cs.GR
AI总结 RAP通过混合注意力机制和静态-动态训练-推理范式,在实时约束下实现高质量音频驱动人物动画,提升音频-视觉同步与视觉保真度。
Comments 11 pages, 9 figures
视觉与机器人
图像生成、文生图、图像编辑、扩散模型和可控生成。
RAP: 基于音频的实时人物动画与视频扩散变换器
专题命中 扩散模型 :diffusion(title);分类 cs.CV、cs.GR
AI总结 RAP通过混合注意力机制和静态-动态训练-推理范式,在实时约束下实现高质量音频驱动人物动画,提升音频-视觉同步与视觉保真度。
Comments 11 pages, 9 figures
SceneTransporter: 基于最优传输的组合潜在扩散模型用于单图像结构化3D场景生成
机构 * Xi’an Research Institute of Hi-Tech(西安高新技术研究院) ; Tsinghua University(清华大学) ; SkyWork AI ; Tongji University(同济大学) ; Fudan University(复旦大学) ; Beijing Normal University(北京师范大学)
专题命中 扩散模型 :diffusion(title);分类 cs.CV
AI总结 SceneTransporter通过最优传输引导的组合潜在扩散模型,提升单图像结构化3D场景生成的实例连贯性和几何保真度。
Comments published at iclr 2026
StableMaterials: 通过半监督学习增强材料生成的多样性
机构 * Adobe Research(Adobe研究院)
专题命中 扩散模型 :image generation(abstract);diffusion(abstract);分类 cs.CV、cs.GR
AI总结 StableMaterials通过半监督学习与潜在扩散模型结合,提升材料生成的多样性和视觉质量,实现快速高效生成。
运算学习用于反应扩散系统的预设时间稳定化
专题命中 扩散模型 :diffusion(title)
AI总结 本文提出基于神经运算的预设时间稳定化方法,用于解决具有空间和时间变化系数的反应扩散系统稳定化问题,通过减少计算成本实现实时应用。
SEGB: 自适应生成性竞价与局部自回归扩散
机构 * Beijing China(中国北京)
专题命中 扩散模型 :diffusion(title)
AI总结 SEGB通过自适应生成性竞价与局部自回归扩散,实现动态市场中的高效竞价策略,显著提升广告效果与商业价值。
G4Splat:基于生成先验的几何引导高斯点云法
机构 * Tsinghua University(清华大学) ; State Key Laboratory of General Artificial Intelligence(通用人工智能国家重点实验室) ; BIGAI ; Peking University(北京大学)
专题命中 扩散模型 :diffusion(abstract);inpainting(abstract);分类 cs.CV
AI总结 G4Splat通过几何引导的生成先验提升3D场景重建,有效解决多视角不一致性问题,实现高质量场景补全。
Comments ICLR'26. Project page: https://dali-jack.github.io/g4splat-web/
LAMM-ViT:通过区域引导注意力的层感知调制进行AI面部检测
机构 * Wuhan University of Technology(武汉理工大学)
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV
AI总结 LAMM-ViT通过层感知调制和区域引导注意力实现鲁棒的AI面部检测,有效捕捉不同生成技术中的细微伪造线索。
Comments Accepted to ECAI 2025
GIFSplat: 生成先验引导的迭代前馈3D高斯点云从稀疏视角重建
机构 * La Trobe University(拉特罗布大学) ; Cisco Research(思科研究)
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV
AI总结 GIFSplat通过生成先验引导的迭代前馈方法,从稀疏视角高效重建3D高斯点云,提升PSNR并保持推理效率。
迈向无缝交互:交互式3D对话头部动力学的因果回合级建模
机构 * HFUT(合肥工业大学) ; IAI, Hefei Comprehensive National Science Center(人工智能研究院,合肥综合性国家科学中心) ; USTC(中国科学技术大学) ; SJTU(上海交通大学) ; TeleAI, China Telecom(TeleAI,中国电信) ; NWPU(西北工业大学) ; UAEU(阿联酋大学) ; AHPU(安徽大学)
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV
AI总结 TIMAR通过因果回合级建模,实现了交互式3D对话头部动态的高效生成,提升了对话的表达性和时序一致性。
虚拟染色的适当评分规则
机构 * School of Computer Science, University of Birmingham, Birmingham, UK GSK Drug Metabolism \& Pharmacokinetics, GSK Medicines Research Centre, Stevenage, UK GSK Genome Biology, Collegeville, PA, USA School of Electronics, Electrical Engineering ; Computer Science, Queen's University Belfast, UK
专题命中 扩散模型 :diffusion(abstract)
AI总结 本文提出信息增益作为评估虚拟染色模型的严格适当评分规则,揭示模型在不同特征上的性能差异。
具有长程依赖性的非马尔可夫链及其缩放极限
专题命中 扩散模型 :diffusion(abstract)
AI总结 本文研究了具有长程依赖性的非马尔可夫链及其缩放极限,探讨了para-马尔可夫链和时间改变的马尔可夫链模型,揭示了其与分数阶方程和异常扩散的关系。
Comments 1 Figure
一个方程解释循环缺氧中的迁移或生长动态
专题命中 扩散模型 :diffusion(abstract)
AI总结 本文提出一个方程解释循环缺氧中肿瘤细胞的迁移或生长动态,通过简化模型验证了其有效性。
从单一测量确定子扩散中变量阶的唯一性
专题命中 扩散模型 :diffusion(abstract)
AI总结 本文提出通过单一测量确定子扩散中变量阶的唯一性,采用调和函数、线性化技术等方法,无需单调性条件,并扩展到高维空间。
Comments 27 pages, 2 figures
分数多孔介质方程弱解的局部有界性
专题命中 扩散模型 :diffusion(abstract)
AI总结 本文研究了分数多孔介质方程在快速扩散情形下弱解的局部有界性,通过最优尾部假设建立了相关结论。
通过孤立硫物种在Li3PS4玻璃中实现Li+传输的机理研究
专题命中 扩散模型 :diffusion(abstract)
AI总结 该研究通过从头计算分子动力学方法揭示了Li3PS4玻璃中Li+传输的机理,发现孤立硫物种显著增强Li+迁移能力,为固态电池玻璃材料设计提供理论依据。
一维晶格随机游走于高斯随机势中
专题命中 扩散模型 :diffusion(abstract)
AI总结 研究一维晶格中随机游走于高斯随机势的行为,分析三种模型下的概率电流、电阻、分裂概率、平均首次通过时间和扩散系数的自平均特性。
基于随机矩阵理论的稀疏PCA用于单细胞RNA测序数据
专题命中 扩散模型 :diffusion(abstract)
AI总结 本文提出基于随机矩阵理论的稀疏PCA方法,用于改进单细胞RNA测序数据的降维与细胞类型分类。
Comments 16 figures
扩散性U(1)-不变量子比特电路的鲁厄-波利科特共振
专题命中 扩散模型 :diffusion(abstract)
AI总结 该研究通过分析量子比特电路的鲁厄-波利科特共振,揭示了磁化扩散与非指数衰减的关系,并提出了扩散常数的提取方法。
Comments 21 + 12 pages, improved numerics and presentation
Journal ref SciPost Phys. 20, 061 (2026)
部分观测随机线性二次问题的近优控制
专题命中 扩散模型 :diffusion(abstract)
AI总结 本文提出了一种解决部分观测随机线性二次控制问题的方法,通过限制控制域和非标准变分法,克服了控制与滤波的环状依赖及无界漂移项的挑战。
URDME手册 版本1.5
专题命中 扩散模型 :diffusion(abstract)
AI总结 URDME 1.5版本提供了一种在无结构网格上模拟随机反应扩散过程的通用软件,采用次体积法并扩展到无结构网格,适用于复杂几何和弯曲边界。
Comments The latest version of URDME is available from http://www.urdme.org
AHBid: 一种适用于跨渠道广告的可适应分层竞价框架
机构 * OPPO Shenzhen Guangdong China(OPPO深圳广东中国)
专题命中 扩散模型 :diffusion(abstract)
AI总结 AHBid通过整合生成规划与实时控制,提升跨渠道广告竞价的适应性和效率,实验显示其投资回报率提升了13.57%。
Comments 11 pages, 6 figures, accepted by WWW'2026
利用锂和铍研究旋转恒星的结构和演化:晕星的斯皮特高原
专题命中 扩散模型 :diffusion(abstract)
AI总结 通过旋转模型解释晕星锂高原,揭示锂耗尽与恒星演化过程的关系。
Comments Accepted for publication in The Astrophysical Journal. 39 pages, 12 figures and 2 tables
超越对角噪声:一种更好的捕食者-猎物建模框架与交叉协方差
专题命中 扩散模型 :diffusion(abstract)
AI总结 本文提出了一种基于微观事件stoichiometry的捕食者-猎物建模框架,通过推导随机罗森兹威格-马卡罗思模型,揭示了标准对角噪声近似在数学和生物学上的局限性,并建立了开放领域与吸收领域之间的明确区分。
EgoAVFlow:通过人类中心视频主动视觉实现机器人策略学习
机构 * School of Interactive Computing, Georgia Institute of Technology(交互计算学院,佐治亚理工学院) ; InnoCORE AI-Transformed Aerospace Research Center, KAIST(AI转型航空航天研究中心,韩国成均馆大学)
专题命中 扩散模型 :diffusion(abstract)
AI总结 EgoAVFlow通过共享3D流表示从人类中心视频中学习机器人策略,实现主动视觉和稳健操纵,无需机器人演示。
细菌微胶囊渗透性的不确定性量化
专题命中 扩散模型 :diffusion(abstract)
AI总结 该研究通过构建数学模型量化细菌微胶囊对1,2-丙二醇和丙烯醛的渗透性,发现其渗透性参数范围并探讨了其对代谢过程的影响。
Comments 31 pages, 7 figures, 38 SI figures, 15 SI tables, and 3 additional SI text
利用流匹配和物理扰动实现动态系统快速灵活的概率预测
机构 * University of British Columbia(不列颠哥伦比亚大学) ; Environnement et Changement climatique Canada(加拿大环境与气候变化部)
专题命中 扩散模型 :diffusion(abstract)
AI总结 本研究提出了一种基于流匹配和物理扰动的框架,用于快速且灵活地预测动态系统,通过高效传播和物理一致性提升预测性能。
Comments arXiv admin note: text overlap with arXiv:2503.12273
多视图无线传感 via 条件生成学习:框架与模型设计
专题命中 扩散模型 :diffusion(abstract)
AI总结 本文提出一种基于条件生成学习的多视图无线传感框架,通过融合多视图CSI信息,利用双部分神经网络架构提升目标重建精度和灵活性。
Comments Accepted by IEEE Transactions on Wireless Communications
Journal ref IEEE Transactions on Wireless Communications
SeeThrough3D: 3D布局生成中的遮挡感知控制
机构 * IIIT Hyderabad(IIIT海得拉尔) ; IISc Bengaluru(IISc班加罗尔)
专题命中 可控生成 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV
AI总结 SeeThrough3D通过引入遮挡感知的3D场景表示和掩码自注意力机制,实现了对3D布局生成中遮挡关系的精确建模与控制。
Comments Project page: https://seethrough3d.github.io. Accepted at CVPR 2026
CoLoGen:渐进式学习概念定位二元性以实现统一图像生成
机构 * Baidu Inc.(百度公司) ; Zhejiang University(浙江大学) ; Tsinghua University(清华大学)
专题命中 可控生成 :image generation(title,abstract);diffusion(abstract);分类 cs.CV
AI总结 CoLoGen通过渐进式学习概念与定位的二元性,实现统一图像生成的高效表示学习。
Comments Accepted by CVPR2026. 15 pages, 8 figures
RelaCtrl: 为扩散变换器实现相关性引导的高效控制
专题命中 可控生成 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV
AI总结 RelaCtrl通过相关性引导的方法优化扩散变换器的控制信号整合,减少参数和计算开销,提升生成效率。
Comments AAAI 2026