arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-04-17 至 2026-04-17 共收录 59 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 49 篇

2604.15144 2026-04-17 math.NA cs.NA 50%

A post-processed higher-order multiscale method for nondivergence-form elliptic equations

后处理的高阶多尺度方法用于非散度形式椭圆方程

Moritz Hauck, Roland Maier, Timo Sprekeler

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出一种后处理的高阶多尺度方法,用于求解非散度形式的线性二阶椭圆偏微分方程,通过稳定对称公式和粗基函数构造多尺度方法,实现更高阶收敛性。

Comments 23 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15084 2026-04-17 cond-mat.other 50%

Static heterogeneity generates apparent universality in first-passage bursty dynamics

静态异质性在首次通过突发动态中产生显性普遍性

Morten Møller, Philipp Rahe, Sadegh Ghaderzadeh, Elena Besley, Philip Moriarty

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究通过分子扩散实验揭示突发动态中的幂律行为源于空间异质性而非自相似性,证明α≈1的尺度效应由探针诱导的空间不均一性导致。

Comments 34 pages (main, including four figures and four tables); 32 pages (Supplementary Text, including 14 figures and 1 table)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15009 2026-04-17 cs.AI cs.LG 50%

Towards Faster Language Model Inference Using Mixture-of-Experts Flow Matching

迈向更快的语言模型推断:专家混合流匹配

Aihua Li

机构 * Duke University(杜克大学)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出MoE-FM框架,通过分解复杂潜空间传输几何结构,提升语言模型推断效率,YAN模型在多个任务中表现优异,速度提升显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16906 2026-04-17 math.AP 50%

Inverse problems for quasi-linear elliptic systems modeling electrolysers

反问题研究:建模电解槽的准线性椭圆系统

Giovanni S. Alberti, Wadim Gerner, Matteo Santacesaria

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究电解槽中电化学过程的反问题,通过耦合的准线性椭圆PDE系统,探讨如何利用边界和内部测量数据唯一重建非线性扩散系数和电势关系。

Comments 33 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06930 2026-04-17 cs.LG math.OC math.ST stat.ML stat.TH 50%

Continuous-time reinforcement learning: ellipticity enables model-free value function approximation

连续时间强化学习:椭圆性使模型无关价值函数近似

Wenlong Mou

机构 * Department of Statistical Sciences, University of Toronto(统计科学系,多伦多大学)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究连续时间马尔可夫扩散过程的离线强化学习,提出基于椭圆性性质的Sobolev-prox fitted q-learning算法,通过迭代求解最小二乘回归问题实现价值函数近似,证明其估计误差受函数类最佳逼近误差、局部复杂度、指数衰减优化误差和数值离散误差影响。

Comments update from previous version: removed unnecessarily strong requirement on discount rate

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07169 2026-04-17 nucl-th hep-ph 50%

Bayesian Inference of Heavy-Quark Dissipation and Jet Transport Parameters from D-Meson observables in heavy-ion collisions at the LHC energies

重子衰减与喷流传输参数的贝叶斯推断:基于D介子观测值的LHC能量重离子碰撞研究

Xu-Fei Xue, Zi-Xuan Xu, Wei Dai, Jiaxing Zhao, Ben-Wei Zhang

专题命中 扩散模型 :diffusion(abstract)

AI总结 利用Pb-Pb碰撞中D介子核修改因子和椭圆流数据,首次通过贝叶斯推断同时确定重子空间扩散系数和喷流传输系数,揭示强相互作用介质中两种基本传输性质的定量关系。

Comments 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26174 2026-04-17 physics.ins-det nucl-ex physics.plasm-ph 50%

BABY 1L: First Tritium Breeding Campaign Results

BABY 1L:首次氚 breeding 活动结果

Rémi Delaporte-Mathurin, Nikola Goles, Collin Dunn, Emily Edwards, Sara Ferry, Ross MacDonald, Ethan Peterson, Davide Pettinari, Stefano Segantin, Weiyue Zhou, Kevin B. Woller

专题命中 扩散模型 :diffusion(abstract)

AI总结 BABY 1L实验通过改进的熔盐 breeding 系统和诊断技术,实现了氚 breeding 比例的显著提升,验证了其在聚变能应用中的可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.05790 2026-04-17 stat.CO stat.ML 50%

Kinetic Interacting Particle Langevin Monte Carlo

动力学交互粒子兰格朗日蒙特卡洛

Paul Felix Valsecchi Oliva, O. Deniz Akyildiz

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出动力学交互粒子兰格朗日蒙特卡洛方法,用于潜在变量模型统计推断,通过联合演化参数与潜在变量空间的扩散过程,实现非渐近收敛率和维度依赖性改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14851 2026-04-17 math.PR math-ph math.MP 50%

Pool model: a mass preserving multi particle aggregation process

池模型:一种质量守恒的多粒子聚并过程

Zhenhao Cai, Eviatar B. Procaccia, Yuan Zhang

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究了二维空间中的池模型,该模型是多粒子扩散限制聚并(MDLA)的旋转对称类比。粒子在连续时间随机游走,并在进入圆形池时被吸收,从而增加池的质量并扩展池的面积,实现质量守恒。

Comments 26 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14680 2026-04-17 cond-mat.mtrl-sci 50%

Anomalous Platinum and Oxygen Transport during Electroforming of NbOx Memristors

铌氧化物忆阻器电形成过程中异常的铂和氧传输

Shimul Kanti Nath, Sanjoy Kumar Nandi, Xiao Sun, Sujan Kumar Das, Bin Gong, Nicholas J. Ekins-Daukes, Deepak Mishra, Mahesh P. Suryawanshi, William D. A. Rickard, Songyan Yin, Michael P. Nielsen, Robert G. Elliman

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究揭示了电形成过程中铂和氧的异常重分布机制,通过建模和实验发现电流控制的负微分电阻操作导致局部加热和热循环,促进氧迁移和铂扩散,揭示了新的金属离子传输机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14498 2026-04-17 cs.AI cs.LG stat.ML 50%

Improving Machine Learning Performance with Synthetic Augmentation

用合成增强提升机器学习性能

Mel Sohm, Charles Dezons, Sami Sellami, Oscar Ninou, Axel Pincon

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究合成增强在金融机器学习中缓解数据稀缺的作用,通过结构偏倚-方差权衡分析,发现其在方差主导的波动预测中有效,但在偏倚主导的预测中表现下降。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14427 2026-04-17 math.PR 50%

A criterion for proving entropy chaos on path space

路径空间上证明熵混沌的判据

Luigi Borasi, Francesco Carlo De Vecchi, Stefania Ugolini

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种在路径空间上证明强形式熵混沌的判据,针对一类保守扩散过程,证明在粒子数趋于无穷时,满足特定正则性条件的极限漂移可实现强熵混沌。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14237 2026-04-17 cs.LG 50%

TOPCELL: Topology Optimization of Standard Cell via LLMs

TOPCELL: 通过LLMs进行标准单元的拓扑优化

Zhan Song, Yu-Tung Liu, Chen Chen, Guoheng Sun, Jiaqi Yin, Chia-tung Ho, Ang Li, Haoxing Ren, Cunxi Yu

机构 * University of Maryland(马里兰大学) NVIDIA(英伟达)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出TOPCELL框架,利用LLMs将高维拓扑探索转化为生成任务,通过GRPO优化实现逻辑和空间约束下的高效拓扑优化,实验显示其在2nm节点中性能优于基础模型,且在7nm库生成中实现85.91倍速度提升。

Comments Accepted to the 63rd ACM/IEEE Design Automation Conference (DAC 2026). 7 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14202 2026-04-17 q-bio.NC cs.AI 50%

Bridging scalp and intracranial EEG in BCI via pretrained neural representations and geometric constraint embedding

通过预训练神经表示和几何约束嵌入桥接头皮和脑内EEG

Yihang Dong, Changhong Jing, Shuqiang Wang

机构 * Shenzhen Institutes of Advanced Technology(深圳先进技术研究院) Chinese Academy of Sciences(中国科学院) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出统一框架提升EEG-iEEG表示,通过几何结构指导功能,结合预训练模型和扩散过程生成高保真神经信号,提升BCI性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14190 2026-04-17 physics.gen-ph 50%

A Local Gauge-Covariant Formulation of Classical Dynamics

经典动力学的局部规范协变 formulations

Gunjan Auti, Hirofumi Daiguji, Gouhei Tanaka

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出一种无需预设演化规律和外部时钟的局部规范协变经典动力学框架,通过局部不相容性与状态和传输几何的协同演化,实现局部规范一致性,恢复经典连续方程。

Comments 15 pages, 1 figure, 8 pages SI

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15974 2026-04-17 physics.soc-ph econ.GN q-fin.EC q-fin.PM 50%

Flow Taxes, Stock Taxes, and Portfolio Choice: A Generalised Neutrality Result

财富税、存量税与投资组合选择:一个广义中性结果

Anders G Frøseth

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究了财富税、存量税对投资组合选择的影响,证明在特定条件下,综合税收系统保持投资组合中性,揭示了存量税与流量税的分离效应。

Comments 27 pages, 1 figure, 7 tables. v2: sqrt(F) attribution corrected; bibliography audit fixes propagated; abstract synced

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01309 2026-04-17 quant-ph cond-mat.dis-nn 50%

Hilbert space signatures of non-ergodic glassy dynamics

非厄洛的玻璃动力学的希尔伯特空间签名

Aleksey Lunkin, Nicole S. Ticea, Shashwat Kumar, Connie Miao, Jaehong Choi, Mohammed Alghadeer, Ilya Drozdov, Dmitry Abanin, Amira Abbas, Rajeev Acharya, Laleh Beni, Georg Aigeldinger, Ross Alcaraz, Sayra Alcaraz, Markus Ansmann, Frank Arute, Kunal Arya, Walt Askew, Nikita Astrakhantsev, Juan Atalaya, Ryan Babbush, Brian Ballard, Joseph C. Bardin, Hector Bates, Andreas Bengtsson, Majid Karimi, Alexander Bilmes, Simon Bilodeau, Felix Borjans, Alexandre Bourassa, Jenna Bovaird, Dylan Bowers, Leon Brill, Peter Brooks, Michael Broughton, David A. Browne, Brett Buchea, Bob B. Buckley, Tim Burger, Brian Burkett, Nicholas Bushnell, Jamal Busnaina, Anthony Cabrera, Juan Campero, Hung-Shen Chang, Silas Chen, Zijun Chen, Ben Chiaro, Liang-Ying Chih, Agnetta Y. Cleland, Bryan Cochrane, Matt Cockrell, Josh Cogan, Paul Conner, Harold Cook, Rodrigo G. Cortiñas, William Courtney, Alexander L. Crook, Ben Curtin, Martin Damyanov, Sayan Das, Dripto M. Debroy, Sean Demura, Paul Donohoe, Andrew Dunsworth, Valerie Ehimhen, Alec Eickbusch, Aviv Moshe Elbag, Lior Ella, Mahmoud Elzouka, David Enriquez, Catherine Erickson, Lara Faoro, Vinicius S. Ferreira, Marcos Flores, Leslie Burgos, Sam Fontes, Ebrahim Forati, Jeremiah Ford, Brooks Foxen, Masaya Fukami, Alan Wing Fung, Lenny Fuste, Suhas Ganjam, Gonzalo Garcia, Christopher Garrick, Robert Gasca, Helge Gehring, Robert Geiger, William Giang, Dar Gilboa, James E. Goeders, Edward C. Gonzales, Raja Gosula, Stijn J. Graaf, Alejandro Dau, Dietrich Graumann, Joel Grebel, Alex Greene, Jonathan A. Gross, Jose Guerrero, Loïck Guevel, Tan Ha, Steve Habegger, Tanner Hadick, Ali Hadjikhani, Michael C. Hamilton, Monica Hansen, Matthew P. Harrigan, Sean D. Harrington, Jeanne Hartshorn, Stephen Heslin, Paula Heu, Oscar Higgott, Reno Hiltermann, Jeremy Hilton, Hsin-Yuan Huang, Mike Hucka, Christopher Hudspeth, Ashley Huff, William J. Huggins, Evan Jeffrey, Shaun Jevons, Zhang Jiang, Xiaoxuan Jin, Cody Jones, Chaitali Joshi, Pavol Juhas, Andreas Kabel, Dvir Kafri, Hui Kang, Kiseo Kang, Amir H. Karamlou, Ryan Kaufman, Kostyantyn Kechedzhi, Julian Kelly, Tanuj Khattar, Mostafa Khezri, Seon Kim, Paul V. Klimov, Can M. Knaut, Bryce Kobrin, Alexander N. Korotkov, Fedor Kostritsa, John Mark Kreikebaum, Ryuho Kudo, Ben Kueffler, Arun Kumar, Vladislav D. Kurilovich, Vitali Kutsko, Tiano Lange-Dei, Brandon W. Langley, Pavel Laptev, Kim-Ming Lau, Emma Leavell, Justin Ledford, Joonho Lee, Joy Lee, Kenny Lee, Brian J. Lester, Wendy Leung, Lily Li, Wing Yan Li, Ming Li, Alexander T. Lill, William P. Livingston, Matthew T. Lloyd, Laura Lorenzo, Erik Lucero, Daniel Lundahl, Aaron Lunt, Sid Madhuk, Aniket Maiti, Ashley Maloney, Salvatore Mandrà, Leigh S. Martin, Orion Martin, Eric Mascot, Paul Das, Dmitri Maslov, Melvin Mathews, Cameron Maxfield, Jarrod R. McClean, Matt McEwen, Seneca Meeks, Anthony Megrant, Kevin C. Miao, Zlatko K. Minev, Reza Molavi, Sebastian Molina, Shirin Montazeri, Charles Neill, Michael Newman, Anthony Nguyen, Murray Nguyen, Chia-Hung Ni, Murphy Yuezhen Niu, Logan Oas, William D. Oliver, Raymond Orosco, Kristoffer Ottosson, Alice Pagano, Agustin Paolo, Sherman Peek, David Peterson, Alex Pizzuto, Elias Portoles, Rebecca Potter, Orion Pritchard, Michael Qian, Chris Quintana, Ganesh Ramachandran, Arpit Ranadive, Matthew J. Reagor, Rachel Resnick, David M. Rhodes, Daniel Riley, Gabrielle Roberts, Roberto Rodriguez, Emma Ropes, Lucia B. Rose, Eliott Rosenberg, Emma Rosenfeld, Dario Rosenstock, Elizabeth Rossi, David A. Rower, Robert Salazar, Kannan Sankaragomathi, Murat Can Sarihan, Kevin J. Satzinger, Max Schaefer, Sebastian Schroeder, Henry F. Schurkus, Aria Shahingohar, Michael J. Shearn, Aaron Shorter, Vladimir Shvarts, Volodymyr Sivak, Spencer Small, W. Clarke Smith, David A. Sobel, Barrett Spells, Sofia Springer, George Sterling, Jordan Suchard, Aaron Szasz, Alexander Sztein, Madeline Taylor, Jothi Priyanka Thiruraman, Douglas Thor, Dogan Timucin, Eifu Tomita, Alfredo Torres, M. Mert Torunbalci, Hao Tran, Abeer Vaishnav, Justin Vargas, Sergey Vdovichev, Guifre Vidal, Benjamin Villalonga, Catherine Heidweiller, Meghan Voorhees, Steven Waltman, Jonathan Waltz, Shannon X. Wang, Brayden Ware, James D. Watson, Yonghua Wei, Travis Weidel, Theodore White, Kristi Wong, Bryan W. Woo, Christopher J. Wood, Maddy Woodson, Cheng Xing, Z. Jamie Yao, Ping Yeh, Bicheng Ying, Juhwan Yoo, Noureldin Yosri, Elliot Young, Grayson Young, Adam Zalcman, Ran Zhang, Yaxing Zhang, Ningfeng Zhu, Nicholas Zobrist, Zhenjie Zou, Sergio Boixo, Hartmut Neven, Vadim Smelyanskiy, Trond I. Andersen, Pedram Roushan, Mikhail V. Feigelman, Lev B. Ioffe

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究二维超导量子比特阵列中非厄洛相的玻璃动力学特性,发现非厄洛相中物理量分布广泛且部分自由度冻结,希尔伯特空间返回概率呈现幂律衰减,同时检测到有限的爱德华-安德森序参量和消失的自旋扩散。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25030 2026-04-17 physics.flu-dyn 50%

Lagrangian description and quantification of scalar mixing in fluid flows from particle tracks

拉格朗日描述与流体中标量混合的量化

Anna Klünker, Alexandra von Kameke, Kathrin Padberg-Gehle

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出一种数据驱动方法,结合扩散图和确定性粒子方法,用于描述和量化流体中标量的输运与混合过程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23468 2026-04-17 cs.RO cs.AI cs.LG 50%

Multi-Modal Manipulation via Multi-Modal Policy Consensus

多模态操控 via 多模态策略共识

Haonan Chen, Jiaming Xu, Hongyu Chen, Kaiwen Hong, Binghao Huang, Chaoqi Liu, Jiayuan Mao, Yunzhu Li, Yilun Du, Katherine Driggs-Campbell

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Columbia University(哥伦比亚大学) Massachusetts Institute of Technology(麻省理工学院) Harvard University(哈佛大学)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出通过多模态策略共识实现多模态操控,采用扩散模型分解策略并利用路由网络动态组合模态贡献,提升机器人操控任务中多模态推理能力。

Comments 8 pages, 7 figures. Project website: https://policyconsensus.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14003 2026-04-17 cs.SD cs.AI 50%

RFM-Editing: Rectified Flow Matching for Text-guided Audio Editing

RFM-Editing:基于矩形流匹配的文本引导音频编辑

Liting Gao, Yi Yuan, Yaru Chen, Yuelan Cheng, Zhenbo Li, Juan Wen, Shubin Zhang, Wenwu Wang

机构 * Centre for Vision, Speech and Signal Processing (CVSSP), University of Surrey, United Kingdom(视觉、语音和信号处理中心(CVSSP),英国萨里大学) College of Information and Electrical Engineering, China Agricultural University, China(信息与电气工程学院,中国农业大学) Fisheries College, Ocean University of China, China(海洋大学渔业学院,中国)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出基于矩形流匹配的音频编辑框架,通过构建包含重叠多事件音频的数据集,实现文本引导下的精确音频编辑,无需辅助提示或掩码,保持高质量编辑效果。

Comments Accepted to ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19783 2026-04-17 cond-mat.mtrl-sci cond-mat.mes-hall 50%

Directionally Locked Heteroepitaxy with a Structurally Modulated van der Waals Material

方向锁定异质外延与结构调制范德瓦尔材料

Nitish Mathur, Guangming Cheng, Francesc Ballester, Gabrielle Carrel, Vincent M. Plisson, Fang Yuan, Jiangchang Zheng, Caiyun Chen, Scott B. Lee, Ratnadwip Singha, Sudipta Chatterjee, Kenji Watanabe, Takashi Taniguchi, Kenneth S. Burch, Berthold Jäck, Ion Errea, Maia G. Vergniory, Nan Yao, Sanfeng Wu, Leslie M. Schoop

专题命中 扩散模型 :diffusion(abstract)

AI总结 通过结构调制范德瓦尔TaCo2Te2基底的晶格不稳定性,实现对对称不匹配体材料CoxTey的生长与对齐,通过热处理诱导表面扩散和横向生长,实现界面方向锁定。

Comments 25 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 可控生成 4 篇

2601.04588 2026-04-17 cs.CV 74%

3D Conditional Image Synthesis of Left Atrial LGE MRI from Composite Semantic Masks

基于复合语义掩码的左心房LGE MRI的3D条件图像合成

Yusri Al-Sanaani, Rebecca Thornhill, Sreeraman Rajan

机构 * Systems and Computer Engineering, Carleton University(卡尔顿大学系统与计算机工程系) Department of Radiology, University of Ottawa(渥太华大学放射科部)

专题命中 可控生成 :image synthesis(title);分类 cs.CV

AI总结 本文提出利用3D条件生成模型增强稀少LGE训练数据,提升左心房分割性能,SPADE-LDM生成最逼真图像,使Dice分数显著提升。

Comments This work has been published in the Proceedings of the 2025 IEEE International Conference on Imaging Systems and Techniques (IST). The final published version is available via IEEE Xplore

Journal ref 2025 IEEE International Conference on Imaging Systems and Techniques (IST)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14940 2026-04-17 math.OC 50%

A pointwise tracking optimal control problem for a fractional, semilinear PDE

关于分数半线性PDE的点跟踪最优控制问题

Enrique Otarola, Abner J. Salgado

专题命中 可控生成 :diffusion(abstract)

AI总结 研究分数半线性椭圆PDE的点跟踪最优控制问题,分析状态点评估的well-posed性,解决非凸性和分数偏微分方程的奇异右端项问题,推导一阶和二阶最优性条件。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25515 2026-04-17 eess.SY cs.SY 50%

Spatiotemporal Forecasting of Incidents and Congestion with Implications for Sustainable Traffic Control

城市事件与拥堵的时空预测及对可持续交通控制的启示

Tony Kinchen, Ting Bai, Nishanth Venkatesh S., Andreas A. Malikopoulos

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出基于模拟的框架,用于建模、检测和预测城市网络中的交通异常,结合深度预测模型实现可持续交通管理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14769 2026-04-17 cs.LG 50%

Constraint-based Pre-training: From Structured Constraints to Scalable Model Initialization

基于约束的预训练:从结构化约束到可扩展的模型初始化

Fu Feng, Yucheng Xie, Ruixiao Shi, Jing Wang, Xin Geng

机构 * School of Computer Science and Engineering, Southeast University, Nanjing, China(东南大学计算机科学与工程学院,南京,中国) Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications (Southeast University), Ministry of Education, China(新一代人工智能技术及其跨学科应用重点实验室(东南大学),教育部,中国)

专题命中 可控生成 :image generation(abstract)

AI总结 本文提出基于约束的预训练方法,通过结构化约束解耦无尺寸依赖的知识,利用轻量级权重标量实现不同尺寸模型的初始化,提升模型适应性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 图像修复 2 篇

2604.14648 2026-04-17 cs.CV cs.AI cs.LG 70%

Seen-to-Scene: Keep the Seen, Generate the Unseen for Video Outpainting

视见过境:保留已见,生成未见以实现视频外推画布

Inseok Jeon, Minhyeok Lee, Seunghoon Lee, Minseok Kang, Suhwan Cho, Sangyoun Lee

机构 * Yonsei University(延世大学) GenGenAI

专题命中 图像修复 :diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 本文提出Seen-to-Scene框架,结合传播和生成方法提升视频外推画布的时空一致性与视觉真实性,通过流传播和参考引导的潜在传播提高效率和可靠性。

Comments 8 pages, 8 figures (main paper); 9 pages, 10 figures (supplementary). Accepted to the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2026, Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20328 2026-04-17 cs.CV eess.IV math.OC 57%

GSNR: Graph Smooth Null-Space Representation for Inverse Problems

GSNR:图平滑空域表示用于逆问题

Romario Gualdrón-Hurtado, Roman Jacome, Rafael S. Suarez, Henry Arguello

机构 * Universidad Industrial de Santander(圣安德烈大学)

专题命中 图像修复 :diffusion(abstract);分类 cs.CV

AI总结 本文提出GSNR方法,通过在不可见成分中施加结构,解决逆问题中空域信息约束不足的问题,提升重建精度。

Comments Accepted to The IEEE/CVF Conference on Computer Vision and Pattern Recognition 2026 (CVPR 2026)

Journal ref Proceedings of the Computer Vision and Pattern Recognition Conference (CVPR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 效率与蒸馏 1 篇

2604.14580 2026-04-17 cs.CV cs.MM cs.SD 62%

TurboTalk: Progressive Distillation for One-Step Audio-Driven Talking Avatar Generation

TurboTalk: 一步生成音频驱动的虚拟角色的渐进蒸馏

Xiangyu Liu, Feng Gao, Xiaomei Zhang, Yong Zhang, Xiaoming Wei, Zhen Lei, Xiangyu Zhu

机构 * MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所MAIS部) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Meituan(美团) The Hong Kong Polytechnic University(香港理工大学) CAIR, HKISI, CAS(中国科学院CAS HKISI CAIR)

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV、cs.MM

AI总结 本文提出TurboTalk框架,通过分布匹配蒸馏和对抗蒸馏逐步压缩多步音频驱动视频扩散模型,实现单步生成高质量虚拟角色,推理速度提升120倍。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 其他图像生成 1 篇

2604.14574 2026-04-17 cs.CV 57%

M3D-Net: Multi-Modal 3D Facial Feature Reconstruction Network for Deepfake Detection

M3D-Net:面向深度伪造检测的多模态3D面部特征重建网络

Haotian Wu, Yue Cheng, Shan Bian

机构 * College of Mathematics and Informatics(数学与信息学院) South China Agricultural University(华南农业大学) Wushan Road, Tianhe District(天河南路) Guangzhou(广州) China(中国)

专题命中 其他图像生成 :image generation(abstract);分类 cs.CV

AI总结 本文提出M3D-Net,通过多模态特征融合和3D重建模块提升深度伪造检测的准确性和鲁棒性,实验表明其在多个数据集上表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏