arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-06-12 至 2026-06-12 共收录 31 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 1 篇

2606.06113 2026-06-12 cs.CV 版本更新 83%

Where, What, Why, and Importance: Structured Defect Grounding for Text-to-Image Feedback

位置、类型、原因与重要性:面向文本到图像反馈的结构化缺陷定位

Huaisong Zhang, Hao Yu, Yuxuan Zhang, Jiahe Wang, Xinrui Chen, Haoxiang Cao, Feng Lu, Wendong Zhang, Changqian Yu, Chun Yuan

机构 * Tsinghua University(清华大学) Kolors Team, Kuaishou Technology(快手科技Kolors团队) University of British Columbia(不列颠哥伦比亚大学) Vector Institute(向量研究所) South China Normal University(华南师范大学)

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 提出结构化缺陷定位(SDG)方法,将文本到图像生成中的缺陷诊断建模为结构化集合预测,通过构建SDG-30K数据集和SDG-Eval评估协议,并利用视觉语言模型作为检测器,结合BoxFlow-GRPO将预测的缺陷集合转化为空间奖励以改进扩散模型对齐。

Comments 25 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 图像编辑 2 篇

2506.18438 2026-06-12 cs.CV 版本更新 85%

CPAM: Context-Preserving Adaptive Manipulation for Zero-Shot Real Image Editing

CPAM: 保持上下文的自适应操作用于零样本真实图像编辑

Dinh-Khoi Vo, Thanh-Toan Do, Tam V. Nguyen, Minh-Triet Tran, Trung-Nghia Le

机构 * Faculty of Information Technology, University of Science, Ho Chi Minh City, Vietnam(越南科学大学信息科技学院) Vietnam National University, Ho Chi Minh City, Vietnam(越南国家大学) Faculty of Information Technology, Monash University, Melbourne, Victoria, Australia(莫纳什大学信息科技学院) Department of Computer Science, University of Dayton, Dayton, Ohio, US(Dayton 大学计算机科学系)

专题命中 图像编辑 :image editing(title,abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 提出CPAM零样本框架,通过保持上下文的自适应操作和掩码引导,实现复杂非刚性真实图像的编辑,保留纹理和身份,无需微调。

Comments Accepted to IEEE Transactions on Multimedia. Project page: https://vdkhoi20.github.io/CPAM

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00122 2026-06-12 cs.CV cs.AI cs.MM 版本更新 81%

VDE Bench: Evaluating The Capability of Image Editing Models to Modify Visual Documents

VDE Bench: 评估图像编辑模型对视觉文档进行修改的能力

Hongzhu Yi, Yujia Yang, Yuanxiang Wang, Tong Li, Zhenyu Guan, Tianyu Zong, Jiahuan Chen, Chenxi Bao, Tiankun Yang, Haopeng Jin, Yixuan Yuan, Xinming Wang, Tao Yu, Ruilin Gao, Ruiwen Tao, Haijin Liang, Jin Ma, Jinwen Luo, Yeshani, Xinyu Zuo, Jungang Xu

机构 * UCAS(中国科学院大学) CASIA(中国科学院自动化研究所) Tencent(腾讯) CMU(卡内基梅隆大学) WashU(华盛顿大学) SJTU(上海交通大学) XDU(北京理工大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV、cs.MM

AI总结 本文提出VDE Bench,一个专门评估图像编辑模型在双语中文-英文和复杂视觉文档编辑任务性能的基准,通过高质量数据集和新的评估框架,系统量化了文本修改的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 扩散模型 24 篇

2605.20140 2026-06-12 math.NA cs.NA 版本更新 78%

A Novel Stochastic Particle-Field Algorithm for a Reaction-Diffusion-Advection Cancer Invasion Model

一种新型的随机粒子-场算法用于反应-扩散-对流癌症侵袭模型

Jingyuan Hu, Zhongjian Wang, Jack Xin, Zhiwen Zhang

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出了一种新的数值框架,用于求解三维癌症生长的特定生物反应-扩散-对流系统,采用可变质量的粒子来模拟细胞密度,并通过粒子-网格算法实现粒子与空间网格的高效交互,同时利用谱方法快速求解空间扩散,证明了粒子质量的变化率在有限时间内有界,并且算法在空间网格上无条件保持正性,数值实验验证了理论收敛速率。

Comments 32 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18085 2026-06-12 cs.LG cs.AI cs.CL 版本更新 78%

Structuring The Future: Diffusion LLM Speculative Decoding via Calibrated Draft Graphs

构建未来:通过校准草稿图实现扩散LLM推测解码

Sudhanshu Agrawal, Risheek Garrepalli, Raghavv Goel, Christopher Lott, Fatih Porikli, Mingu Lee

机构 * University of Waterloo(多伦多大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 提出Spiffy算法,利用校准的草稿图结构实现扩散LLM的推测解码,在保持输出分布的同时加速推理,最高减少8.6倍模型推理次数并加速6.3倍令牌生成速率。

Comments Original version uploaded on Sep 22, 2025. (v2): Extended Table 2 with additional analysis and referenced it in Sec 5.2. (v3): Added note to Sec 4.2 and Appendix A.2 specifying conditions for losslessness. (v4): Updated with the version accepted to ICML 2026 workshops

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05895 2026-06-12 math.PR 版本更新 78%

Diffusion approximations for interacting stochastic systems with reflection and control

具有反射和控制的交互随机系统的扩散近似

Thoa Thieu, Roderick Melnik

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 研究一类具有反射和控制的交互随机系统的扩散近似,通过扩散缩放建立到Ornstein-Uhlenbeck型反射随机微分方程组的分布收敛,并用数值例子展示在人群动力学和神经群体动力学中的应用。

Comments 21 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19478 2026-06-12 physics.med-ph eess.IV 版本更新 78%

Bayesian Insights into Exchange and Restriction in Gray Matter Diffusion MRI

灰质弥散MRI中交换与限制的贝叶斯洞察

Maëliss Jallais, Quentin Uhl, Tommaso Pavan, Malwina Molendowska, Derek K. Jones, Ileana Jelescu, Marco Palombo

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本研究利用贝叶斯推断框架μGUIDE评估NEXI和SANDIX两种灰质模型的参数估计准确性、精度和简并性,发现交换时间和胞体半径等参数在高噪声下存在高不确定性和偏差,强调不确定性量化对提高模型可重复性的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01538 2026-06-12 cs.GR cs.CV cs.LG 版本更新 62%

MPMWorlds: Material-Point-Method Simulations for Inferring and Extrapolating Physical Dynamics

MPMWorlds: 用于推断和外推物理动力学的物质点法模拟

Žiga Kovačič, Kevin Ellis

机构 * Cornell University(康奈尔大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV、cs.GR

AI总结 通过构建2D物质点法(MPM)模拟数据集,研究从视频推断物理动力学并外推时间演化的能力,比较代码生成与视频扩散方法的优劣。

Comments 16 pages, 13 figures. Project page: https://zzigak.github.io/mpmworlds/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04260 2026-06-12 cs.CV cs.AI 版本更新 57%

Proto-LeakNet: Towards Signal-Leak Aware Attribution in Synthetic Human Face Imagery

Proto-LeakNet:面向合成人脸图像中信号泄漏感知的归因方法

Claudio Giusti, Luca Guarnera, Sebastiano Battiato

机构 * Department of Mathematics and Computer Science(数学与计算机科学系) University of Catania(卡塔尼亚大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 提出Proto-LeakNet,利用扩散模型中的信号泄漏痕迹,结合闭集分类与密度开集评估,实现可解释的生成器归因,在闭集上训练后对未见生成器也有效。

Comments 44 pages, 27 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.03747 2026-06-12 physics.app-ph 版本更新 50%

Generalized Virtual-Wave Theory for Photothermal Coherence Tomography under Arbitrary Excitation Toward Non-Contact Industrial Inspection of Composite Materials

面向复合材料非接触工业检测的光热相干层析成像广义虚拟波理论

Pengfei Zhu, Julien Lecompagnon, Philipp Daniel Hirsch, Mathias Ziegler

专题命中 扩散模型 :diffusion(abstract)

AI总结 提出广义虚拟波光热层析框架,将扩散-波变换推广到任意边界激励,通过ADMM或截断SVD求解逆问题,实现热扩散场到波场的转换,提升复合材料缺陷检测的深度定位和层析重建质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04009 2026-06-12 stat.ML cs.AI cs.LG 版本更新 50%

Counterfactual Explanations for Deep Two-Sample Testing

深度双样本检验的反事实解释

Wei-Cheng Lai, Marco Simnacher, Christoph Lippert

机构 * Hasso-Plattner-Institute, University of Potsdam(波茨坦大学洪堡-劳恩堡研究所) Hasso Plattner Institute for Digital Health at Mount Sinai Icahn School of Medicine at Mount Sinai(辛辛那提医学院洪堡数字健康研究所)

专题命中 扩散模型 :diffusion(abstract)

AI总结 针对深度双样本检验,提出基于扩散自编码器和MMD优化的反事实解释框架,生成样本级编辑以揭示驱动假设拒绝的特征。

Comments 17 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02133 2026-06-12 cs.LG cs.AI 版本更新 50%

Variational Learning for Insertion-based Generation

基于插入生成的变分学习

Yangtian Zhang, Zhe Wang, Arthur Gretton, Rex Ying, David van Dijk, Michalis K. Titsias, Jiaxin Shi

机构 * University of Cambridge(剑桥大学)

专题命中 扩散模型 :diffusion(abstract)

AI总结 提出插入过程(IP)模型,通过排列变分推断联合学习插入位置、内容和终止条件,支持变长生成并提升非自回归序列建模质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02044 2026-06-12 cs.LG physics.med-ph 版本更新 50%

Realistic noise synthesis reduces bias and improves tissue microstructure estimation with supervised machine learning

真实噪声合成减少偏差并改善有监督机器学习的组织微结构估计

Bradley G. Karat, Maëliss Jallais, Ali R. Khan, Santiago Aja-Fernández, Jelle Veraart, Marco Palombo

机构 * Robarts Research Institute, Schulich School of Medicine and Dentistry, The University of Western Ontario(罗巴茨研究所在,施密特医学与牙科学院,温哥华大学) Center for Biomedical Imaging, Department of Radiology, NYU Grossman School of Medicine(生物医学成像中心,放射科,纽约大学格罗斯曼医学院) Cardiff University Brain Research Imaging Center (CUBRIC), School of Psychology, Cardiff University(卡迪夫大学脑研究成像中心(CUBRIC),心理学学院,卡迪夫大学) School of Computer Science and Informatics, Cardiff University(计算机科学与信息学院,卡迪夫大学) Laboratorio de Procesado de Imagen, Universidad de Valladolid(图像处理实验室,瓦尔达利德大学) Instituto de Investigación Biosanitaria de Valladolid, IBioVALL(瓦尔达利德生物医学研究所,IBioVALL)

专题命中 扩散模型 :diffusion(abstract)

AI总结 针对扩散MRI中模拟与实测信号噪声不匹配导致的协变量偏移问题,提出真实噪声合成框架,通过引入Rician期望和有效后处理噪声方差,显著降低参数估计偏差并提高精度。

Comments * Shared first author

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00193 2026-06-12 cs.CL 版本更新 50%

BOUTEF: A Multilingual Corpus for FakeNews in North Africa -- Language as a Weapon

BOUTEF:北非假新闻的多语种语料库——语言作为武器

Kamel Smaili, Yassine Toughrai, Amina Laggoun, David Langlois

机构 * Loria, CNRS, Université de Lorraine(Loria研究所、法国国家科学研究中心、洛林大学)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文构建了包含阿尔及利亚和突尼斯多语种(MSA、方言、Arabizi、法语、英语等)的假新闻语料库BOUTEF,通过定量与定性分析揭示了假新闻依赖情感化叙事、耸人听闻框架和混合语言实践来增强传播力,而辟谣内容则更注重事实和验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15133 2026-06-12 cs.CE cs.AI 版本更新 50%

HD-Prot: A Protein Language Model for Joint Sequence-Structure Modeling with Continuous Structure Tokens

HD-Prot:一种使用连续结构令牌进行联合序列-结构建模的蛋白质语言模型

Yi Zhou, Haohao Qu, Yunqing Liu, Shanru Lin, Le Song, Wenqi Fan

机构 * The Hong Kong Polytechnic University(香港理工大学) Mohamed bin Zayed University of Artificial Intelligence(马尔代夫人工智能大学)

专题命中 扩散模型 :diffusion(abstract)

AI总结 提出HD-Prot,一种混合扩散蛋白质语言模型,通过连续结构令牌将序列pLM扩展为多模态,实现联合序列-结构建模,在多种任务上取得竞争性能。

Comments This is the long version of the corresponding paper to appear at KDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18817 2026-06-12 cs.LG 版本更新 50%

Multi-Token Residual Prediction

多令牌残差预测

Yufeng Xu, Zishuo Bao, Qian Wang, Zeshen Zhang, Haoqi Zhang, Bowen Peng, Ang Li, Rahul Chalamala, Yucheng Lu

机构 * New York University(纽约大学) New York University Shanghai(纽约大学上海) Nos Research(Nos研究) Modal

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种轻量级模块Multi-token Residual Prediction,通过利用去噪过程中相邻步骤的logit分布相似性,在单次骨干网络前向传播中实现依赖感知的多令牌去噪,从而在成本较低的情况下提高去噪效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18566 2026-06-12 physics.flu-dyn 版本更新 50%

Effect of subgrid-scale anisotropy on wall-modeled large-eddy simulation of turbulent flow with smooth-body separation

亚网格尺度各向异性对光滑体分离湍流壁面模化大涡模拟的影响

Di Zhou, H. Jane Bae

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究亚网格尺度各向异性应力在壁面模化大涡模拟光滑体分离流中的作用,发现基于涡粘的模型在网格细化时预测分离泡尺寸非单调,而各向异性模型更一致;迎风面强顺压梯度区是关键,各向异性应力通过改变亚网格耗散和扩散影响雷诺应力和分离起始。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08415 2026-06-12 math.NA cs.NA 版本更新 50%

Discontinuous Galerkin approximation of a nonlinear multiphysics problem arising in ultrasound-enhanced drug delivery

超声增强药物递送中非线性多物理场问题的间断伽辽金逼近

Femke de Wit, Vanja Nikolić

专题命中 扩散模型 :diffusion(abstract)

AI总结 针对超声增强药物递送,提出耦合Westervelt波动方程与对流扩散方程的数学模型,采用间断伽辽金方法离散,证明了半离散压力子问题的适定性与最优收敛率,并验证了数值实验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12753 2026-06-12 cs.LG 版本更新 50%

Hierarchical Successor Representation for Robust Transfer

层次化后继表示用于鲁棒迁移

Changmin Yu, Máté Lengyel

机构 * University of Cambridge(剑桥大学) DeepMind(深度思维)

专题命中 扩散模型 :diffusion(abstract)

AI总结 提出层次化后继表示(HSR),通过时间抽象构建鲁棒的状态特征,结合非负矩阵分解实现稀疏低秩表示,支持多隔间环境下的高效任务迁移与探索。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01636 2026-06-12 math.NA cs.NA 版本更新 50%

Low-order CR--RT equilibrated-flux certification for semilinear problems on anisotropic meshes

各向异性网格上半线性问题的低阶CR--RT均衡流认证

Hiroki Ishizaka

专题命中 扩散模型 :diffusion(abstract)

AI总结 针对半线性扩散-反应问题,提出基于CR--RT均衡流的低阶认证框架,通过牛顿-康托罗维奇论证给出显式半径ρ确保解存在唯一,并利用伴随修正缩小感兴趣量的区间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21570 2026-06-12 cs.AI cs.RO 版本更新 50%

From Digital to Physical: Digital Agents as Autonomous Coaches for Physical Intelligence

从数字到物理:数字代理作为物理智能的自主教练

Zixing Lei, Genjia Liu, Yuanshuo Zhang, Qipeng Liu, Yuzhu Cai, Sixiang Chen, Jixian Wu, Yunhong Wang, Weixin Li, Chuan Wen, Bo Zhao, Shanghang Zhang, Wenzhao Lian, Siheng Chen

机构 * School of Artificial Intelligence, Shanghai Jiao Tong University, Shanghai, China(上海交通大学人工智能学院) Zhongguancun Academy, Beijing, China(中关村学院) School of Integrated Circuits, Shanghai Jiao Tong University, Shanghai, China(上海交通大学集成电路学院) School of Computer Science, Shanghai Jiao Tong University, Shanghai, China(上海交通大学计算机科学学院) State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University, Beijing, China(北京大学计算机科学学院多媒体信息处理国家重点实验室)

专题命中 扩散模型 :diffusion(abstract)

AI总结 提出EmboCoach-Bench基准,评估LLM代理自主设计具身策略的能力,通过迭代调试和优化,代理在平均成功率上超越人工基线26.5%,并具备自我修正能力。

Comments 53 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07947 2026-06-12 cs.LG cs.AI 版本更新 50%

Reconstructing Template-Memorized Images from Natural Prompts

从自然提示中重建模板记忆的图像

Sol Yarkoni, Mahmood Sharif, Roi Livni

机构 * School of Electrical & Computer Engineering(电气与计算机工程学院) School of Computer Science & AI(计算机科学与人工智能学院) Tel Aviv University(特拉维夫大学)

专题命中 扩散模型 :diffusion(abstract)

AI总结 提出一种低资源攻击方法,利用模板化电商数据中的模式,从自然提示中重建训练集中的记忆图像,揭示隐私风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.25056 2026-06-12 stat.ME 版本更新 50%

Sequential Bayesian parameter-state estimation in dynamical systems with noisy and incomplete observations via a variational framework

基于变分框架的含噪声不完全观测动态系统序贯贝叶斯参数-状态估计

Liliang Wang, Alex Gorodetsky

专题命中 扩散模型 :diffusion(abstract)

AI总结 提出一种在线变分推断框架,通过分解联合后验为参数边缘分布和条件状态分布,实现动态系统参数与状态的联合估计,并给出误差上界理论保证,数值实验验证了其在混沌和高维系统中的鲁棒性与可扩展性。

Comments 31 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01082 2026-06-12 q-bio.TO 版本更新 50%

Comparative CFD modelling of the interplay between aqueous humour hydrodynamics and drug and nanocarrier transport for glaucoma drug delivery via intracameral injection, drug-eluting implants and contact lenses

青光眼药物经前房注射、药物洗脱植入物和隐形眼镜递送的眼前段药物和纳米载体输运的CFD比较建模

Nazifa Begum, Robert Dinita, Naman Patel, Umar Pitafi, Tao Chen, Cynthia Yu-Wai-Man, Daniel Sebastia-Saez

专题命中 扩散模型 :diffusion(abstract)

AI总结 本研究开发CFD框架,比较前房注射、药物洗脱植入物和隐形眼镜三种递送策略的药物输运、滞留和空间分布,以评估青光眼治疗效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03660 2026-06-12 cs.LG 版本更新 50%

Single vs. Multiple Branches in DeepONet and S-DeepONet: Network Architecture Follows Coupling in Multiphysics Systems

DeepONet和S-DeepONet中的单分支与多分支:网络架构遵循多物理系统中的耦合

Jaewan Park, Kazuma Kobayashi, Qibang Liu, Seid Koric, Diab Abueidda, Syed Bahauddin Alam

机构 * National Center for Supercomputing Applications, University of Illinois at Urbana-Champaign(国家超级计算应用中心,伊利诺伊大学厄巴纳-香槟分校) The Grainger College of Engineering, Mechanical Science and Engineering, University of Illinois at Urbana-Champaign(格拉inger工程学院,机械科学与工程系,伊利诺伊大学厄巴纳-香槟分校) The Grainger College of Engineering, Nuclear, Plasma & Radiological Engineering, University of Illinois at Urbana-Champaign(格拉inger工程学院,核物理与辐射工程系,伊利诺伊大学厄巴纳-香槟分校) Department of Industrial and Manufacturing Systems Engineering, Kansas State University(工业与制造系统工程系,堪萨斯州立大学) Civil and Urban Engineering Department, New York University Abu Dhabi, UAE(土木与城市工程系,纽约大学阿布扎比分校,阿联酋)

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究比较单分支与多分支神经算子架构在强耦合多物理系统中的表现,发现单分支网络在紧耦合场景下通过共享潜在表示优于多分支,而多分支适用于解耦或单物理任务,代理模型加速高达1.8×10^4倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12756 2026-06-12 math.AP 版本更新 50%

A note on global in-time behavior for the semilinear nonlocal heat exchanger system

关于半线性非局部热交换系统全局时间行为的注记

Yan Liu

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究具有分数阶拉普拉斯算子的非局部反应扩散系统的全局时间渐近行为,在超临界情形下证明全局存在性,并在一般L^m框架下给出全局解的渐近轮廓,同时确定次临界和临界情形下局部解生命跨度的下界估计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08425 2026-06-12 cs.LG math.AP math.PR 版本更新 50%

Is Stochastic Gradient Descent Effective? A PDE Perspective on Machine Learning processes

随机梯度下降有效吗?机器学习过程的PDE视角

Davide Barbieri, Matteo Bonforte, Peio Ibarrondo

机构 * Departamento de Matemáticas, Universidad Autónoma de Madrid, ICMAT - Instituto de Ciencias Matemáticas, CSIC-UAM-UC3M-UCM(数学系,马德里自治大学,ICMAT数学科学研究所,CSIC-UAM-UC3M-UCM)

专题命中 扩散模型 :diffusion(abstract)

AI总结 通过Fokker-Planck型抛物PDE分析SGD行为,区分漂移和扩散两个阶段,量化浓度现象并证明平均退出时间界限,为非凸损失和退化扩散矩阵下的渐近收敛提供新结果。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 可控生成 2 篇

2506.18493 2026-06-12 cs.CV 版本更新 70%

ShowFlow: From Robust Single Concept to Condition-Free Multi-Concept Generation

ShowFlow: 从鲁棒的单概念到无条件的多概念生成

Trong-Vu Hoang, Quang-Binh Nguyen, Thanh-Toan Do, Tam V. Nguyen, Minh-Triet Tran, Trung-Nghia Le

机构 * University of Science(科学大学) Vietnam National University(越南国家大学) Monash University(墨尔本大学) University of Dayton(Dayton大学)

专题命中 可控生成 :image generation(abstract);image synthesis(abstract);分类 cs.CV

AI总结 提出ShowFlow框架,通过KronA-WED适配器和语义感知注意力正则化增强单概念生成,并利用SAMA和布局一致性指导实现无额外条件的多概念生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17152 2026-06-12 physics.app-ph nlin.CD physics.comp-ph 版本更新 50%

Criticality of a Stochastic Dense Associative Memory Model with Exponential Interaction Function

具有指数交互函数的随机稠密联想记忆模型的临界性

Marco Cafiso, Paolo Paradisi

专题命中 可控生成 :diffusion(abstract)

AI总结 研究随机指数稠密联想记忆模型在MNIST数据上的动力学,发现噪声诱导的相变,临界噪声水平随负载增加而降低,临界状态下呈现长时间相关动力学。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 图像修复 1 篇

2402.01779 2026-06-12 eess.IV cs.CV cs.LG stat.ML 版本更新 70%

Plug-and-Play image restoration with Stochastic deNOising REgularization

即插即用图像恢复:随机去噪正则化

Marien Renaud, Jean Prost, Arthur Leclaire, Nicolas Papadakis

专题命中 图像修复 :diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 提出SNORE框架,仅在适当噪声水平图像上应用去噪器,结合随机正则化与梯度下降求解逆问题,在去模糊和修复任务上达到SOTA。

详情

展开后加载摘要…

URL PDF HTML 收藏