arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-05-01 至 2026-05-01 共收录 60 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 48 篇

2512.14345 2026-05-01 cond-mat.stat-mech math-ph math.MP 50%

Age-structured hydrodynamics of ensembles of anomalously diffusing particles with renewal resetting

具有刷新重置的异常扩散粒子群体的年龄结构流体动力学

Baruch Meerson, Ohad Vilk

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文发展了描述大量异常扩散粒子在随机刷新重置下集体行为的年龄结构流体动力学理论,分析了三种重置协议下的稳态密度,发现不同模型下稳态密度特征各异。

Comments 10 pages, 6 figures

Journal ref Phys. Rev. Research 8, 023103 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21087 2026-05-01 eess.AS cs.LG cs.SD 50%

Are Modern Speech Enhancement Systems Vulnerable to Adversarial Attacks?

现代语音增强系统是否易受对抗攻击?

Rostislav Makarov, Lea Schönherr, Timo Gerkmann

机构 * Signal Processing (SP), University of Hamburg, Germany(汉堡大学信号处理系,德国) CISPA Helmholtz Center for Information Security, Germany(德国海德堡信息安全研究中心)

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究揭示现代语音增强系统存在对抗攻击漏洞,展示对抗噪声可改变语义,同时指出扩散模型具有固有鲁棒性。

Comments Copyright 2026 IEEE. Personal use of this material is permitted. Permission from IEEE must be obtained for all other uses, in any current or future media, including reprinting/republishing this material for advertising or promotional purposes, creating new collective works, for resale or redistribution to servers or lists, or reuse of any copyrighted component of this work in other works

Journal ref Proc. ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06753 2026-05-01 cs.DL 50%

Influential scientists shape knowledge flows between science and IGO policy

在科学与政府间组织政策之间塑造知识流动的科学家

Kimitaka Asatani, Yurie Iwata, Yuta Tomokiyo, Basil Mahfouz, Masaru Yarime, Ichiro Sakata

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究通过分析科学论文与政策文件的关联,识别出影响政策的科学家群体,揭示其在知识流动中的核心作用及跨领域影响力差异。

Journal ref Proc. Natl. Acad. Sci. U.S.A. 123(17), e2514861123 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00718 2026-05-01 math.PR cs.NA math.DS math.NA 50%

Path-Kernel Method for Differentiating Unstable Diffusions

路径核方法用于区分不稳定的扩散

Angxiu Ni

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出路径核方法用于计算随机微分方程参数导数,通过渐进移动导数从路径扰动到核微分,不假设双曲性,提供新的计算工具用于优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27603 2026-05-01 stat.CO 50%

Martingale Posteriors for Discretely Observed Diffusions

对离散观测扩散过程的martingale后验

Jingning Yao, Ajay Jasra, Sheng Jiang

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究低频观测扩散过程的参数估计,提出一种新的martingale后验方法,通过数值近似转移密度,实现高效率的参数估计,相比传统MCMC方法有数量级的提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27558 2026-05-01 physics.comp-ph cs.NA math.NA physics.optics 50%

Computation of frequency- and time-domain Jacobians in optical tomography with Monte Carlo simulations

在光学层析成像中利用蒙特卡罗模拟计算频域和时域雅可比矩阵

Pauliina Hirvi, Jaakko Olkkonen, Qianqian Fang, Ilkka Nissilä

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出利用蒙特卡罗模拟计算频域和时域雅可比矩阵的方法,通过高斯-塞德尔迭代法和有限元方法验证结果,强调蒙特卡罗方法在低散射域的重要性。

Comments The manuscript contains 33 pages and 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27459 2026-05-01 quant-ph 50%

Galilean boost invariance does not survive the trace: symmetry breaking in open quantum systems

伽利略boost不变性不存活于迹:开放量子系统中的对称性破缺

Leonardo F. Calderón, Esteban Marulanda, Santiago Morales, Leonardo A. Pachón

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究揭示了伽利略不变性在开放量子系统中因耗散反交换项破坏,波动-耗散定理与减少的boost协变性无法共存,冷原子和超冷分子处于临界点,参数驱动抑制了boost破坏。

Comments 6 pages, 1 figure, Supplemental Material included

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27444 2026-05-01 physics.plasm-ph 50%

Electrothermal Dynamics of Cold Front in Impure Tokamak Plasmas

不纯等离子体中冷锋的电热动力学

S. Oshiro, A. Matsuyama, Y. Nakamura

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究冷锋区域电流密度扰动的电热动力学,揭示电流密度分布变化与等离子体输运机制的关系。

Comments 12 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27196 2026-05-01 math.ST stat.TH 50%

Technical Note on Relating Scores of Tilted Distributions

关于倾斜分布分数关系的技术说明

Curtis McDonald

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文扩展了线性倾斜分数与原始密度卷积关系的研究,探讨了常数负对角倾斜对分数的影响,为基于分数的扩散社区提供了新的分数估计方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27127 2026-05-01 math.OC 50%

Explainable Artificial Intelligence for Financial Integral Equations: A Fixed-Point Neural Operator Approach

可解释人工智能用于金融积分方程:一种固定点神经算子方法

Sanjay Kumar Mohanty

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出利用固定点神经算子方法解决随机Fredholm积分方程和随机深度神经网络,通过积分算子的迭代结构模拟神经网络的分层架构,并应用于Black-Scholes方程、金融网络传染动态及Merten跳跃扩散方程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27114 2026-05-01 cond-mat.mtrl-sci 50%

Contrasting Effects of Functionalization in Binary and Medium-Entropy MXene Coatings for Corrosion Protection

二元和中熵MXene涂层在防腐中的对比效应

Aqsa Fayyaz, Ulises Martin Diaz, Jianyu Dai, Homero Castaneda, Chenglin Wu

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究通过多层环氧涂层结合四种MXene系统,探讨功能化对防腐性能的影响,发现P-Ti3C2Tx具有最强的防腐性能,DFT计算揭示表面化学、电子结构和熵在设计下一代防腐涂层中的关键作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27104 2026-05-01 cs.IT math.IT 50%

Low-Complexity Run-Length-Limited ISI-Mitigation (RLIM) Codes for Molecular Communication

低复杂度的运行长度受限干扰抑制(RLIM)码用于分子通信

Melih Şahin, Ozgur B. Akan

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种低复杂度的RLIM码,通过覆盖排名框架和恒定重量计数减少存储需求,提升分子通信的误码率性能。

Comments 9 pages, 3 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26602 2026-05-01 astro-ph.GA astro-ph.SR 50%

The intrinsic dispersion of elemental abundance ratios in nearby metal-poor halo stars

邻近金属贫淡星系中元素丰度比的内在散射

Poul Erik Nissen, Anish Amarsi

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究通过高信噪比光谱分析25颗金属贫乏恒星的元素丰度比,发现其内在散射比以往研究小,且存在不同元素的强相关性。

Comments Accepted for publication in A&A, 15 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01444 2026-05-01 cs.LG 50%

Autoregressive Synthesis of Sparse and Semi-Structured Mixed-Type Data

自回归合成稀疏和半结构化混合类型数据

Thomas Rückstieß, Robin Vujanic

机构 * Independent Researcher(独立研究者)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出ORiGAMi模型,通过自回归Transformer架构实现半结构化记录的建模与合成,无需扁平化处理,提升隐私保护和基准性能。

Comments Under Submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05052 2026-05-01 cs.LG stat.ML 50%

DeepWeightFlow: Re-Basined Flow Matching for Generating Neural Network Weights

DeepWeightFlow:基于重新基化流匹配的神经网络权重生成

Saumya Gupta, Scott Biggs, Moritz Laber, Zohair Shafi, Robin Walters, Ayan Paul

机构 * Northeastern University(东北大学)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出DeepWeightFlow,通过在权重空间中直接生成多种架构和规模的神经网络权重,提升生成效率和准确性,无需微调且能处理大规模模型。

Comments 25 pages, 20 tables, 2 figures

Journal ref The Fourteenth International Conference on Learning Representations (ICLR 2026): https://openreview.net/forum?id=fOwsr1VTi8

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16224 2026-05-01 eess.SP 50%

Simultaneous Secrecy and Covert Communications (SSACC) in Mobility-Aware RIS-Aided Networks

在面向移动性的RIS辅助网络中同时实现保密和隐秘通信(SSACC)

Yanyu Cheng, Yujian Hu, Haoran Liu, Hua Zhong, Wei Wang, Pan Li

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种在可重构智能表面(RIS)辅助网络中结合保密和隐秘通信的方案,通过最大化保密容量和检测错误概率(DEP)来增强通信安全,利用生成扩散模型(GDM)和深度强化学习(DRL)设计算法,平衡AMDEP和ASC,验证了其在安全与容量性能上的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05471 2026-05-01 cond-mat.stat-mech cond-mat.soft 50%

Observation-Time-Induced Crossover from Fluctuating Diffusivity

观察时间诱导的从波动扩散系数的 crossover

Masahiro Shirataki, Takuma Akimoto

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究揭示了在 Langevin 框架下,波动扩散系数自然导致观察时间诱导的扩散 crossover,通过分析和数值分析阐明了 crossover 机制并识别了其出现的最小条件,确立了观察时间诱导的 crossover 作为非平衡现象。

Comments 16 pages, 10 figures

Journal ref Phys. Chem. Chem. Phys., 28, 8692 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01887 2026-05-01 physics.chem-ph physics.atm-clus physics.plasm-ph 50%

Modeling formation and transport of clusters at high temperature and pressure gradients by implying partial chemical equilibrium

通过引入局部部分化学平衡来建模高温高压梯度下簇团的形成与传输

Eugene V. Stepanov, Alexander F. Gutsol

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种理论方法,用于描述不同大小簇团作为单一物种在气体中的传输,通过局部部分化学平衡假设,推导了有效扩散系数和热扩散系数的解析表达式,并应用于硫化氢在离心等离子-化学反应器中的转化技术。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16115 2026-05-01 econ.EM stat.AP 50%

A Korean Macroeconomic Database for Data-Rich Policy Analysis and U.S.--Korea Dependence

一个韩国宏观经济数据库用于数据丰富的政策分析和美韩依赖性

Changryong Baek, Seunghyun Moon, Seunghyeon Lee

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文介绍KRED数据库,用于数据丰富的政策分析和跨国比较,通过主成分分析提取四个因素,揭示美韩经济依赖性及跨国家依赖性特征。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07798 2026-05-01 cond-mat.mtrl-sci cs.LG 50%

Generative Inversion for Property-Targeted Materials Design: Application to Shape Memory Alloys

面向性能目标的材料设计生成性反向设计:应用于形状记忆合金

Cheng Li, Pengfei Danga, Yuehui Xiana, Yumei Zhou, Bofeng Shi, Xiangdong Ding, Jun Suna, Dezhen Xue

机构 * State Key Laboratory for Mechanical Behavior of Materials, Xi'an Jiaotong University, Xi'an 710049, China(材料机械行为国家重点实验室,西安交通大学,西安710049,中国)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出基于生成对抗网络反向设计的框架,用于设计高性能形状记忆合金,通过梯度优化生成满足性能目标的合金成分和工艺参数,并通过实验验证了其有效性。

Journal ref Advanced Functional Materials (2026): e27774

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07986 2026-05-01 cs.LG cs.AI 50%

EXPO: Stable Reinforcement Learning with Expressive Policies

EXPO: 通过表达性策略进行稳定的强化学习

Perry Dong, Qiyang Li, Dorsa Sadigh, Chelsea Finn

机构 * Stanford University(斯坦福大学) UC Berkeley(加州大学伯克利分校)

专题命中 扩散模型 :diffusion(abstract)

AI总结 EXPO通过构建实时策略最大化Q值,提升样本效率,适用于基于离线数据的策略微调和在线训练。

Comments changed formatting, added code

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 可控生成 3 篇

2604.28169 2026-05-01 cs.CV cs.AI cs.LG 57%

PhyCo: Learning Controllable Physical Priors for Generative Motion

PhyCo:学习可控制的物理先验以生成运动

Sriram Narayanan, Ziyu Jiang, Srinivasa Narasimhan, Manmohan Chandraker

机构 * Carnegie Mellon University(卡内基梅隆大学) NEC Labs America(NEC美国实验室) UC San Diego(圣地亚哥大学)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 PhyCo通过整合物理可控的生成模型,实现了在视频生成中物理一致性和可控性的提升,无需模拟器或几何重建。

Comments CVPR 2026. Project Page: https://phyco-video.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27700 2026-05-01 q-fin.MF 50%

Data-Driven Stochastic Optimal Control for Intraday Electricity Trading by Renewable Producers

数据驱动的随机最优控制用于日内电力交易:可再生能源生产者

Chiheb Ben Hammouda, Michael Samet, Raúl Tempone

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出了一种数据驱动的连续时间随机最优控制框架,用于可再生能源生产者的日内电力交易,通过随机微分方程和跳跃扩散模型来应对市场波动和不平衡惩罚风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27002 2026-05-01 cs.CR 50%

Membership Inference Attacks Against Video Large Language Models

针对视频大语言模型的成员推断攻击

Wei Song, Yuxin Cao, Ziqi Ding, Yi Liu, Gelei Deng, Yuekang Li

专题命中 可控生成 :image generation(abstract)

AI总结 本文研究了针对视频大语言模型的黑盒成员推断攻击,通过温度扰动生成与视频感知难度特征结合,验证了视频大语言模型对隐私风险的脆弱性。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 图像生成评测 1 篇

2604.27958 2026-05-01 cs.CV 57%

TripVVT: A Large-Scale Triplet Dataset and a Coarse-Mask Baseline for In-the-Wild Video Virtual Try-On

TripVVT:一个大规模三元组数据集和一个粗略遮罩基线用于真实场景视频虚拟试穿

Dingbao Shao, Song Wu, Shenyi Wang, Ye Wang, Ziheng Tang, Fei Liu, Jiang Lin, Xinyu Chen, Qian Wang, Ying Tai, Jian Yang, Zili Yi

机构 * Nanjing University, China(南京大学) JIUTIAN Research, CMCC, China(JIUTIAN研究院,CMCC,中国) Jilin University, China(吉林大学) ByteDance Inc., China(字节跳动公司)

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV

AI总结 本文提出TripVVT-10K数据集和TripVVT框架,通过改进的遮罩先验提升视频虚拟试穿的鲁棒性和质量,同时建立评估基准以验证其在复杂场景中的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 效率与蒸馏 3 篇

2512.14067 2026-05-01 cs.CL cs.AI cs.LG 78%

Efficient-DLM: From Autoregressive to Diffusion Language Models, and Beyond in Speed

Efficient-DLM:从自回归到扩散语言模型,以及速度上的突破

Yonggan Fu, Lexington Whalen, Zhifan Ye, Xin Dong, Shizhe Diao, Jingyu Liu, Chengyue Wu, Hao Zhang, Enze Xie, Song Han, Maksim Khadkevich, Jan Kautz, Yingyan Celine Lin, Pavlo Molchanov

机构 * Georgia Tech(佐治亚理工学院) University of Chicago(芝加哥大学) University of Hong Kong(香港大学) MIT(麻省理工学院)

专题命中 效率与蒸馏 :diffusion(title,abstract)

AI总结 本文提出Efficient-DLM方法,通过改进自回归到扩散语言模型的转换,提升生成速度并保持任务准确性,实验显示其在精度和效率上优于现有模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.28126 2026-05-01 cs.CV cs.AI 57%

AdvDMD: Adversarial Reward Meets DMD For High-Quality Few-Step Generation

AdvDMD:对抗性奖励与DMD结合实现高质量少步生成

Xu Wang, Zexian Li, Litong Gong, Tiezheng Ge, Zhijie Deng

机构 * Shanghai Jiao Tong University(上海交通大学) Alimama Tech(阿里巴巴技术)

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

AI总结 本文提出AdvDMD方法,结合DMD蒸馏与强化学习,通过对抗训练的判别器作为奖励模型,提升少步生成质量并稳定训练过程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20549 2026-05-01 cs.LG cs.CV stat.ME 57%

Sample-efficient evidence estimation of score based priors for model selection

基于扩散先验的模型选择中高效证据估计

Frederic Wang, Katherine L. Bouman

机构 * Department of Computing and Mathematical Sciences(计算与数学科学系)

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

AI总结 本文提出DiME方法,通过整合后验采样方法的时间边际,利用逆扩散采样过程中的大量中间样本,高效估计扩散先验的模型证据,用于模型选择和先验误拟诊断。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 其他图像生成 2 篇

2604.27804 2026-05-01 cs.CV cs.CR cs.LG 57%

Machine Unlearning for Class Removal through SISA-based Deep Neural Network Architectures

通过基于SISA的深度神经网络架构实现类别移除的机器无学习

Ishrak Hamim Mahi, Siam Ferdous, Md Sakib Sadman Badhon, Nabid Hasan Omi, Md Habibun Nabi Hemel, Farig Yousuf Sadeque, Md. Tanzim Reza

机构 * Department of Computer Science and Engineering(计算机科学与工程系) Brac University(布拉大学) Dhaka, Bangladesh(孟加拉国达卡)

专题命中 其他图像生成 :image generation(abstract);分类 cs.CV

AI总结 本文提出一种改进的SISA框架,用于在卷积神经网络中实现类别级无学习,通过增强的重放机制和门控网络提升选择性遗忘效率,实验表明该方法能有效移除特定类别数据并保持模型性能。

Comments 10 pages, 9 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15641 2026-05-01 cs.CR 50%

ComMark: Covert and Robust Black-Box Model Watermarking with Compressed Samples

ComMark:基于压缩样本的隐蔽且鲁棒的黑盒模型水印技术

Yunfei Yang, Xiaojun Chen, Zhendong Zhao, Yu Zhou, Xiaoyan Gu, Juan Cao

专题命中 其他图像生成 :image generation(abstract)

AI总结 本文提出ComMark,一种利用频域变换生成隐蔽且抗攻击的压缩水印样本的黑盒模型水印框架,通过过滤高频信息提升隐蔽性和鲁棒性,适用于图像识别、语音识别等多种任务。

Comments Extended version of the paper accepted by ICMR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏