arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-07-30 至 2026-07-30 共收录 39 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 2 篇

2607.26647 2026-07-30 cs.CV 新提交 91%

Anchoring and Steering Diffusion: Enhancing the Faithfulness of Text-to-Image Generation at Inference Time

锚定与引导扩散:在推理时提升文生图生成的忠实度

Xinyi Wang, Yuyang Huang, Yalin Su, Pengcheng Luan, Tao Zhang, Feiming Wei, Wenxian Yu

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(title);分类 cs.CV

AI总结 提出无训练框架AnchorSteer,通过语义锚定与反射引导组件改进文生图扩散模型的推理,在GenEval等基准上提升文本-图像对齐性能且保持视觉质量。

Comments Accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26566 2026-07-30 cs.DC cs.AI 新提交 78%

ServerlessT2I: Efficient Text-to-Image Workflow Serving on a Serverless Platform

ServerlessT2I:在无服务器平台上实现高效的文生图工作流服务

Xiaoxiao Jiang, Suyi Li, Sheng Yao, Tianyu Feng, Lingyun Yang, Dapeng Nie, Haoran Yang, Wei Wang

专题命中 文生图 :text-to-image(title,abstract)

AI总结 ServerlessT2I是将T2I工作流分解为独立模型函数的无服务器系统,通过优化调度与内存利用,在相同GPU预算下提升请求率2倍,固定请求率下节省GPU资源达3倍。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 扩散模型 28 篇

2607.26735 2026-07-30 cs.CV cs.AI cs.MM 新提交 90%

Dual Inversion for Text-to-Image Diffusion Models: From Both Prompt and Noise Perspectives

文本到图像扩散模型的双重逆推:从提示与噪声双视角

Xiaolong Liu, Junjian Li, Yuan Xiao, Jiaqi Deng, Dayong Ye, Tianqing Zhu, Huan Huo

机构 * University of Technology Sydney(悉尼科技大学) Geely(吉利) City University of Hong Kong(香港城市大学) City University of Macau(澳门城市大学)

专题命中 扩散模型 :text-to-image(title,abstract);diffusion(title,abstract);image editing(abstract);分类 cs.CV、cs.MM

AI总结 该研究针对现有文本到图像扩散模型提示逆推方法的局限,提出联合恢复语义提示与潜在噪声的Dualin方法,实现了高质量逆推提示与最优图像保真度,为可控图像编辑奠定基础。

Comments Accepted by ACM MM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27036 2026-07-30 cs.CV cs.LG 新提交 81%

Mitigating Compounding Error via Video Representation Regularization

通过视频表示正则化缓解复合误差

Taiye Chen, Qi Zhang, Yisen Wang

机构 * Peking University(北京大学)

专题命中 扩散模型 :diffusion(summary_cn,abstract);分类 cs.CV

AI总结 针对视频扩散世界模型自回归生成的复合误差问题,研究发现其与表示维度崩溃相关,提出视频表示正则化方法,在VBench指标上显著优于Diffusion Forcing,提升了长视频生成的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26715 2026-07-30 cs.CV 新提交 79%

FreeShadow: Training-Free Shadow Removal via Illumination Transfer and Selective Content Preservation in Diffusion Models

FreeShadow:基于扩散模型的无需训练的光照迁移与选择性内容保留去阴影方法

Yinan Wang, Yan Huang, Yong Xu, Patrick Le Callet

机构 * School of Computer Science and Engineering, South China University of Technology(华南理工大学计算机科学与工程学院) Pazhou Lab(琶洲实验室) Polytech Nantes, Université de Nantes(南特大学南特理工学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 FreeShadow是基于预训练扩散模型的无需训练去阴影方法,通过光照迁移注意力等技术解决传统方法泛化差、易生伪影等问题,实验表明其泛化能力强且生成图像逼真。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26706 2026-07-30 cs.CV 新提交 79%

TPD: Temporal Prior Decoupling for Text-to-Video Diffusion Models

TPD:用于文本到视频扩散模型的时间先验解耦

Taewon Kang, Matthias Zwicker

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 该研究针对文本到视频扩散模型的时间先验抑制问题,提出无需训练的TPD框架,通过帧选择性下界约束恢复被抑制的后期片段信号,提升后期概念实现效果且与骨干无关。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26292 2026-07-30 cs.CV 新提交 79%

Eddeep: a deep-learning framework for fast eddy-current distortion correction in diffusion MRI

Eddeep:用于扩散MRI中快速涡流畸变校正的深度学习框架

Antoine Legouhy, Ross Callaghan, Yuchuan Qiao, Whitney Stee, Philippe Peigneux, Hojjat Azadbakht, Hui Zhang

机构 * Hawkes Institute(霍克斯研究所) University College London(伦敦大学学院) Institut Pasteur(巴斯德研究所) Université Paris Cité(巴黎西岱大学) AINOSTICS ltd.(AINOSTICS有限公司) Fudan University(复旦大学) Université Libre de Bruxelles (ULB)(布鲁塞尔自由大学) University of Liège (ULiège)(列日大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本研究针对dMRI中涡流畸变校正方法计算成本高的问题,提出深度学习框架Eddeep,其通过两阶段网络实现与FSL Eddy相当的校正质量,同时大幅缩短推理时间,为大规模研究和临床部署提供支持。

Comments Associated GitHub repo: https://github.com/CIG-UCL/eddeep

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26203 2026-07-30 cs.CV 新提交 79%

WildShadowRemover: In-the-Wild Video Shadow Removal via Detail-Preserving Video Diffusion Models

WildShadowRemover:基于细节保留视频扩散模型的野外视频阴影去除方法

Jiamin Xu, Cong Wang, Zheng Dong, Chi Wang, Renshu Gu, Weiwei Xu, Gang Xu

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 针对野外视频阴影去除难题,提出WildShadowRemover框架,通过LoRA微调适配视频扩散模型,结合细节注入、频率分解调制及Depth Anything 3深度先验,构建对应数据集,在阴影去除质量与时间一致性上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27063 2026-07-30 q-fin.TR 新提交 78%

Herding, Momentum, and Reversal in China's A-Share Market: An Agent-Based Network Model with Information Diffusion

中国A股市场的羊群效应、动量与反转:基于信息扩散的 Agent 网络模型

Jiahao Weng

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本研究构建基于Agent的金融市场模型,结合局部羊群效应与信息扩散机制,解释中国A股市场的动量与反转现象,经实证验证相关机制的互补作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27169 2026-07-30 cs.LG 新提交 78%

When Do Learned Diffusion Proposals Help Constraint Solving? A Controlled Study on Continuous Algebraic Systems

学习到的扩散提议何时有助于约束求解?针对连续代数系统的对照研究

Quang Bui, Sparsh Roy, Akash Gundimeda, Davin Yin

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本研究针对连续代数系统开展对照实验,发现学习到的扩散提议仅在高维、变量未耦合的场景下,才比随机多起点更有助于约束求解,且其优势并非适用于所有真实系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26723 2026-07-30 cs.CR cs.AI 新提交 78%

FARI: Robust One-Step Inversion for Watermarking in Diffusion Models

FARI:用于扩散模型水印的鲁棒单步反演

Jindong Yang, Han Fang, Weiming Zhang, Nenghai Yu, Kejiang Chen

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本研究提出FARI框架,通过单步反演结合轻量级对抗LoRA微调,在提升扩散模型水印验证鲁棒性的同时大幅缩短推理时间,效率与性能均优于50步DDIM反演。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26428 2026-07-30 cs.LG stat.ML 新提交 78%

Existence-Field Diffusion Model for Spatial Point Processes with Variable Cardinality

用于可变基数空间点过程的存在场扩散模型

Xiaoyin Pan, Christian R. Shelton, Rakshith Mahishi, Chengkuan Hong

机构 * University of California, Riverside(加州大学河滨分校) New York University(纽约大学) Zhongguancun Academy(中关村学院)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 该研究针对可变基数空间点过程生成建模难题,提出存在场扩散模型(EFDM),通过关联存在变量实现空间位置与基数的联合建模,在可变基数数据集上提升了建模能力。

Comments 19 pages, 9 figures, 6 tables. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27150 2026-07-30 math.PR 新提交 78%

Modelling Anomalous Diffusion: The Role of CTRWs and Non-Local Dynamics

异常扩散建模:连续时间随机游走(CTRWs)与非局部动力学的作用

Ivan Biočić, Bruno Toaldo

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文总结了基于CTRWs的异常扩散随机方法,阐述其标度极限技术、与非局部方程的联系,及涵盖通用非局部演化方程的最新成果。

Comments 67 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26459 2026-07-30 math.AP 新提交 78%

A Hamilton-Jacobi Approach to Time-Delayed Nonlocal Diffusion Models in Shifting Habitats

移位生境中时滞非局部扩散模型的哈密顿-雅可比方法

Bing-Er Jiang, King-Yeung Lam, Wan-Tong Li, Wen Tao

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 该研究采用哈密顿-雅可比方程的粘性解理论,对移位生境中时滞非局部扩散方程的传播速度分类,揭示了非局部选择机制的方向不对称性和时滞不敏感性,确定了生境锁定消除时滞减速作用的阈值条件。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26285 2026-07-30 math.ST cs.LG cs.NA math.NA stat.ML stat.TH 新提交 78%

Denoising growth complexity: Data geometry and certified schedules for diffusion sampling

去噪增长复杂度:扩散采样的数据几何与可验证调度

Martin J. Wainwright

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 该研究提出去噪增长复杂度(DGC),利用其鞅结构开发可验证扩散采样算法,推导KL误差边界,揭示适配数据几何可带来计算收益。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27093 2026-07-30 physics.flu-dyn 新提交 78%

A New Paradigm for 3D Turbomachinery Design: Generative Diffusion Model Based Framework with Direct Geometry Encoding

三维涡轮机械设计的新范式:基于直接几何编码的生成扩散模型框架

Yingfan Geng, Jinhong Wang, Lazaros Papachristodoulou, Sibo Cheng, Teng Cao

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本研究针对涡轮机械三维逆设计难题,开发了以扩散模型为核心的直接几何编码设计框架,实现高精度、多样化的三维压缩机几何生成,验证了坐标学习的可行性及方案的优异性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26341 2026-07-30 math.NA cs.NA math-ph math.MP 新提交 78%

A Cartesian Grid Method for Advection-Diffusion Equations with Robin Boundary Conditions on Moving Domains

移动域上带有Robin边界条件的对流-扩散方程的笛卡尔网格方法

Han Zhou, Yoichiro Mori, Lingxing Yao

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 该研究提出一种移动域带Robin边界的对流-扩散方程的笛卡尔网格方法,避免重网格化与切割单元,收敛性与计算效率良好,经数值例子验证有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26668 2026-07-30 math.AP 新提交 71%

On the decay estimates of a nonlocal convection-diffusion Hamer system

Timothée Crin-Barat, Belkacem Said-Houari

专题命中 扩散模型 :diffusion(title)

Comments 33 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26108 2026-07-30 cs.GR cs.LG 新提交 70%

Two2Four: Generative Quadruped Puppeteering from Human Motion

Two2Four:基于人类动作的生成式四足动物操控

Fatemeh Zargarbashi, Zehong Qiu, Dhruv Agrawal, Stelian Coros, Robert W. Sumner, Martin Guay, Jakob Buhmann

专题命中 扩散模型 :diffusion(abstract);inpainting(abstract);分类 cs.GR

AI总结 该研究提出Two2Four框架,采用两阶段生成扩散模型,可从人类动作生成可控逼真四足动物动作,用于动画和虚拟制作,效果优于现有重定向方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26646 2026-07-30 cs.CV 新提交 57%

Genie Sim PanoWorld: An Infinite Indoor 3D World Generation Pipeline via Panoramic Scene Modeling and Simulation

Genie Sim PanoWorld:基于全景场景建模与仿真的无限室内3D世界生成流水线

Yongxin Su, Linjie Hou, Feng Wang, Jialin Tang, Zhijun Li, Qian Wang, Maoqing Yao

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 Genie Sim PanoWorld是两阶段前馈流水线,从单张360°全景生成可自由导航的高保真3D高斯场景,优于几何条件基线,且能零样本泛化至未见室内场景

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26472 2026-07-30 cs.SD cs.AI 新提交 50%

Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio Deepfake Detection

用于跨域音频深度伪造检测的多比率DiT重建残差的音频锚定融合

Haotian Mo, Jie Liu, Siqi Shen, Songzhu Mei, Xinhai Chen, Xiangyang Wang, Yigui Feng, Shuai Li, Gencheng Liu, Keqi Yang, Qinglin Wang

专题命中 扩散模型 :diffusion(abstract)

AI总结 该研究针对音频深度伪造检测器跨域性能下降问题,提出音频锚定融合多比率DiT重建残差的方法,在ASVspoof 5和ITW数据集上取得优于基准的跨域检测性能。

Comments 10 pages, 5 figures. Submitted to speech security conference. This work proposes a cross-domain audio deepfake detection framework based on bona-fide trained DiT multi-ratio reconstruction residuals and audio-anchored additive fusion, evaluated on ASVspoof 5 and real-world ITW datasets

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26398 2026-07-30 cs.LG 新提交 50%

Flow Map Learning via Nongradient Vector Flow

基于非梯度向量流的流图学习

Mark Goldstein, Anshuk Uppal, Raghav Singhal, Aahlad Puli, Rajesh Ranganath

机构 * Flatiron Institute(弗拉蒂隆研究所) Technical University of Denmark(丹麦技术大学) Courant Institute, New York University(纽约大学柯朗研究所)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出SGFlow方法,绕过流图学习的可逆性与迭代微分难题,在CIFAR基准上10采样步时FID最优,其他步数具竞争力且有驻点保证。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26709 2026-07-30 math.NA cs.NA 新提交 50%

Markov Chain Approximation of Sticky Diffusions and Hamilton-Jacobi-Bellman Equations on Networks

网络上粘性扩散过程与哈密尔顿-雅可比-贝尔曼方程的马尔可夫链逼近

Alessio Basti, Jules Berry, Fabio Camilli

专题命中 扩散模型 :diffusion(abstract)

AI总结 针对带基尔霍夫与粘性顶点条件的网络扩散过程,提出离散马尔可夫链逼近方法,证明其依分布收敛,进而推导网络上哈密尔顿-雅可比-贝尔曼方程的全离散半拉格朗日格式并建立收敛性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26616 2026-07-30 math.AP 新提交 50%

Conditional hypocoercivity for nonlinear kinetic Fokker--Planck equations

非线性动力学Fokker–Planck方程的条件次协性

Jose A. Carrillo, Dowan Koo, Sihyun Song

专题命中 扩散模型 :diffusion(abstract)

AI总结 该研究针对非微扰情形下带多孔介质扩散的非线性动力学Fokker–Planck方程,结合熵-熵耗散结构与L²-次协性技术,证明其在宏观量先验条件界下可在L¹中指数收敛到平衡态。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26585 2026-07-30 math.OC 新提交 50%

Optimal control problems for quasi-linear parabolic equations and their linear approximations

拟线性抛物型方程的最优控制问题及其线性近似

Xu Liu, Meisai Wang, Xu Zhang

专题命中 扩散模型 :diffusion(abstract)

AI总结 该研究针对热扩散模型,精确了拟线性抛物型方程最优控制问题的线性近似,证明小数据下拟线性与线性问题的最优控制及轨迹差为高阶无穷小,内点情形近似阶最优。

Comments 24 pp

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26433 2026-07-30 math.AP 新提交 50%

Nonlinear quantum Fokker-Planck equation near equilibrium

平衡附近的非线性量子Fokker-Planck方程

Young-Pil Choi, Byung-Hoon Hwang, Ju-Hwan Hyun

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究平衡附近具有自洽宏观量的非线性量子Fokker-Planck方程,证明了三维全空间柯西问题强解的全局存在唯一性,给出非负性与泡利上界的传播性及代数衰减率,揭示其与量子朗道方程的关联。

Comments 66 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26965 2026-07-30 physics.plasm-ph physics.app-ph physics.data-an physics.optics 新提交 50%

Measurement of multiple mechanical properties from multi-dimensional signals in nanosecond laser ablation via PINN

基于PINN的纳秒激光烧蚀多维信号测量多种力学性能

Ying Zhou, Jian Wu, Ziyuan Song, Jinghui Li, Xinyu Guo, Hao Sun, Yuhua Hang, Cuixiang Pei, Xingwen Li

专题命中 扩散模型 :diffusion(abstract)

AI总结 该研究提出嵌入PINN的热力耦合框架,结合守恒律与多信号特征,实现纳秒激光烧蚀下钢材多种力学性能的高精度非接触反演,性能显著优于基线方法。

Comments Published in Applied Physics Letters. This is the authors' version. 6 pages, 5 figures

Journal ref Y. Zhou, J. Wu, Z.Y. Song, J.H. Li, X.Y. Guo, H. Sun, Y.H. Hang, C.X. Pei, and X.W. Li, Appl. Phys. Lett. 127 (24), 244101 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26824 2026-07-30 cond-mat.stat-mech 新提交 50%

The Role of Odd Diffusivity in Multipoint Statistics of State-Dependent Observables

奇扩散率在依赖状态的可观测量多点统计中的作用

Jong-Min Park

专题命中 扩散模型 :diffusion(abstract)

AI总结 该研究明确奇扩散系统的反常关联仅源于奇迁移率,其状态依赖可观测量统计可通过常规朗之万动力学计算,相关普适关系仍有效,且通过多种系统验证了结论。

Comments 15 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26678 2026-07-30 cond-mat.stat-mech 新提交 50%

Quantum Brownian transport in a correlated Gaussian force

关联高斯力下的量子布朗输运

Yun Jeong Kang, Seungsik Min, Sung Kyu Seo, Kyungsik Kim

专题命中 扩散模型 :diffusion(abstract)

AI总结 该研究在经典系统-环境模型中推导了关联高斯噪声下的粒子均方值表达式,发现移除Caldeira-Leggett框架耗散会产生t⁵、t³等非扩散量子输运机制。

Comments 13 pages, 2 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26930 2026-07-30 astro-ph.SR 新提交 50%

Evolutionary variations of superficial iron and calcium abundance in main sequence A stars

主序A型恒星表层铁与钙丰度的演化变化

Yu. A. Fadeyev, R. M. Bayazitov

专题命中 扩散模型 :diffusion(abstract)

AI总结 本研究通过计算含原子扩散的主序恒星演化模型,揭示主序A型恒星表层铁、钙丰度演化变化的机制,指出Am恒星与慢旋转非磁A型主序恒星起源相同,化学异常由恒星质量与年龄决定。

Comments 12 pages, 12 figures, accepted to Astronomy Letters

详情

展开后加载摘要…

URL PDF HTML 收藏