arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-07-14 至 2026-07-14 共收录 159 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 123 篇

2603.08825 2026-07-14 cs.LG cs.AI 版本更新 50%

Local Message-Passing for Discrete Graph Generation

可扩展编码器是否必要用于离散图生成?

Jay Revolinsky, Harry Shomer, Jiliang Tang

机构 * Michigan State University(密歇根州立大学) University of Texas - Arlington(德克萨斯大学-阿灵顿)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出GenGNN框架,通过模块化消息传递实现高效离散图生成,展示其在Tree、Planar和分子生成任务中的高有效性及速度优势。

Comments 11 pages, 6 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05576 2026-07-14 cs.RO 版本更新 50%

Task Parameter Extrapolation via Learning Inverse Tasks from Forward Demonstrations

通过从正向演示中学习逆向任务进行任务参数外推

Serdar Bahar, Fatih Dogangun, Matteo Saveriano, Yukie Nagai, Emre Ugur

机构 * Bogazici University(博雅科技大学) University of Trento(特伦托大学) The University of Tokyo(东京大学)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种基于任务逆向学习的联合学习方法,通过利用辅助正向演示实现准确且高效的知识转移,以解决机器人学习中的泛化问题。

Comments Accepted for publication in IEEE RA-L

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13010 2026-07-14 cs.LG 版本更新 50%

Probabilistic Wind Power Forecasting with Tree-Based Machine Learning and Weather Ensembles

基于树形机器学习和天气集成的概率风力发电预测

Max Bruninx, Diederik van Binsbergen, Timothy Verstraeten, Ann Nowé, Jan Helsen

机构 * Vrije Universiteit Brussel(布鲁塞尔自由大学) Norwegian University of Science and Technology(挪威科学技术大学)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出利用树形机器学习和天气集成方法,提高风力发电的概率预测精度,实验结果显示其在误差降低和预测准确性方面优于传统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03564 2026-07-14 cs.LG 版本更新 50%

CoGenCast: A Coupled Autoregressive-Flow Generative Framework for Time Series Forecasting

CoGenCast:用于时间序列预测的耦合自回归流生成框架

Mingyue Cheng, Yaguo Liu, Daoyu Wang, Xiaoyu Tao, Qi Liu

机构 * State Key Laboratory of Cognitive Intelligence, University of Science and Technology of China(认知智能国家重点实验室,中国科学技术大学)

专题命中 扩散模型 :diffusion(abstract)

AI总结 针对时间序列预测需兼顾语义理解与随机建模的问题,提出CoGenCast框架,将预训练大语言模型与流匹配机制结合,通过修改注意力拓扑重配置模型,集成流匹配机制捕捉动态,实现多模态预测和跨域统一训练,实验显示性能具竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17090 2026-07-14 cs.LG cs.AI 版本更新 50%

SFO: Learning PDE Operators via Spectral Filtering

SFO:通过谱滤波学习偏微分方程算子

Noam Koren, Rafael Moschopoulos, Kira Radinsky, Elad Hazan

机构 * Technion - Israel Institute of Technology(技术离子-以色列理工学院) Princeton University(普林斯顿大学)

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究如何让神经算子有效捕捉偏微分方程解映射中的长程非局部相互作用,提出谱滤波算子SFO,利用通用谱基参数化积分核,通过学习快速衰减特征值的谱系数实现高效表示,在六个基准测试中达最优精度,大幅降误差并减少参数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00377 2026-07-14 cs.CR cs.CY 50%

Measuring Memecoin Fragility

衡量加密货币碎片化

Yuexin Xiang, Qishuang Fu, Yuquan Li, Qin Wang, Tsz Hon Yuen, Jiangshan Yu

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出ME2F框架,通过三个维度评估加密货币生态系统的脆弱性,揭示政治主题代币的高风险及主流代币的韧性。

Journal ref 2026 IEEE International Conference on Blockchain and Cryptocurrency (ICBC), Brisbane, Australia, 2026, pp. 1-5

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18381 2026-07-14 stat.ME stat.AP stat.CO 版本更新 50%

Efficient Inference in First Passage Time Models

首次通过时间模型中的高效推理

Sicheng Liu, Alexander Fengler, Michael J. Frank, Matthew T. Harrison

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究首次通过时间模型中广义漂移扩散模型似然函数计算难题,提出基于满足切尔卡索夫条件的随机微分方程的快速灵活算法,该算法能准确计算似然且速度优于现有方法。

Comments 40 pages, 10 figures (incl. appendix); final revised version

Journal ref Statistics and computing, 36(3), 101 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20159 2026-07-14 math.NA cs.NA 版本更新 50%

IEnSF: Iterative Ensemble Score Filter for Reducing Error in Posterior Score Estimation in Nonlinear Data Assimilation

IEnSF:用于减少非线性数据同化中后验分数估计误差的迭代集成分数滤波器

Zezhong Zhang, Feng Bao, Guannan Zhang

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究针对非线性数据同化中后验分数估计误差问题,提出迭代集成分数滤波器(IEnSF),通过迭代算法改进似然分数函数条件期望近似准确性,减少估计误差,提高跟踪高维动力系统的精度。

Comments 38 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.05845 2026-07-14 math.PR 版本更新 50%

McKean-Vlasov SDEs with Bounded Measurable Interaction

具有有界可测相互作用的McKean-Vlasov随机微分方程

Xing Huang

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究具有有界可测相互作用的McKean-Vlasov随机微分方程,推导其非线性半群正则性估计,分两种情况讨论,在第二种情况中扩散与分布无关,漂移含特定两项,最终基于正则性估计在该情况获$\W_1$中指数遍历性。

Comments 30 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.11642 2026-07-14 math.AP 版本更新 50%

A Unified Approach to Mixing and Regularity for Passive Scalar Transport by Sobolev Vector Fields

索伯列夫向量场被动标量输运混合与正则性的统一方法

Lucas Huysmans, Ayman Rimah Said

专题命中 扩散模型 :diffusion(abstract)

AI总结 该研究为索伯列夫向量场的被动标量输运定量估计构建新框架,基于克里斯 - 茹尔内奇异积分估计,得出稳定性估计、指数混合界等成果,涵盖解对初始数据频率依赖、正则性传播及收敛率等多方面结论。

Comments 31 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10352 2026-07-14 math.PR 版本更新 50%

Markovian Lifts of Stochastic Volterra Equations in Sobolev Spaces: Solution theory, an Ito Formula and Invariant Measures

索伯列夫空间中随机沃尔泰拉方程的马尔可夫提升:解理论、伊藤公式和不变测度

Florian Huber

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究加权索伯列夫空间中随机沃尔泰拉方程的马尔可夫提升,通过建立解理论给出不变测度条件,利用伊藤型公式发展出有限时间爆破准则等应用,为相关方程理论及应用研究提供支持。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.17953 2026-07-14 math.PR math.AP 版本更新 50%

Fluctuation Correction and Global Solutions for the Stochastic Shigesada-Kawasaki-Teramoto System via Entropy-Based Regularization

基于熵正则化的随机Shigesada-Kawasaki-Teramoto系统的涨落修正与全局解

Florian Huber

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究n物种SKT交叉扩散系统随机扩展,通过乘性噪声项进行涨落修正,在扩散系数细致平衡及相关小性条件下,建立随机偏微分方程系统非负、全局、弱鞅解的存在性,该理论在确定性平均场极限附近微扰区域成立。

Comments arXiv admin note: text overlap with arXiv:2202.12602 (same author) Derivation section split off, becomes companion paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.06064 2026-07-14 cond-mat.dis-nn quant-ph 50%

Quantum Avalanches in $\mathbb{Z}_2$-preserving Interacting Ising Majorana Chain

$\mathbb{Z}_2$保持相互作用伊辛马约拉纳链中的量子雪崩

Lv Zhang, Kai Xu, Heng Fan

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究发现$\mathbb{Z}_2$保持相互作用伊辛马约拉纳链在有限尺寸下存在量子雪崩机制,导致MBL相不稳定。

Journal ref Scientific Reports 16, 2819 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.12921 2026-07-14 math.NA cs.NA 50%

A hypocoercivity-exploiting stabilised finite element method for Kolmogorov equation

利用隐偏导数性质的稳定有限元方法求解柯尔莫哥洛夫方程

Zhaonan Dong, Emmanuil H. Georgoulis, Philip J. Herbert

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种稳定有限元方法,通过数值隐偏导数性质求解柯尔莫哥洛夫方程,克服退化扩散问题并保证稳健性。

Comments 23

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.13935 2026-07-14 math.AP q-bio.PE 50%

Pulled, pushed or failed: the demographic impact of a gene drive can change the nature of its spatial spread

被拉、被推或失败:基因驱动的种群影响可以改变其空间扩散的性质

Léna Kläy, Léo Girardin, Vincent Calvez, Florence Débarre

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究基因驱动在不同种群增长率下的空间扩散机制,揭示其传播方式受种群动态影响的条件。

Comments 21 pages, 6 figures, appendix

Journal ref J Math Biol . 2023 Jul 16;87(2):30

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 可控生成 6 篇

2607.10243 2026-07-14 cs.RO cs.SY eess.SY 新提交 78%

Diffusion-Residual Model Predictive Steering Control for Vehicle Stabilization at the Limit of Handling under Model Uncertainty

模型不确定性下车辆极限操控时基于扩散残差模型预测的转向控制实现车辆稳定

Bongsob Song

机构 * Ajou University(韩国亚洲大学)

专题命中 可控生成 :diffusion(title,abstract)

AI总结 研究在模型不确定性下车辆极限操控时的稳定问题,核心方法是用条件扩散残差模型学习不确定性并应用于控制器参考值和约束,主要贡献是降低峰值侧滑、恢复低摩擦操控方向稳定性,且算法运行高效。

Comments 16 pages, 6 figures, 7 tables. Submitted to IEEE Transactions on Control Systems Technology

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09588 2026-07-14 eess.IV q-bio.QM 版本更新 78%

Diffusion-Based Quality Control of Medical Image Segmentations across Organs

基于扩散的质量控制用于跨器官医学图像分割

Vincenzo Marcianò, Hava Chaptoukaev, Virginia Fernandez, M. Jorge Cardoso, Sébastien Ourselin, Michela Antonelli, Maria A. Zuluaga

专题命中 可控生成 :diffusion(title,abstract)

AI总结 本文提出nnQC框架,通过扩散生成模型实现跨器官医学图像分割的质量控制,有效解决现有方法的通用性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10537 2026-07-14 cs.SD cs.MM eess.AS 新提交 57%

Dance to Music Generation leveraging Pre-training with Unpaired data and Contrastive Alignment

利用未配对数据和对比对齐进行预训练的舞蹈音乐生成

Ryota Kimura, Sangheon Park, Natalia Polouliakh, Taketo Akama

机构 * Sony Computer Science Laboratories(索尼计算机科学实验室) Keio University(庆应义塾大学) Georgia Institute of Technology(佐治亚理工学院)

专题命中 可控生成 :diffusion(abstract);分类 cs.MM

AI总结 针对舞蹈音乐生成中高质量配对数据稀缺问题,提出利用未配对和配对数据的框架,结合预训练单峰编码器、对比预训练及控制网络模块,实验证明该方法提升了舞蹈音乐对齐和音频质量,优于现有技术。

Comments 7 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10625 2026-07-14 cs.RO 新提交 50%

Dual-Process Atomic Skill Learning: Decoupling Semantic Reasoning and Real-Time Control

双过程原子技能学习:解耦语义推理与实时控制

Jun Chen, Erdent Bao, Wenlong Dong, Jierui Liu, Qi Cai, Hao Wan, Shaopeng Li, Weijun Qin, Jing Liang, Huiping Zhuang

机构 * University of Electronic Science and Technology of China(电子科技大学) Huazhong University of Science and Technology(华中科技大学) Southern University of Science and Technology(南方科技大学) South China University of Technology(华南理工大学) EbTech Co. Ltd.(依比特科技有限公司)

专题命中 可控生成 :diffusion(abstract)

AI总结 研究针对语言条件模仿学习推广到多步组合任务的挑战,提出双过程原子技能学习框架DASL,通过解耦语义推理与实时控制,含低频和高频策略,有效减轻技能码本干扰问题,性能显著优于现有基线。

Comments 28 pages,20 figures,21 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10550 2026-07-14 quant-ph 新提交 50%

Coherent Quantum Schrodinger Bridge: Two-Boundary Optimal Control for Quantum Algorithm Design

相干量子薛定谔桥:量子算法设计的双边界最优控制

Masayuki Ohzeki

专题命中 可控生成 :diffusion(abstract)

AI总结 研究将量子算法双边界过程视为相干量子薛定谔桥,利用阿哈罗诺夫双态矢量和庞特里亚金原理得出最优哈密顿量,应用此框架重构多种算法,将不同算法范式统一为选择边界条件和实现最优流的几何原理。

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06558 2026-07-14 cs.RO 版本更新 50%

RynnWorld-Teleop: An Action-Conditioned World Model for Digital Teleoperation

RynnWorld-Teleop:用于数字遥操作的动作条件世界模型

Haoyu Zhao, Xingyue Zhao, Hangyu Li, Biao Gong, Kehan Li, Siteng Huang, Xin Li, Deli Zhao, Zhongyu Li

机构 * DAMO Academy, Alibaba Group(达摩院,阿里巴巴集团) Hong Kong Embodied AI Lab(香港具身人工智能实验室) CUHK(香港中文大学) Hupan Lab(湖畔实验室) Alibaba Group(阿里巴巴集团) Ant Group(蚂蚁集团)

专题命中 可控生成 :diffusion(abstract)

AI总结 研究针对机器人学习数据收集瓶颈,提出数字遥操作范式,用生成世界模型解耦数据收集与物理约束。以RynnWorld-Teleop系统实现,含多种技术,能实时生成,训练策略可零样本转移,还能增强数据集,是高保真可扩展数据引擎。

Comments Project Page: https://alibaba-damo-academy.github.io/RynnWorld-Teleop.github.io, Github: https://github.com/alibaba-damo-academy/RynnWorld-Teleop

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 图像修复 3 篇

2607.10140 2026-07-14 cs.CV cs.AI 新提交 83%

FlowPainter: Inpainting Optical Flow via Confidence-Guided Completion

FlowPainter:通过置信度引导完成来修复光流

Yuang Meng, Chenyang Wu, Xianshun Liu, Chun-Le Guo, Zichen Liang, Lina Lei, Jie Liang, Hui Zeng, Chongyi Li, Lei Zhang

机构 * Nankai University(南开大学) The Hong Kong Polytechnic University(香港理工大学) OPPO Research Institute(OPPO研究院)

专题命中 图像修复 :inpainting(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 研究光流估计问题,提出FlowPainter框架,结合迭代优化和扩散估计范式,用轻量级置信度感知网络区分区域,通过置信度引导完成光流修复,实验表明其在可比训练下精度高、收敛快。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08765 2026-07-14 cs.CV 版本更新 57%

Enhancing In-context Panoramic Generation via Geometric-aware Pretraining

通过几何感知预训练增强上下文全景生成

Haoran Feng, Ruiyang Zhang, Longyi Zhang, Dizhe Zhang, Lu Qi

机构 * Insta360 Research(影石创新研究院) Tsinghua University(清华大学) Beihang University(北京航空航天大学) Wuhan University(武汉大学)

专题命中 图像修复 :inpainting(abstract);分类 cs.CV

AI总结 该研究提出两阶段框架Canvas360用于上下文全景生成,结合几何感知预训练与微调。通过构建数据集及特定建模方法,增强文本到全景生成,经实验验证其能提高全景图像保真度,在相关指标上表现优异。

Comments Project page: https://zry000.github.io/Canvas360/ Github: https://github.com/Insta360-Research-Team/Canvas360

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01581 2026-07-14 cs.CV 版本更新 57%

Satellite-Free Training for Drone-View Geo-Localization

无需卫星的无人机视角地理定位

Tao Liu, Yingzhi Zhang, Kan Ren, Xiaoqi Zhao

机构 * Nanjing University of Science and Technology(南京理工大学) University of Tsukuba(筑波大学) Nanyang Technological University(南洋理工大学)

专题命中 图像修复 :inpainting(abstract);分类 cs.CV

AI总结 本文提出无需卫星数据的训练框架,通过三维场景重建、伪正射影像生成和特征聚合,提升无人机在无GPS环境下的地理定位性能。

Comments Withdrawn by the authors to allow for substantial revision in light of valuable reviewer feedback. A thoroughly revised version may be submitted in the future

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 个性化与一致性 7 篇

2607.11885 2026-07-14 cs.CV cs.GR 新提交 84%

Latent-Identity Tuning in Text-to-Image Personalization Models

文本到图像个性化模型中的潜在身份调整

Daniel Garibi, Ronen Kamenetsky, Hadar Averbuch-Elor, Daniel Cohen-Or, Or Patashnik

机构 * Tel Aviv University(特拉维夫大学) Cornell University(康奈尔大学)

专题命中 个性化与一致性 :text-to-image(title,abstract);image editing(abstract);分类 cs.CV、cs.GR

AI总结 研究文本到图像个性化模型中细粒度身份调整问题,利用预训练冻结编码器潜在空间,无需额外训练,通过揭示潜在语义方向实现局部、细粒度且语义连贯的面部编辑,经实验验证有效。

Comments Project page at: https://garibida.github.io/IdentityTuning/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10538 2026-07-14 cs.HC cs.CV cs.CY 新提交 79%

Navigating the Open-Source Model Ecosystem: An Empirical Study of Creator Practices in Artistic Image Generation

探索开源模型生态系统:艺术图像生成中创作者实践的实证研究

Yiluo Wei, Yupeng He, Qiming Ye, Gareth Tyson

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))

专题命中 个性化与一致性 :image generation(title,abstract);分类 cs.CV

AI总结 本文针对开源图像生成生态系统中创作者模型使用行为展开实证研究,构建含600万张图像及生成元数据的数据集,关联基础模型与LoRA模型使用情况,揭示其优劣势,公开数据集,为创作者和研究人员提供参考。

Comments Accepted to MM'26: The 34th ACM International Conference on Multimedia

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10165 2026-07-14 cs.CV cs.AI 新提交 79%

EmoStyle: Affective Conditioning of Style-Specialist Experts for Emotional Image Generation

EmoStyle:用于情感图像生成的风格专家情感调节

Dexiang Hong, Yijie Guo, Weidong Chen, Xinyan Liu, Zixuan Zou, Zhendong Mao, Yongdong Zhang

机构 * University of Science and Technology of China(中国科学技术大学) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 个性化与一致性 :image generation(title,abstract);分类 cs.CV

AI总结 针对情感感知艺术图像生成中训练与测试时属性不一致造成的控制差距问题,提出EmoStyle框架,利用语言模型推理器预测情感线索,编码情感字段指导生成,训练专用LoRA适配器结合风格表达情感,经视觉语言模型引导排序,在挑战赛中获佳绩。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10370 2026-07-14 cs.CV cs.GR 新提交 62%

Neural Motion Blending Across Arbitrary Character Topologies

跨任意角色拓扑的神经运动混合

Luca Cazzola, Giulia Martinelli, Nicola Conci

机构 * University of Trento(特伦托大学) CNIT(意大利国家信息与电信研究所)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.GR

AI总结 研究针对角色动画运动混合,提出跨异构骨架的新框架,结合语义编码器与基于扩散的解码器,通过插值潜在表示实现混合运动,在Truebones Zoo数据集上训练评估,能在多样场景中实现平滑合理的运动混合。

Comments To appear in the proceedings of Computer Graphics International (CGI 2026). For references, please cite the official proceedings version. Paper website: https://mmlab-cv.github.io/neural_motion_blending/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06280 2026-07-14 cs.CV 版本更新 57%

Eulerian Motion Guidance: Robust Image Animation via Bidirectional Geometric Consistency

欧拉运动引导:基于双向几何一致性的鲁棒图像动画

Thong Nguyen, Khoi M. Le, Cong-Duy Nguyen, Luu Anh Tuan, See-Kiong Ng, Chunyan Miao

机构 * National University of Singapore(新加坡国立大学) Centre for AI Research, VinUniversity(Vin大学人工智能研究中心) Nanyang Technological University(南洋理工大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 提出使用相邻帧欧拉运动场引导生成,并通过双向几何一致性机制解决遮挡问题,实现加速训练、保持时间连贯性和减少动态伪影。

Comments Accepted by ACM MM 2026. Code is available at https://github.com/nguyentthong/eulerian_motion_guidance

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10820 2026-07-14 stat.ME 新提交 50%

Causal Estimation of Share-Induced Engagement with Flywheel Effects

基于飞轮效应的分享诱导参与度的因果估计

Weitao Cheng, Yilin Li, Yong Wang, Nian Si

专题命中 个性化与一致性 :diffusion(abstract)

AI总结 研究在线平台分享功能的飞轮效应,开发考虑干扰的实验框架,提出基于流量平衡恒等式的估计器,降低偏差,建立A/A测试程序,扩展到用户级指标,并用真实平台验证方法。

Comments Accepted by KDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏