arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-06-16 至 2026-06-16 共收录 184 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 142 篇

2606.15260 2026-06-16 cs.LG cs.AI 新提交 78%

Trust-Region Diffusion Policies for Massively Parallel On-Policy RL

大规模并行在线强化学习的信任区域扩散策略

Huy Le, Onur Celik, Denis Blessing, Tai Hoang, Claas A Voelcker, Axel Brunnbauer, Felix Richter, Michael Volpp, Gerhard Neumann

机构 * University of Freiburg(弗赖堡大学) Max Planck Institute for Intelligent Systems(智能系统马克斯·普朗克研究所)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 提出TruDi方法,通过信任区域优化约束扩散轨迹的KL散度,实现大规模并行在线强化学习中的稳定训练,在73个任务中优于或持平基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15228 2026-06-16 math.AP 新提交 78%

Self-similar smoothing of a discontinuity by degenerate cross-diffusion

退化交叉扩散对间断的自相似平滑

Michael C. Dallaston

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 研究生物入侵中退化交叉扩散模型的自相似平滑现象,通过匹配渐近分析揭示间断前高度消失时传播速度的对数慢衰减,表明系统不支持紧支撑移动前沿解。

Comments 25 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15131 2026-06-16 cond-mat.stat-mech 新提交 78%

Quasiparticle Diffusion for the Toda Fluid in Equilibrium

平衡态Toda流体中的准粒子扩散

Seema Chahal, Alberto Brollo, Indranil Mukherjee, Abhishek Dhar, Anupam Kundu, Herbert Spohn

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 针对Toda流体,提出基于Lax矩阵特征向量追踪准粒子轨迹的数值方案,数值验证了准粒子的布朗运动,并计算了扩散常数,与TBA预测吻合。

Comments 19 pages+ Appendices, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14964 2026-06-16 physics.bio-ph 新提交 78%

Dependence of the extra-cellular diffusion coefficient on the fractions of neurites and cell bodies in gray matter

灰质中细胞外扩散系数对神经突和细胞体分数的依赖性

Hong-Hsi Lee, Ali Abdollahzadeh, Hansol Lee, Ricardo Coronado-Leija, Els Fieremans, Susie Y. Huang, Dmitry S. Novikov

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本研究通过有效介质理论和蒙特卡洛模拟,建立了灰质中细胞外扩散系数与细胞体及神经突体积分数之间的幂律关系,为扩散MRI协议设计提供了理论基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13140 2026-06-16 cs.SI 新提交 78%

MIDSim: Simulating Multi-Channel Information Diffusion in Social Media with LLM-Powered Multi-Agent System

MIDSim: 基于LLM多智能体系统的社交媒体多渠道信息扩散模拟

Lexi Liu, Qi Cao, Yuanhao Liu, Huawei Shen, Xueqi Cheng

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 提出LLM驱动的多智能体系统,联合建模社交与算法曝光流,模拟多渠道信息扩散,在三个真实数据集上优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10844 2026-06-16 math.OC 新提交 78%

A Stochastic Maximum Principle for Partially Observed Jump-Diffusion Systems with State-Dependent Counting-Process Observations

部分观测跳扩散系统带计数过程观测的随机最大值原理

Jie Xiong, Ying Yang

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 针对观测为计数过程的部分观测跳扩散系统,通过参考概率测度转化为完全观测条件分布问题,推导出随机最大值原理,并应用于线性二次型金融执行问题,得到闭式Riccati反馈律。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08008 2026-06-16 math.PR 新提交 78%

Pathwise structure of the three-dimensional attractive one-point interaction diffusion

三维吸引性单点相互作用扩散的路径结构

Barkat Mian

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 研究三维吸引性单点相互作用扩散的路径行为,通过局部随机微分方程构造自然下鞅,证明过程以正概率访问原点且条件于避免原点的律为三维维纳测度。

Comments 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06007 2026-06-16 cs.LG 版本更新 78%

Diffusion Models for Adaptive Sequential Data Generation

自适应序列数据生成的扩散模型

Haoyang Cao, Minshuo Chen, Yinbin Han, Renyuan Xu

机构 * Department of Applied Mathematics and Statistics, Data Science and AI Institute, and Mathematical Institute for Data Science, Johns Hopkins University(应用数学与统计学系、数据科学与人工智能研究所、数据科学数学研究所,约翰霍普金斯大学) Department of Industrial Engineering and Management Sciences, Northwestern University(工业工程与管理科学系,西北大学) Department Management Science and Engineering, Stanford University(管理科学与工程系,斯坦福大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 提出一种顺序前向后向扩散框架,通过沿序列逐步注入和去除噪声并基于历史生成条件确保自适应性,用于生成自适应时间序列数据,并引入新的分数匹配目标实现高效并行训练,在合成数据和均值-方差最优投资组合构建中验证有效性。

Comments 38 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02955 2026-06-16 cs.CL cs.AI cs.LG 版本更新 78%

Fast-dLLM++: Fréchet Profile Decoding for Faster Diffusion LLM Inference

Fast-dLLM++: 用于更快扩散LLM推理的Fréchet轮廓解码

Siva Rajesh Kasa, Yasong Dai, Sumit Negi, Hongdong Li

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 针对扩散大语言模型推理中并行令牌生成的瓶颈,提出Fréchet轮廓解码方法,通过利用异构置信度轮廓选择并行提交集,在保持模型和缓存不变的情况下提升吞吐量。

Comments Initial version accepted at Workshop on Structured Probabilistic Inference & Generative Modeling, ICML 2026. Project Page: https://ringo-star.github.io/projectpage_frechet/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07013 2026-06-16 cs.CL 版本更新 78%

CoBit: Language Modeling with Bitstream Diffusion

CoBit: 基于比特流扩散的语言建模

Georgios Batzolis, Mark Girolami, Luca Ambrogioni

机构 * University of Cambridge(剑桥大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 提出CoBit模型,将文本建模为固定宽度二进制比特流上的连续扩散过程,采用匹配滤波残差参数化和基于熵率门控的朗之万校正采样器,在LM1B和OpenWebText上达到接近自回归模型的生成困惑度,并消除词汇表缩放瓶颈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23850 2026-06-16 cond-mat.soft 78%

Ostwald ripening controlled by diffusion of a sparingly soluble component

由难溶组分扩散控制的奥斯特瓦尔德熟化

Alexey Kabalnov

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文扩展了前期模型,证明在准稳态下,难溶组分的扩散控制熟化过程,颗粒尺寸分布遵循经典LSW理论,熟化速率符合立方律,并推导了涵盖全配方范围的改进外推方程。

Comments As accepted in Open Transport in January 2026

Journal ref Open Transport, vol. 1, no. 1, 2026, pp. 20260017

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27450 2026-06-16 cs.LG 版本更新 78%

FlowRL: A Taxonomy and Modular Framework for Reinforcement Learning with Diffusion Policies

FlowRL:基于扩散策略的强化学习分类与模块化框架

Chenxiao Gao, Edward Chen, Tianyi Chen, Bo Dai

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 提出扩散/流策略强化学习算法的统一分类法,构建模块化JAX框架,在多个基准上提供系统比较,为算法设计与应用提供指导。

Comments accepted by RLC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20668 2026-06-16 cs.RO cs.LG 版本更新 78%

DemoDiffusion: One-Shot Human Imitation using pre-trained Diffusion Policy

DemoDiffusion: 使用预训练扩散策略的一次性人类模仿

Sungjae Park, Homanga Bharadhwaj, Shubham Tulsiani

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 提出DemoDiffusion方法,通过单次人类演示和预训练扩散策略,无需任务特定训练即可使机器人执行操作任务,在8项任务中平均成功率达83.8%。

Comments 11 pages. Published at ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01149 2026-06-16 cond-mat.stat-mech 版本更新 78%

Ultra slow sub-logarithmic diffusion of a sluggish random walker subject to resetting with memory

具有记忆重置的慢速随机游走者的超慢次对数扩散

Denis Boyer, Satya N. Majumdar

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 研究布朗粒子扩散系数随距离原点代数衰减且以恒定速率重置到历史访问位置的模型,发现典型位移以[ln(rt)]^{1/(α+2)}超慢增长,位置分布呈双峰非高斯标度律。

Comments 22 pages, 4 figures

Journal ref J. Stat. Mech. (2026) 063201

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07212 2026-06-16 cs.AI cs.LG 版本更新 78%

Sample from What You See: Visuomotor Policy Learning via Diffusion Bridge with Observation-Embedded Stochastic Differential Equation

从所见中采样:基于观测嵌入随机微分方程的扩散桥视觉运动策略学习

Zhaoyang Liu, Mokai Pan, Zhongyi Wang, Kaizhen Zhu, Haotao Lu, Haipeng Zhang, Jingya Wang, Ye Shi

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 提出BridgePolicy,通过扩散桥公式将观测直接集成到随机动力学中,利用语义对齐器处理异构观测,在模拟和真实任务中超越现有生成式策略。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01394 2026-06-16 eess.AS cs.LG cs.SD 版本更新 78%

SSNAPS: Audio-Visual Separation of Speech and Background Noise with Diffusion Inverse Sampling

SSNAPS: 基于扩散逆采样的语音与背景噪声视听分离

Yochai Yemini, Yoav Ellinson, Rami Ben-Ari, Sharon Gannot, Ethan Fetaya

机构 * Bar-Ilan University(巴伊兰大学) OriginAI

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 提出一种无监督的视听语音分离方法,利用扩散先验和逆采样联合建模语音与噪声,在单麦克风场景下优于有监督基线,并支持离屏说话人分离。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13090 2026-06-16 cs.RO 版本更新 78%

Multi-Robot Motion Planning from Vision and Language using Heat-Inspired Diffusion

基于热启发的扩散模型实现从视觉和语言的多机器人运动规划

Jebeom Chae, Junwoo Chang, Seungho Yeom, Yujin Kim, Jongeun Choi

机构 * Department of Artificial Intelligence, Yonsei University(燕山大学人工智能学院) School of Mechanical Engineering, Yonsei University(燕山大学机械工程学院)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 提出LHD框架,结合CLIP语义先验与碰撞避免扩散核,实现语言条件化的多机器人无碰撞轨迹规划,在成功率上优于先前方法并降低延迟。

Comments 8 pages, 6 figures, accepted by IEEE Robotics and Automation Letters (RA-L)

Journal ref IEEE Robotics and Automation Letters, vol. 11, no. 6, pp. 7118-7125, June 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08328 2026-06-16 stat.ME 版本更新 78%

Diffusion Non-Additive Model for Multi-Fidelity Simulations with Tunable Precision

扩散非加性模型:用于可调精度多保真度模拟

Junoh Heo, Romain Boutelet, Wenjia Wang, Chih-Li Sung

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 提出扩散非加性(DNA)模型,利用高斯过程捕获非线性依赖并外推精确解,实现多保真度模拟的精度提升与不确定性量化。

Comments 35 pages including references and 27 pages supplementary

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17442 2026-06-16 astro-ph.HE hep-ph 版本更新 78%

Every Nearby Energetic Pulsar Is Surrounded by a Region of Inhibited Diffusion

每个附近的高能脉冲星都被一个扩散抑制区域包围

Isabelle John, Tim Linden

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 H.E.S.S.观测到高达40 TeV的电子正电子能谱,与标准单区模型冲突;通过模拟本地脉冲星群,发现每个年轻高能脉冲星周围必须存在扩散抑制区域(如超新星遗迹、脉冲星风云或TeV晕),否则会过度产生观测通量。

Comments 7 pages, 4 figures, appendix adds 4 pages, 4 figures. Updated version matches version accepted by PRD

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.03009 2026-06-16 cond-mat.soft 78%

Mesoscale simulations of diffusion and sedimentation in shape-anisotropic nanoparticle suspensions

介观尺度下形状各向异性纳米颗粒悬浮液中扩散与沉降的模拟

Yashraj M. Wani, Penelope Grace Kovakas, Arash Nikoubashman, Michael P. Howard

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 研究通过介观模拟确定了各向异性纳米颗粒悬浮液的长时自扩散系数和沉降系数,基于理论预测和实验数据验证了正十二面体、立方体、四面体和圆柱体颗粒的扩散系数估算方法。

Comments 13 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04621 2026-06-16 cs.CV cs.GR 版本更新 76%

MeshFlow: Efficient Artistic Mesh Generation via MeshVAE and Flow-based Diffusion Transformer

MeshFlow: 通过MeshVAE和基于流的扩散Transformer实现高效艺术网格生成

Weiyu Li, Antoine Toisoul, Tom Monnier, Roman Shapovalov, Rakesh Ranjan, Ping Tan, Andrea Vedaldi

机构 * Meta AI Hong Kong University of Science and Technology(香港科技大学)

专题命中 扩散模型 :diffusion(title);分类 cs.CV、cs.GR

AI总结 提出MeshFlow方法,利用变分自编码器将网格拓扑和顶点坐标映射到连续潜空间,并结合修正流Transformer并行生成网格,相比自回归方法速度提升18倍且精度优异。

Comments CVPR2026 Highlight, Homepage: https://mesh-flow.github.io/, Code: https://github.com/facebookresearch/meshflow

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16783 2026-06-16 cs.CV cs.AI cs.LG 新提交 74%

Gen-VCoT: Generative Visual Chain-of-Thought Reasoning via Diffusion-Based RGB Intermediate Representations

Gen-VCoT: 基于扩散的RGB中间表示的生成式视觉思维链推理

Zhiqiang Zhou, Junliang Dai, Xu ling

机构 * Hunan Chemical Industry Vocational and Technical College(湖南化工职业技术学院)

专题命中 扩散模型 :diffusion(title);分类 cs.CV

AI总结 提出Gen-VCoT框架,利用专家视觉模型生成RGB图像作为推理中间步骤,通过自适应路由器选择推理深度,在空间和深度问题上分别提升25%和50%,但简单事实查询性能下降,表明最优表示依赖于任务。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07753 2026-06-16 cond-mat.soft 71%

Externally driven condensates show translation-induced polarization, directed coalescence, and anomalous diffusion in viscoelastic media

在外力驱动下,凝聚态表现出由翻译诱导的极化、定向合并和异常扩散

Andriy Goychuk

专题命中 扩散模型 :diffusion(title)

AI总结 研究在外力作用下,凝聚态在粘弹性介质中表现出翻译诱导极化、定向合并和异常扩散,补充了奥斯特瓦尔德熟化和布朗运动合并机制,揭示了相分离与流体力学的竞争。

Journal ref Phys. Rev. E 113 (2026), 065402

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24223 2026-06-16 cs.LG cs.CV stat.ML 版本更新 70%

Semantic Editing with Coupled Stochastic Differential Equations

耦合随机微分方程的语义编辑

Jianxin Zhang, Clayton Scott

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 扩散模型 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 提出耦合随机微分方程(coupled SDEs)引导预训练生成模型的采样过程,无需重新训练即可实现高提示保真度和近像素级一致性的语义编辑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09465 2026-06-16 stat.ML cs.LG 版本更新 67%

Branching Flows: Discrete, Continuous, and Manifold Flow Matching with Splits and Deletions

分支流:带有分裂和删除的离散、连续和流形流匹配

Lukas Billera, Hedwig Nora Nordlinder, Jack Collier Ryder, Anton Oresten, Aron Stålmarck, Theodor Mosetti Björk, Ben Murrell

机构 * Department of Microbiology, Tumor and Cell Biology, Karolinska Institutet(卡罗林斯卡研究所微生物学、肿瘤和细胞生物学系)

专题命中 扩散模型 :image generation(abstract);diffusion(abstract)

AI总结 提出分支流框架,通过随机分支和死亡过程控制序列元素数量,适用于变长数据生成,并在小分子、抗体序列和蛋白质骨架生成中验证效果。

Comments 39 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17048 2026-06-16 cs.LG cs.CV stat.ML 新提交 57%

Exact Posterior Score Estimation for Solving Linear Inverse Problems

精确后验分数估计用于求解线性逆问题

Abbas Mammadov, Ozgur Kara, Kaan Oktay, Iskander Azangulov, Adil Kaan Akan, Hyungjin Chung, James Matthew Rehg, Yee Whye Teh

机构 * University of Oxford(牛津大学) UIUC(伊利诺伊大学厄巴纳-香槟分校) EverEx

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 提出精确后验分数(EPS)方法,通过闭式后验分数将线性逆问题转化为去噪问题,无需梯度或投影,在FFHQ和ImageNet上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16354 2026-06-16 cs.CV 新提交 57%

GraphBEV++: Multi-Modal Feature Alignment for Autonomous Driving

GraphBEV++: 自动驾驶中的多模态特征对齐

Ziying Song, Caiyan Jia, Lin Liu, Shaoqing Xu, Lei Yang, Yadan Luo

机构 * Beijing Key Laboratory of Traffic Data Mining and Embodied Intelligence, School of Computer Science and Technology, Beijing Jiaotong University(北京交通大学计算机科学与技术学院,交通数据挖掘与具身智能北京市重点实验室) School of Artificial Intelligence (School of Software), Yanshan University(燕山大学人工智能学院(软件学院)) University of Macau(澳门大学) Nanyang Technological University(南洋理工大学) The University of Queensland(昆士兰大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 针对自动驾驶中BEV感知的特征未对齐问题,提出GraphBEV++框架,通过局部对齐(LocalAlign-v2)和全局对齐(GlobalAlign-v2)模块,利用图匹配、可变形偏移和扩散去噪方法,在多种基准上实现最优性能。

Comments 30 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16317 2026-06-16 cs.CV 新提交 57%

Training-free sparse attention based on cumulative energy filtering

基于累积能量过滤的无训练稀疏注意力

Chunlu Li, Yixuan Pan, Bai Du, Zhenyuan Chen, Yanzhao Li, Hui Dong, Hui Wang, Zhiqiang Zou

机构 * Huawei Technologies(华为技术有限公司)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 提出动态阈值策略,在保持固定召回率的同时提高稀疏性,并与Flash Attention深度集成,无需额外掩码计算,在Wan 2.2上稀疏度从61.42%提升至82%,VBench指标下降小于5%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16124 2026-06-16 cs.CV 新提交 57%

Training-Free Open-Vocabulary Visual Grounding for Remote Sensing Images and Videos

面向遥感图像与视频的无训练开放词汇视觉定位

Ke Li, Di Wang, Yongshan Zhu, Ting Wang, Weiping Ni, Tao Lei, Quan Wang, Xinbo Gao

机构 * School of Computer Science and Technology, Xidian University(西安电子科技大学计算机科学与技术学院) Interdisciplinary Institute of Artificial Intelligence, Xidian University(西安电子科技大学跨学科人工智能研究院) School of Artificial Intelligence, Xidian University(西安电子科技大学人工智能学院) Northwest Institute of Nuclear Technology(西北核技术研究所) School of Physics and Information Engineering, Fuzhou University(福州大学物理与信息工程学院)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 提出无训练框架RSVG-ZeroOV,利用冻结的通用基础模型通过概览-聚焦-演化范式实现零样本开放词汇遥感视觉定位,并扩展至视频时空定位,在多个基准上超越现有零样本方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15574 2026-06-16 cs.CV 新提交 57%

Toward the Whole Picture: Accumulative Fingerprint Mapping and Reconstruction for Small-Area Mobile Sensors

迈向全貌:小面积移动传感器的累积指纹映射与重建

Xiongjun Guan, Jianjiang Feng, Jie Zhou

机构 * Tsinghua University(清华大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 针对小面积移动指纹传感中采集与识别不匹配的问题,提出累积映射与重建框架,将局部观测序列转化为统一指纹状态,实现单次匹配,提升效率与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏