arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-05-15 至 2026-05-15 共收录 66 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 66 篇

2605.14326 2026-05-15 cs.CV 88%

D2-CDIG: Controlled Diffusion Remote Sensing Image Generation with Dual Priors of DEM and Cloud-Fog

D2-CDIG: 基于DEM和云雾双先验的受控扩散遥感图像生成

Zuopeng Zhao, Ying Liu, Kanyaphakphachsorn Pharksuwan, Su Luo, Xiaoyu Li, Maocai Ning

机构 * China University of Mining and Technology(中国矿业大学)

专题命中 扩散模型 :image generation(title,abstract);diffusion(title,abstract);分类 cs.CV

AI总结 本文提出D2-CDIG框架,结合扩散模型与双先验控制机制,利用DEM和云雾信息提升遥感图像生成的准确性和自然度,改进图像质量、细节丰富度和真实感。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15193 2026-05-15 cs.CV 83%

Aligning Latent Geometry for Spherical Flow Matching in Image Generation

在图像生成中利用球面流匹配对潜在几何进行对齐

Tuna Han Salih Meral, Kaan Oktay, Hidir Yesiltepe, Adil Kaan Akan, Pinar Yanardag

机构 * Virginia Tech(弗吉尼亚理工大学) fal(法尔)

专题命中 扩散模型 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 本文提出通过分解潜在标记为径向和角向成分,利用球面线性插值改进流匹配,使生成图像在不同分词器下提升FID评分,无需辅助编码器。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15055 2026-05-15 cs.LG cs.CV 83%

DiffusionOPD: A Unified Perspective of On-Policy Distillation in Diffusion Models

DiffusionOPD:扩散模型中在线策略蒸馏的统一视角

Quanhao Li, Junqiu Yu, Kaixun Jiang, Yujie Wei, Zhen Xing, Pandeng Li, Ruihang Chu, Shiwei Zhang, Yu Liu, Zuxuan Wu

机构 * Fudan University(复旦大学) Wan Team, Alibaba Group(阿里集团万团队)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

AI总结 本文提出DiffusionOPD,通过在线策略蒸馏统一多任务训练,解决多任务优化中的交叉干扰和不平衡问题,理论推导出连续状态马尔可夫过程的KL目标,实验显示其在训练效率和性能上优于多奖励RL和级联RL基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14894 2026-05-15 cs.CV 83%

SEDiT: Mask-Free Video Subtitle Erasure via One-step Diffusion Transformer

SEDiT: 一种基于单步扩散变换器的无掩膜视频字幕擦除方法

Zheng Hui, Yunlong Bai

机构 * Baidu Inc.(百度公司)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

AI总结 SEDiT提出一种单步扩散变换器方法,实现无掩膜视频字幕擦除,通过理论证明和实验验证,解决字幕擦除中的局部编辑问题和长期时间一致性挑战。

Comments Project page:http://zheng222.github.io/SEDiT_project

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14461 2026-05-15 cs.CV 83%

ClickRemoval: An Interactive Open-Source Tool for Object Removal in Diffusion Models

ClickRemoval: 一种基于扩散模型的对象移除交互式开源工具

Ledun Zhang, Yatu Ji, Xufei Zhuang, Xinying Yao

机构 * Inner Mongolia University of Technology(内蒙古科技大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 ClickRemoval通过用户点击实现对象移除,无需手动掩膜或文本提示,在复杂场景中实现精确移除和自然背景恢复。

Comments 5 pages, 4 figures. Open-source software paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14341 2026-05-15 cs.CV 83%

AnyBand-Diff: A Unified Remote Sensing Image Generation and Band Repair Framework with Spectral Priors

AnyBand-Diff: 一种结合光谱先验的遥感图像生成与波段修复框架

Zuopeng Zhao, Ying Liu, Xiaoyu Li, Su Luo, Lu Li, Wenwen Liu

机构 * School of Computer Science and Technology / School of Artificial Intelligence, China University of Mining and Technology(计算机科学与技术学院/人工智能学院,中国矿业大学) Mine Digitization Engineering Research Center of the Ministry of Education(教育部矿山数字化工程研究中心) Jiangsu Provincial Industrial Technology Engineering Center for Intelligent Sensing(江苏省智能感知与应急物联网地下空间工业技术工程中心)

专题命中 扩散模型 :image generation(title);diffusion(abstract,abstract_cn);分类 cs.CV

AI总结 本文提出AnyBand-Diff框架,结合光谱先验指导扩散模型,解决遥感图像生成中的光谱失真问题,通过双随机掩码策略和物理引导采样机制实现可靠图像生成与准确光谱修复。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08698 2026-05-15 cs.CV cs.LG 83%

Supersampling Stable Diffusion and Beyond: A Seamless, Training-Free Approach for Scaling Neural Networks Using Common Interpolation Methods

超采样稳定扩散与更远:一种无缝、无需训练的方法,利用常见插值方法扩展神经网络

Md Abu Obaida Zishan, Jannatun Noor, Annajiat Alim Rasel

机构 * School of Data and Sciences BRAC University, Dhaka(数据与科学学院,布拉克大学,达卡) Computing for Sustainability and Social Good (C2SG) Research Group Department of Computer Science and Engineering United Internation University, Dhaka(可持续性与社会公益(C2SG)研究组,计算机科学与工程系,联合国际大学,达卡)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

AI总结 本文提出无需训练的超采样方法,通过插值扩展神经网络以生成更高分辨率图像,同时减少内存占用。

Comments Updated the title for clarity. Removed background and redundant text from section 4.2,5. Improved organization in section 4 and clarity of text in Section 4.3

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13857 2026-05-15 cs.GR cs.CV cs.LG 81%

MoZoo:Unleashing Video Diffusion power in animal fur and muscle simulation

MoZoo:释放视频扩散在动物毛发和肌肉模拟中的潜力

Dongxia Liu, Jie Ma, Xiaochen Yang, Jiancheng Zhang, Bin Xia, Zhehan Kan, Nisha Huang, Jun Liang, Wenming Yang, Jin Li

机构 * tabular c 1 Tsinghua University 2 University of Glasgow 3 The Chinese University of Hong Kong 4 HUIJING Digital Media \& Entertainment Group 2mm Project Page: tabular

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

AI总结 MoZoo通过引入Role-Aware RoPE和Asymmetric Decoupled Attention,实现高保真动物视频生成,同时构建了MoZoo-Data和MoZooBench进行评估,提升了毛发和肌肉动态模拟的效率与质量。

Comments Github Page:https://dongxialiu15.github.io/MoZoo/

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12202 2026-05-15 cs.CV 79%

Hunyuan3D 2.0: Scaling Diffusion Models for High Resolution Textured 3D Assets Generation

Hunyuan3D 2.0:基于扩散模型的高分辨率纹理3D资产生成

Zibo Zhao, Zeqiang Lai, Qingxiang Lin, Yunfei Zhao, Haolin Liu, Shuhui Yang, Yifei Feng, Mingxin Yang, Sheng Zhang, Xianghui Yang, Huiwen Shi, Sicong Liu, Junta Wu, Yihang Lian, Fan Yang, Ruining Tang, Zebin He, Xinzhou Wang, Jian Liu, Xuhui Zuo, Zhuo Chen, Biwen Lei, Haohan Weng, Jing Xu, Yiling Zhu, Xinhai Liu, Lixin Xu, Changrong Hu, Shaoxiong Yang, Song Zhang, Yang Liu, Tianyu Huang, Lifu Wang, Jihong Zhang, Meng Chen, Liang Dong, Yiwen Jia, Yulin Cai, Jiaao Yu, Yixuan Tang, Hao Zhang, Zheng Ye, Peng He, Runzhou Wu, Chao Zhang, Yonghao Tan, Jie Xiao, Yangyu Tao, Jianchen Zhu, Jinbao Xue, Kai Liu, Chongqing Zhao, Xinming Wu, Zhichao Hu, Lei Qin, Jianbing Peng, Zhan Li, Minghui Chen, Xipeng Zhang, Lin Niu, Paige Wang, Yingkai Wang, Haozhao Kuang, Zhongyi Fan, Xu Zheng, Weihao Zhuang, YingPing He, Tian Liu, Yong Yang, Di Wang, Yuhong Liu, Jie Jiang, Jingwei Huang, Chunchao Guo

机构 * Tencent(腾讯)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 Hunyuan3D 2.0通过大规模形状生成模型和纹理合成模型,实现高分辨率纹理3D资产生成,其核心贡献在于提升几何细节、条件对齐和纹理质量,并提供用户友好的生产平台。

Comments GitHub link: https://github.com/Tencent/Hunyuan3D-2

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14396 2026-05-15 cs.CV cs.CR cs.LG cs.RO 79%

Systematic Discovery of Semantic Attacks in Online Map Construction through Conditional Diffusion

通过条件扩散系统发现在线地图构建中的语义攻击

Chenyi Wang, Ruoyu Song, Raymond Muller, Jean-Philippe Monteuuis, Jonathan Petit, Z. Berkay Celik, Ryan Gerdes, Ming F. Li

机构 * University of Arizona(亚利桑那大学) Purdue University(普渡大学) Lawrence Livermore National Laboratory(劳伦斯利弗莫尔国家实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出MIRAGE框架,系统发现能绕过对抗防御的语义攻击,通过寻找环境变化(如阴影、湿路)来降低地图预测准确性,实验显示两种攻击在多种防御下仍有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14337 2026-05-15 cs.CV 79%

IG-Diff: Complex Night Scene Restoration with Illumination-Guided Diffusion Model

IG-Diff: 复杂夜间场景恢复与光照引导扩散模型

Yifan Chen, Fei Yin, Chunle Guo, Chongyi Li, Yujiu Yang

机构 * Tsinghua Univerisity(清华大学) NanKai University(南开大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出IG-Diff模型,通过光照引导模块提升低光照环境下复杂场景的恢复能力,解决天气与低光共存的挑战。

Comments Accepted by CGI-2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14191 2026-05-15 cs.CV 79%

CoReDiT: Spatial Coherence-Guided Token Pruning and Reconstruction for Efficient Diffusion Transformers

CoReDiT:基于空间一致性引导的令牌剪枝与重建用于高效的扩散变换器

Zhuojin Li, Hsin-Pai Cheng, Hong Cai, Shizhong Han, Fatih Porikli

机构 * Qualcomm AI Research(高通人工智能研究)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 CoReDiT通过空间一致性引导的令牌剪枝与重建,显著降低扩散变换器的计算量,提升推理速度,同时保持高质量视觉输出。

Comments 8 pages, 8 figures, CVPR workshop

Journal ref 2026 CVPR Workshop of EDGE

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04473 2026-05-15 cs.CV 79%

CC-Pan: Channel-wise Compression based Diffusion for Efficient Pan-Sharpening

CC-Pan: 基于通道压缩的扩散模型用于高效全色锐化

Junjie Li, Congyang Ou, Haokui Zhang, Guoting Wei, Shengqin Jiang, Ying Li

机构 * School of Cyberspace Security, Northwestern Polytechnical University(网络安全学院,西北工业大学) Nanjing University of Science and Technology(南京理工大学) School of Computer Science, Nanjing University of Information Science and Technology(计算机科学学院,南京信息工程大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出CC-Pan,一种跨传感器潜在扩散框架,通过带级单通道变分自编码器编码高分辨率多谱段图像,结合轻量级区域基于跨带注意力模块,提升全色锐化精度与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12083 2026-05-15 cs.CV 79%

RePack then Refine: Efficient Diffusion Transformer with Vision Foundation Model

RePack then Refine:高效的扩散变换器与视觉基础模型

Guanfang Dong, Luke Schultz, Negar Hassanpour, Chao Gao

机构 * Huawei Technologies Canada Ltd.(华为加拿大有限公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出RePack then Refine框架,通过压缩高维VFM特征并细化提升扩散变换器的生成效率与质量,在ImageNet-1K上取得优于最新LDMs的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09549 2026-05-15 cs.CV 79%

SD-ReID: View-aware Stable Diffusion for Aerial-Ground Person Re-Identification

SD-ReID: 视角感知的稳定扩散用于空-地人员重识别

Yuhao Wang, Xiang Hu, Lixin Wang, Pingping Zhang, Huchuan Lu

机构 * School of Future Technology, Dalian University of Technology(大连理工大学未来技术学院) School of Information and Communication Engineering, Dalian University of Technology(大连理工大学信息与通信工程学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出SD-ReID框架,通过生成模型模仿不同视角的特征分布,提取稳健的身份表示,提升空-地人员重识别的鲁棒性和准确性。

Comments This work is accepted by IEEE TIP 2026. More modifications may performed

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14136 2026-05-15 cs.CV 79%

TeDiO: Temporal Diagonal Optimization for Training-Free Coherent Video Diffusion

TeDiO:基于时间对角优化的训练自由一致视频扩散

Nurislam Tursynbek, Zhiqiang Lao, Heather Yu, Gedas Bertasius, Marc Niethammer

机构 * UNC Chapel Hill(北卡罗来纳大学教堂山分校) Futurewei Technologies Inc(未来科技有限公司) UCSD(加州大学圣迭戈分校)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 TeDiO通过优化内部注意力模式提升视频生成的时序一致性,无需训练或外部监督,实现更流畅的动态表现。

Comments CVPR'26 Workshop on Agentic AI for Visual Media

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13910 2026-05-15 stat.ML cs.CV cs.LG 79%

Covariance-aware sampling for Diffusion Models

考虑协方差的扩散模型采样

Andrea Schioppa, Tim Salimans

机构 * GDM - Amsterdam(阿姆斯特丹GDM)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出一种考虑协方差的采样器,改进了扩散模型在少步 regime 中的像素空间采样质量。通过显式建模反向过程的协方差,结合 Tweedie 公式和结构化傅里叶空间分解,实现高效采样。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17353 2026-05-15 cs.CV cs.AI cs.LG eess.IV 79%

Dual Ascent Diffusion for Inverse Problems

双上升扩散用于逆问题

Minseo Kim, Axel Levy, Gordon Wetzstein

机构 * Stanford University(斯坦福大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出双上升优化框架解决逆问题,提升图像质量与鲁棒性,改进扩散模型先验的MAP求解方法。

Comments Project page: https://soniaminseokim.github.io/ddiff/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15158 2026-05-15 cond-mat.soft 78%

Duality Between Chemical Potential Dynamics and Reaction-Diffusion Systems

化学势动力学与反应扩散系统的对偶性

Daniel Zhou, Erwin Frey

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 研究揭示了化学势动力学与反应扩散系统在非平衡态下的对偶关系,通过构建方程层面的对偶性,解决了相分离过程中化学势与密度非可逆性问题,并统一了多种动态现象。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05762 2026-05-15 cs.LG 78%

BiTrajDiff: Bidirectional Trajectory Generation with Diffusion Models for Offline Reinforcement Learning

BiTrajDiff: 用于离线强化学习的双向轨迹生成扩散模型

Yunpeng Qing, Yixiao Chi, Shuo Chen, Shunyu Liu, Kexuan Zhou, Sixu Lin, Litao Liu, Changqing Zou

机构 * Zhejiang University(浙江大学) Zhejiang Lab(浙江省实验室) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Nanyang Technological University(南洋理工大学) Rutgers University(罗格斯大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出BiTrajDiff,通过双向扩散模型生成轨迹,解决离线强化学习中数据分布偏差问题,提升数据集多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14770 2026-05-15 math.NA cs.NA 78%

A Least-Squares Weak Galerkin Finite Element Scheme for Cauchy Problems in Convection--Diffusion

一种用于对流-扩散方程Cauchy问题的最小二乘弱伽辽金有限元方案

Chunmei Wang, Shangyou Zhang

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出了一种最小二乘弱伽辽金有限元方法,用于求解严重病态的对流-扩散方程Cauchy问题,通过弱导数处理复杂边界条件和内部界面,建立对称正定离散线性系统,并证明了解的唯一性和最优误差估计。

Comments 19 pages, 6 tables, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14570 2026-05-15 cs.CL 78%

Uncertainty Quantification for Large Language Diffusion Models

大型语言扩散模型的不确定性量化

Artem Vazhentsev, Vladislav Smirnov, David Li, Maxim Panov, Timothy Baldwin, Artem Shelmanov

机构 * MBZUAI The University of Melbourne(墨尔本大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出了一种轻量级的不确定性信号,通过迭代去噪过程和中间生成来提升LLDMs的不确定性量化,实验显示其在成本与性能之间取得良好平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14452 2026-05-15 math.AP 78%

Local and global solutions to continuous fragmentation-coagulation equations with vanishing diffusion and unbounded fragmentation and coagulation rates

连续破碎-凝聚方程局部和全局解的研究:消失扩散与无界破碎和凝聚速率

Sergey Shindin

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文研究了由消失扩散和无界破碎凝聚过程支配的粒子系统,证明了在特定系数下,此类系统在局部上经典可解,并在幂率情况下在所有空间维度上存在全局经典解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14368 2026-05-15 cs.CL cs.AI 78%

Where Should Diffusion Enter a Language Model? Geometry-Guided Hidden-State Replacement

扩散应进入语言模型的何处?几何引导的隐藏状态替换

Injin Kong, Hyoungjoon Lee, Yohan Jo

机构 * Graduate School of Data Science, Seoul National University(首尔国立大学数据科学研究生院) Department of Biosystems & Biomaterials Science and Engineering, Seoul National University(首尔国立大学生物系统与生物材料科学与工程系)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出DiHAL模型,通过几何引导确定扩散在预训练Transformer中的最佳插入位置,通过隐藏状态恢复而非直接连续到离散恢复提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14317 2026-05-15 cs.LG physics.ao-ph 78%

Guided Diffusion Sampling for Precipitation Forecast Interventions

引导扩散采样用于降水预报干预

Ayumu Ueyama, Kazuhiko Kawamoto, Hiroshi Kera

机构 * Chiba University(千叶大学) National Institute of Informatics(国家信息研究所)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出基于梯度的引导框架,通过扩散模型实现降水减少干预,通过引导扩散采样轨迹保持大气分布一致性,实验表明其干预更符合物理规律。

Comments 12+7 pages, 7+2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14305 2026-05-15 cs.CL 78%

Factorization-Error-Free Discrete Diffusion Language Model via Speculative Decoding

通过推测解码的无因子误差离散扩散语言模型

Xun Fang, Yunchen Li, Hang Yuan, Zhou Yu

机构 * East China Normal University(华东师范大学) Beijing Zhongguancun Academy(北京中关村学院)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出FeF-DLLM,通过精确的前缀条件因子分解保留token依赖性,结合推测解码提升推理速度,实验表明在多个数据集上准确率提升5.04个百分点,推理速度提升3.86倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22917 2026-05-15 astro-ph.CO astro-ph.GA 78%

Diffusion-based Galaxy Simulations for the Roman High Latitude Survey

基于扩散的星系模拟用于罗马高纬度调查

Diana Scognamiglio, Jake H. Lee, Eric Huff, Sergi R. Hildebrandt, Shoubaneh Hemmati

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出一种基于扩散的星系图像模拟方法,用于罗马高纬度调查的弱透镜分析,通过训练去噪扩散概率模型生成多波段星系图像,验证其在弱透镜校准中的有效性。

Comments 15 pages, 8 Figure, accepted for publication in ApJ

Journal ref ApJ 1003 (2026) 42

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21809 2026-05-15 cs.LG cs.AI q-bio.QM stat.ML 78%

Quotient-Space Diffusion Models

商空间扩散模型

Yixian Xu, Yusong Wang, Shengjie Luo, Kaiyuan Gao, Tianyu He, Di He, Chang Liu

机构 * State Key Laboratory of General Artificial Intelligence, Peking University, Beijing, China(一般人工智能国家重点实验室,北京大学,北京,中国) Huazhong University of Science and Technology, Wuhan, China(华中科技大学,武汉,中国) Microsoft Research Asia, Beijing, China(微软亚洲研究院,北京,中国) Zhongguancun Academy, Beijing, China(中关村学院,北京,中国)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出商空间扩散模型,通过处理对称性来提升生成模型性能,优于等变模型和对齐方法,在分子结构生成中表现更佳。

Comments ICLR 2026 Oral Presentation; 43 pages, 5 figures, 6 tables; ICLR 2026 Camera Ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12554 2026-05-15 cs.LG cs.AI cs.CL 78%

Reinforcement Learning for Diffusion LLMs with Entropy-Guided Step Selection and Stepwise Advantages

基于熵引导的步骤选择和分步优势的扩散语言模型强化学习

Vishnu Teja Kunde, Fatemeh Doudi, Mahdi Farahbakhsh, Dileep Kalathil, Krishna Narayanan, Jean-Francois Chamberland

机构 * Department of Electrical & Computer Engineering(电气与计算机工程系)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出一种针对扩散语言模型的强化学习方法,通过熵引导选择步骤和分步优势估计,实现无偏策略梯度,提升生成效果和计算效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05285 2026-05-15 cs.LG 78%

Robust Inference-Time Steering of Protein Diffusion Models via Embedding Optimization

通过嵌入优化实现蛋白质扩散模型推理时间的鲁棒引导

Minhuan Li, Jiequn Han, Pilar Cossio, Luhuan Wu

机构 * Flatiron Institute(Flatiron研究所)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出EmbedOpt框架,通过优化嵌入空间使蛋白质结构先验与实验约束对齐,在稀疏距离约束和冷冻电镜图匹配中表现更优,且对超参数更鲁棒。

详情

展开后加载摘要…

URL PDF HTML 收藏