arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-05-14 至 2026-05-14 共收录 92 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 92 篇

2511.17031 2026-05-14 cs.LG cs.CV cs.CY 89%

Energy Scaling Laws for Diffusion Models: Quantifying Compute in Image Generation

扩散模型的能量缩放规律:量化图像生成中的计算需求

Aniketh Iyengar, Jiaqi Han, Boris Ruf, Vincent Grari, Marcin Detyniecki, Stefano Ermon

机构 * Stanford University(斯坦福大学) AXA AI Research(AXA人工智能研究)

专题命中 扩散模型 :diffusion(title,abstract);image generation(title,abstract);分类 cs.CV

AI总结 本文提出基于计算复杂度(FLOPs)的扩散模型GPU能耗预测方法,通过分解推理过程中的文本编码、去噪和解码步骤,验证去噪操作主导能耗,并在四种先进模型和三种GPU架构上验证了预测准确性与跨架构泛化能力。

Comments Accepted at ACM Conference on Fairness, Accountability, and Transparency (FAccT) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13010 2026-05-14 cs.CV cs.AI cs.SY eess.SY math.OC 88%

Amortized Guidance for Image Inpainting with Pretrained Diffusion Models

基于预训练扩散模型的图像修复的 amortized 指导

Yilie Huang, Xun Yu Zhou

机构 * Department of Industrial Engineering and Operations Research, Columbia University, New York, NY 10027, USA(工业工程与运筹学系,哥伦比亚大学,纽约,NY 10027,美国) Department of Industrial Engineering and Operations Research & Data Science Institute, Columbia University, New York, NY 10027, USA(工业工程与运筹学系及数据科学研究所,哥伦比亚大学,纽约,NY 10027,美国)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(title,abstract);分类 cs.CV

AI总结 本文提出AID模型,通过预训练扩散模型和离线训练的指导模块,在多种掩码类型下提升图像修复的质量-速度平衡,训练开销低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12088 2026-05-14 cs.CV 83%

UniCustom: Unified Visual Conditioning for Multi-Reference Image Generation

UniCustom: 多参考图像生成的统一视觉条件化

Yiyan Xu, Qiulin Wang, Wenjie Wang, Yunyao Mao, Xintao Wang, Pengfei Wan, Kun Gai, Fuli Feng

机构 * University of Science and Technology of China(中国科学技术大学) Kling Team, Kuaishou Technology(快手技术团队)

专题命中 扩散模型 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 UniCustom通过融合ViT和VAE特征提升多参考图像生成中主体一致性和指令遵循能力,采用两阶段训练策略和槽绑定正则化减少跨参考混淆。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.04557 2026-05-14 cs.CV cs.AI 83%

Efficient Geometry-Controlled High-Resolution Satellite Image Synthesis

高效几何控制高分辨率卫星图像合成

Vlad Vasilescu, Daniela Faur, Teodor Costachioiu

机构 * Univ. POLITEHNICA Bucharest SIGMA Lab , CAMPUS Institute(巴比什-博亚尔银行大学 SIGMA 实验室,CAMPUS 机构) Univ. POLITEHNICA Bucharest GEOSENSE , CAMPUS Institute(巴比什-博亚尔银行大学 GEOSENSE,CAMPUS 机构)

专题命中 扩散模型 :image synthesis(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 本文提出一种高效方法,通过利用跳连特征和滑动窗口交叉注意力模块,改进扩散模型以实现几何控制的高分辨率卫星图像合成,同时探讨了当前评估方法的局限性。

Comments 2026 IEEE International Geoscience and Remote Sensing Symposium (IGARSS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13293 2026-05-14 cs.CV 83%

Img2CADSeq: Image-to-CAD Generation via Sequence-Based Diffusion

Img2CADSeq:通过序列扩散生成图像到CAD

Shiyu Tan, Zixuan Zhao, Hao Gao, Zhiheng Chen, Xiaolong Yin, Enya Shen

机构 * School of Software Tsinghua University China(软件学院清华大学中国) Tsinghua University(清华大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出Img2CADSeq,通过序列扩散模型生成高质量CAD模型,采用三级代码本和对比学习解决模态差异问题,实现工业领域应用。

Comments Accepted by SIGGRAPH 2026 Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13382 2026-05-14 cs.RO 82%

BlockVLA: Accelerating Autoregressive VLA via Block Diffusion Finetuning

BlockVLA: 通过块扩散微调加速自回归VLA

Ruiheng Wang, Shuanghao Bai, Haoran Zhang, Badong Chen, Xiangyu Xu

机构 * Xi'an Jiaotong University(西安交通大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出BlockVLA框架,通过块扩散方法将预训练自回归模型转化为高效离散扩散策略,减少推理延迟并提升训练效率,实验证明在复杂长周期任务中性能显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13115 2026-05-14 cs.CR cs.LG 82%

DiffusionHijack: Supply-Chain PRNG Backdoor Attack on Diffusion Models and Quantum Random Number Defense

DiffusionHijack: 供应链PRNG后门攻击针对扩散模型和量子随机数防御

Ziyang You, Liling Zheng, Xiaoke Yang, Xuxing Lu

机构 * School of Electronics, Electrical Engineering and Physics, Fujian University of Technology(福建工程学院电子工程与物理学院) School of Humanities, Fujian University of Technology(福建工程学院人文学院) Institute of Applied Physics and Materials Engineering, University of Macau(澳门大学应用物理与材料工程学院)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 研究提出DiffusionHijack攻击通过供应链注入恶意PRNG控制扩散模型生成图像,采用量子随机数生成器有效防御该攻击,降低输出相似度至随机基线水平。

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12778 2026-05-14 cs.GR cs.CV 81%

Generative Motion In-betweening by Diffusion over Continuous Implicit Representations

通过扩散在连续隐式表示上生成运动中间帧

Shiyu Fan, Paul Henderson, Edmond S. L. Ho

机构 * School of Computing Science, University of Glasgow(格拉斯哥大学计算机科学学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.GR

AI总结 本文提出基于运动隐式神经表示的扩散模型新管道和采样优化策略,通过映射隐式神经表示与稀疏时空信息,实现从稀疏模糊关键帧数据中采样并生成流畅运动。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13815 2026-05-14 cs.CV cs.RO 79%

OmniLiDAR: A Unified Diffusion Framework for Multi-Domain 3D LiDAR Generation

OmniLiDAR:一个多领域3D激光雷达生成的统一扩散框架

Youquan Liu, Weidong Yang, Ao Liang, Xiang Xu, Lingdong Kong, Yang Wu, Dekai Zhu, Xin Li, Runnan Chen, Ben Fei, Tongliang Liu, Wanli Ouyang

机构 * College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院) School of Computing, Department of Computer Science, National University of Singapore(新加坡国立大学计算机学院) College of Computer Science and Technology, Nanjing University of Aeronautics and Astronautics(南京航空航天大学计算机科学与技术学院) Technical University of Munich(慕尼黑技术大学) Nanjing University of Science and Technology(南京理工大学) Shanghai AI Laboratory(上海人工智能实验室) University of Sydney(悉尼大学) The Chinese University of Hong Kong, Hong Kong SAR(香港中文大学(深圳))

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 OmniLiDAR提出一种统一的文本条件扩散框架,生成跨八个领域的3D激光雷达扫描,通过跨域训练策略和特征建模提升多域生成能力,实验显示在数据增强和鲁棒性评估中表现优异。

Comments Preprint; 12 pages, 7 figures, 10 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13778 2026-05-14 cs.RO cs.CV 79%

Realtime-VLA FLASH: Speculative Inference Framework for Diffusion-based VLAs

实时-VLA FLASH:基于扩散模型的视觉-语言-动作模型的推测推理框架

Jiahui Niu, Kefan Gu, Yucheng Zhao, Shengwen Liang, Tiancai Wang, Xing Hu, Ying Wang, Huawei Li

机构 * State Key Lab of Processors, Institute of Computing Technology, CAS(处理器国家重点实验室,计算技术研究所,中国科学院) University of Chinese Academy of Sciences(中国科学院大学) Nanjing University(南京大学) Dexmal

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出实时-VLA FLASH框架,通过轻量级草案模型和主模型的Action Expert并行验证,实现低延迟高频率重规划,实验显示在LIBERO上任务性能保持良好,推理延迟降低至19.1ms。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13713 2026-05-14 cs.CV eess.IV 79%

Learning to Optimize Radiotherapy Plans via Fluence Maps Diffusion Model Generation and LSTM-based Optimization

通过束流图扩散模型生成和基于LSTM的优化学习优化放射治疗计划

Isabella Poles, Simon Arberet, Riqiang Gao, Martin Kraus, Marco D. Santambrogio, Florin C. Ghesu, Ali Kamen, Dorin Comaniciu

机构 * Politecnico di Milano(米兰理工学院) Digital Technology and Innovation, Siemens Healthineers(西门子医疗数字化技术与创新)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出一种扩散驱动的学习优化方法,用于端到端的VMAT计划,通过生成可行的束流图并利用LSTM优化模块提高计划效率和机器可交付性。

Comments Early Accept at MICCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13316 2026-05-14 cs.CV 79%

Test-time Sparsity for Extreme Fast Action Diffusion

测试时稀疏性用于极端快速动作扩散

Kangye Ji, Yuan Meng, Jianbo Zhou, Ye Li, Chen Tang, Zhi Wang

机构 * Tsinghua University(清华大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出测试时稀疏性方法,通过动态预测可剪枝的残差计算来加速动作扩散,解决开放环境中的动态策略问题,实验表明在减少92% FLOPs的同时提升5倍生成速度,保持无损性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13182 2026-05-14 cs.CV 79%

DiffST: Spatiotemporal-Aware Diffusion for Real-World Space-Time Video Super-Resolution

DiffST: 用于现实世界时空视频超分辨率的时空感知扩散模型

Zheng Chen, Ruofan Yang, Jin Han, Dehua Song, Zichen Zou, Chunming He, Yong Guo, Yulun Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Huawei Noah’s Ark Lab(华为诺亚实验室) Duke University(杜克大学) Huawei Consumer Business Group(华为消费者业务集团)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 DiffST提出一种高效时空感知视频扩散框架,通过跨帧上下文聚合和视频表示引导提升时空信息利用,实现高效实时世界时空视频超分辨率。

Comments Code is available at: https://github.com/zhengchen1999/DiffST

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13041 2026-05-14 cs.CV 79%

EgoForce: Robust Online Egocentric Motion Reconstruction via Diffusion Forcing

EgoForce:通过扩散强迫实现鲁棒的在线自体视角运动重建

Inwoo Hwang, Donggeun Lim, Hojun Jang, Young Min Kim

机构 * Seoul National University(首尔国立大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出EgoForce框架,通过扩散强迫方法实现从噪声自体视角输入中鲁棒的长时间全身体运动重建,优于现有在线和离线方法。

Comments Project page: https://inwoohwang.me/EgoForce

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13027 2026-05-14 cs.CV 79%

PRISM: Prior Rectification and Uncertainty-Aware Structure Modeling for Diffusion-Based Text Image Super-Resolution

PRISM:基于先验校正和不确定性感知结构建模的扩散文本图像超分辨率

Zihang Xu, Xiaoyang Liu, Zheng Chen, Yulun Zhang, Xiaokang Yang

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 PRISM通过Flow-Matching Prior Rectification和Structure-guided Uncertainty-aware Residual Encoder解决文本超分辨率中的先验校正和局部结构细化问题,实现高精度文本生成。

Comments Code is available at https://github.com/faithxuz/PRISM

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12957 2026-05-14 cs.CV 79%

GTA: Advancing Image-to-3D World Generation via Geometry Then Appearance Video Diffusion

GTA: 通过几何然后外观视频扩散推进图像到3D世界生成

Hanxin Zhu, Cong Wang, Peiyan Tu, Jiayi Luo, Tianyu He, Xin Jin, Zhibo Chen

机构 * College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息科学与电子工程学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出GTA方法,通过几何先于外观的两阶段框架提升3D场景生成的结构精度和视觉质量,同时引入随机潜在shuffle策略和测试时缩放方案,实验表明其在保真度、视觉质量和几何准确性上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29917 2026-05-14 cs.CV 79%

Diffusion-Based Feature Denoising with NNMF for Robust handwritten digit multi-class classification

基于NNMF的扩散特征去噪在鲁棒手写数字多类分类中的应用

Hiba Adil Al-kharsan, Róbert Rajkó

机构 * Doctoral School of Computer Science, University of Szeged(塞格德大学计算机科学博士学院) University Research and Innovation Center (EKIK), Óbuda University(奥布达大学研究与创新中心(EKIK))

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出结合扩散驱动特征去噪与混合特征表示的鲁棒多类分类框架,通过NNMF提取紧致可解释特征并结合CNN深度特征,提升噪声和对抗攻击下的分类鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01242 2026-05-14 cs.CV cs.AI cs.CL 79%

When Diffusion Breaks Constraints: Sequential Autoregressive Generation with RL and MCTS

当扩散模型失效约束:通过强化学习和MCTS的序列自回归生成

Zirui Zhao, Boye Niu, Harold Soh, David Hsu, Wee Sun Lee

机构 * Salesforce AI Research(Salesforce人工智能研究) University of Sydney(悉尼大学) National University of Singapore(新加坡国立大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文研究了扩散模型在约束生成任务中的失效模式,通过拼图生成和简化矩形组合任务,发现扩散模型难以满足约束,提出基于自回归序列生成的约束意识生成方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12587 2026-05-14 cs.CV 79%

TrackCraft3R: Repurposing Video Diffusion Transformers for Dense 3D Tracking

TrackCraft3R:将视频扩散变换器重新用于密集3D跟踪

Jisu Nam, Jahyeok Koo, Soowon Son, Jaewoo Jung, Honggyu An, Junhwa Hur, Seungryong Kim

机构 * KAIST AI(韩国科学技术院人工智能研究所) Google DeepMind(谷歌DeepMind)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出TrackCraft3R,通过重新利用预训练的视频扩散变换器,实现了基于单目视频的密集3D跟踪,采用双潜表示和时间RoPE对齐设计,提升了跟踪性能和效率。

Comments Project page and code are available at https://cvlab-kaist.github.io/TrackCraft3r/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13448 2026-05-14 stat.ML cs.LG math.PR 78%

On the Limits of Latent Reuse in Diffusion Models

扩散模型中潜在重用的极限

Yifeng Yu, Lu Yu

机构 * Department of Mathematical Sciences, Tsinghua University(清华大学数学科学系) Department of Data Science, City University of Hong Kong(香港城市大学数据科学系)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 研究扩散模型在分布偏移下潜在重用的可靠性,分析源-目标子空间主角偏差与环境噪声对目标域得分误差的影响,提出混合源-目标训练方法以确定共享潜在维度的依赖关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13404 2026-05-14 cs.SD 78%

Seconds-Aligned PCA-DAC Latent Diffusion for Symbolic-to-Audio Drum Rendering

秒级对齐的PCA-DAC潜在扩散用于符号到音频鼓渲染

Konstantinos Soiledis, Maximos Kaliakatsos Papakostas, Dimos Makris, Konstantinos Tsamis

机构 * Dept. of Music Technology and Acoustics, Hellenic Mediterranean University(音乐技术与声学系,希腊地中海大学) Athena RC(雅典研究中心)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出Sec2Drum-DAC模型,通过PCA-DAC在符号到音频鼓渲染中实现精确的时间和动态控制,提升频谱和瞬态指标,同时优化去噪步骤与指标的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13399 2026-05-14 cs.LG cs.IT math.IT 78%

The Diffusion Encoder

扩散编码器

Akhil Premkumar, Sarah Lucioni

机构 * Department of Physics(物理系) University of California San Diego(加州大学圣地亚哥分校) Independent Researcher(独立研究者)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出一种新型编码器,利用扩散模型的表达能力,通过交替训练方案解决解码器与编码器之间的同步问题,保持了标准扩散模型的简单高效训练目标。

Comments 22 pages + references, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11726 2026-05-14 cs.LG 78%

Block-R1: Rethinking the Role of Block Size in Multi-domain Reinforcement Learning for Diffusion Large Language Models

Block-R1: 重新审视块大小在多领域强化学习中的作用以提升扩散大语言模型

Yan Jiang, Ruihong Qiu, Zi Huang

机构 * The University of Queensland(昆士兰大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文从领域冲突角度研究多领域场景下扩散大语言模型强化学习中的块大小问题,提出领域块大小冲突公式、Block-R1-41K数据集、Block-R1基准和跨领域强化学习方法,通过13个数据集和7种算法验证方法有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19185 2026-05-14 cs.LG 78%

MIDST Challenge at SaTML 2025: Membership Inference over Diffusion-models-based Synthetic Tabular data

MIDST挑战赛在SaTML 2025: 基于扩散模型的合成表格数据的成员推断

Masoumeh Shafieinejad, Xi He, Mahshid Alinoori, John Jewell, Sana Ayromlou, Wei Pang, Veronica Chatrath, Gauri Sharma, Deval Pandya

机构 * Vector Institute

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文探讨了基于扩散模型生成的合成表格数据在隐私保护方面的有效性,重点评估其对成员推断攻击的抗性,并开发了针对这些模型的新型攻击方法。

Comments 4 page, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06021 2026-05-14 stat.ML cs.LG cs.NA math.NA math.PR 78%

Diffusion Model's Generalization Can Be Characterized by Inductive Biases toward a Data-Dependent Ridge Manifold

扩散模型的泛化能力可以通过数据依赖的ridge流形的归纳偏差来表征

Ye He, Yitong Qiu, Molei Tao

机构 * Georgia Institute of Technology(佐治亚理工学院) University of Science and Technology of China(中国科学技术大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文研究扩散模型泛化能力的几何机制,通过引入时间依赖的log-density ridge流形,揭示生成样本在流形附近的运动规律,并通过实验验证了其在多模态数据和MNIST中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02791 2026-05-14 stat.ML cs.LG math.ST stat.TH 78%

Plug-In Classification of Drift Functions in Diffusion Processes Using Neural Networks

利用神经网络插件分类扩散过程中的漂移函数

Yuzhen Zhao, Jiarong Fan, Yating Liu

机构 * Université Paris-Dauphine, PSL Chaire DIALog, Fondation du Risque Institut Louis Bachelier(巴黎-第十大学,PSL DIALog研究中心,风险基金会路易·巴舍利埃研究所) LaMME, University of Paris-Saclay(LaMME,巴黎-萨克雷大学) CEREMADE, CNRS Université Paris-Dauphine, PSL(CEREMADE,国家科学研究中心巴黎-第十大学,PSL)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文研究扩散过程的监督多类分类,通过神经网络估计类特定漂移函数构建插件分类器,分析了漂移估计、时间离散化和维度对分类风险的影响,并通过数值实验验证了方法的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21033 2026-05-14 cs.LG 78%

Predict-Project-Renoise: Sampling Diffusion Models under Hard Constraints

预测-投影-重噪:在硬约束下采样扩散模型

Omer Rochman-Sharabi, Gilles Louppe

机构 * University of Liège(利根大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出PPR算法,在硬约束下采样预训练扩散模型,通过投影、重噪和迭代实现低约束违反和高分布保真度。

Comments Code coming soon

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.20570 2026-05-14 cond-mat.soft math.AP q-bio.SC 78%

Voltage laws in nanodomains revealed by asymptotics and simulations of electro-diffusion equations

通过渐近分析和电扩散方程的模拟揭示纳米域中的电压定律

Frédéric Paquin-Lefebvre, Alejandro Barea Moreno, David Holcman

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文通过渐近分析和模拟研究纳米域中离子电流通过膜通道驱动的局部电压分布,揭示了小和大电荷 regime 中的离子分布和电压降,验证了理论预测。

Comments 30 pages, 7 figures, 3 tables

Journal ref Multiscale Modeling and Simulation, 24(1), 365-397 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13296 2026-05-14 cs.AI cs.LG cs.MA 78%

Discrete Diffusion for Complex and Congested Multi-Agent Path Finding with Sparse Social Attention

离散扩散用于复杂且拥堵的多智能体路径寻找与稀疏社交注意

Yuanzhe Wang, Tian Zhi, Zihang Wei, Hongguang Wang, Jiaming Guo, Yang Zhao, Zisheng Liu, Shiyu Quan, Xing Hu, Zidong Du, Yunji Chen

机构 * State Key Lab of Processors, Institute of Computing Technology, CAS(中国科学院计算技术研究所处理器重点实验室) School of Advanced Interdisciplinary Sciences, CAS(中国科学院高等交叉学科学院) University of Chinese Academy of Sciences(中国科学院大学) Institute of Microelectronics, CAS(中国科学院微电子研究所)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出DiffLNS框架,结合离散去噪扩散概率模型与LNS2,通过稀疏社交注意学习多智能体轨迹先验,提升多智能体路径寻找的修复效率与成功率。

Comments 24 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13043 2026-05-14 cs.CL 78%

Adaptive Steering and Remasking for Safe Generation in Diffusion Language Models

自适应转向与重掩码用于扩散语言模型中的安全生成

Yejin Lee, Yo-Sub Han

机构 * Department of Computer Science(计算机科学系) Yonsei University(延世大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出基于去噪过程分步干预的安全防御框架,通过对比安全方向(SGD)检测有害生成并重掩码以提高安全性,实验显示有效降低逃逸成功率至0.64%。

Comments 17 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏