arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-03-27 至 2026-03-27 共收录 92 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 7 篇

2511.22989 2026-03-27 cs.CV 88%

MultiBanana: A Challenging Benchmark for Multi-Reference Text-to-Image Generation

MultiBanana:多参考文本到图像生成的挑战性基准

Yuta Oshima, Daiki Miyake, Kohsei Matsutani, Yusuke Iwasawa, Masahiro Suzuki, Yutaka Matsuo, Hiroki Furuta

机构 * The University of Tokyo(东京大学) Google DeepMind(谷歌DeepMind)

专题命中 文生图 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

AI总结 本文提出MultiBanana基准,用于评估多参考文本到图像生成模型的能力,涵盖参考数量变化、领域不匹配、尺度不匹配、罕见概念和多语言参考等挑战,分析不同模型的性能与不足。

Comments Accepted to CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12760 2026-03-27 cs.MM cs.AI cs.CV 87%

A User-Friendly Framework for Generating Model-Preferred Prompts in Text-to-Image Synthesis

一种用户友好的生成模型偏好提示框架

Nailei Hei, Qianyu Guo, Zihao Wang, Yan Wang, Haofen Wang, Wenqiang Zhang

专题命中 文生图 :text-to-image(title,abstract);image synthesis(title);分类 cs.CV、cs.MM

AI总结 本文提出UF-FGTG框架,通过粗细粒度提示数据集和自适应特征提取模块,自动优化用户输入提示以生成更高质量的图像。

Comments Accepted by The 38th Annual AAAI Conference on Artificial Intelligence (AAAI 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24965 2026-03-27 cs.CV cs.AI 83%

Self-Corrected Image Generation with Explainable Latent Rewards

可解释性潜在奖励的自校正图像生成

Yinyi Luo, Hrishikesh Gokhale, Marios Savvides, Jindong Wang, Shengfeng He

机构 * Carnegie Mellon University(卡内基梅隆大学) Singapore Management University(新加坡管理大学) William & Mary(威廉与玛丽学院)

专题命中 文生图 :image generation(title,abstract);text-to-image(abstract);分类 cs.CV

AI总结 本文提出xLARD框架,利用多模态大语言模型通过可解释性潜在奖励指导生成,改进语义对齐和视觉保真度,同时保持生成先验。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21208 2026-03-27 cs.CV cs.LG 83%

JANUS: A Lightweight Framework for Jailbreaking Text-to-Image Models via Distribution Optimization

JANUS:通过分布优化轻量级框架实现文本到图像模型的 jailbreak 攻击

Haolun Zheng, Yu He, Tailun Chen, Shuo Shao, Zhixuan Chu, Hongbin Zhou, Lan Tao, Zhan Qin, Kui Ren

机构 * The State Key Laboratory of Blockchain and Data Security(区块链与数据安全国家重点实验室) Alibaba Group(阿里巴巴集团) Hangzhou HighTech Zone (Binjiang) Blockchain and Data Security Research Institute(杭州高新技术区(滨江)区块链与数据安全研究院)

专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 JANUS 通过分布优化实现文本到图像模型的 jailbreak 攻击,提升 ASR-8 评分并保持语义,适用于开源和商业模型。

Comments This paper is accepted by the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2026. 18 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25738 2026-03-27 cs.CV 57%

PSDesigner: Automated Graphic Design with a Human-Like Creative Workflow

PSDesigner: 基于人类创意流程的自动化图形设计

Xincheng Shuai, Song Tang, Yutong Huang, Henghui Ding, Dacheng Tao

机构 * Institute of Big Data, College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与技术学院大数据研究所) Generative AI Lab, College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院生成式人工智能实验室)

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

AI总结 PSDesigner通过模拟人类设计师的创意流程,实现了自动化图形设计,通过设计数据集CreativePSD提升工具使用能力,在多种设计任务中优于现有方法,使非专业人士能轻松创建高质量设计。

Comments CVPR 2026, Project Page: https://henghuiding.com/PSDesigner/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05042 2026-03-27 cs.CV cs.RO 57%

CoIn3D: Revisiting Configuration-Invariant Multi-Camera 3D Object Detection

CoIn3D:重新审视配置不变的多摄像头3D目标检测

Zhaonian Kuang, Rui Ding, Haotian Wang, Xinhu Zheng, Meng Yang, Gang Hua

机构 * National Key Laboratory of Human-Machine Hybrid Augmented Intelligence, Institute of Artificial Intelligence and Robotics, Xi’an Jiaotong University(西安交通大学人工智能与机器人研究所人机混合增强智能全国重点实验室) Intelligent Transportation Thrust of the Systems Hub, HKUST(GZ)(香港科技大学(广州)系统枢纽智能交通学域) Amazon Alexa AI(亚马逊Alexa人工智能)

专题命中 文生图 :image synthesis(abstract);分类 cs.CV

AI总结 本文提出CoIn3D框架,通过空间先验整合和摄像头感知数据增强,提升多摄像头3D目标检测在不同配置下的泛化能力。

Comments Accepted to CVPR 2026 main track

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24730 2026-03-27 cs.CV 57%

A Framework for Generating Semantically Ambiguous Images to Probe Human and Machine Perception

一种生成语义模糊图像的框架以探测人类和机器感知

Yuqi Hu, Vasha DuTell, Ahna R. Girshick, Jennifer E. Corbett

机构 * University of California, Berkeley(加州大学伯克利分校) Massachusetts Institute of Technology(麻省理工学院)

专题命中 文生图 :image synthesis(abstract);分类 cs.CV

AI总结 该研究通过生成语义模糊图像探讨人类和机器感知的边界,揭示模型在概念区分上的偏差,展示控制模糊性作为诊断工具的价值。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 图像编辑 5 篇

2603.00141 2026-03-27 cs.CV cs.AI cs.LG eess.IV 85%

From Scale to Speed: Adaptive Test-Time Scaling for Image Editing

从尺度到速度:面向图像编辑的自适应测试时间缩放

Xiangyan Qu, Zhenlong Yuan, Jing Tang, Rui Chen, Datao Tang, Meng Yu, Lei Sun, Yancheng Bai, Xiangxiang Chu, Gaopeng Gou, Gang Xiong, Yujun Cai

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络空间安全学院) AMAP, Alibaba Group(阿里巴巴集团高德地图) University of Queensland(昆士兰大学)

专题命中 图像编辑 :image editing(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

AI总结 本文提出ADE-CoT框架,通过动态资源分配、编辑特定验证和深度优先停止策略,提升图像编辑效率与性能,实验显示在同等采样预算下性能优于现有方法。

Comments Accepted to the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25502 2026-03-27 cs.CV 79%

RealRestorer: Towards Generalizable Real-World Image Restoration with Large-Scale Image Editing Models

RealRestorer:迈向通用的现实世界图像修复的大型图像编辑模型

Yufeng Yang, Xianfang Zeng, Zhangqi Jiang, Fukun Yin, Jianzhuang Liu, Wei Cheng, jinghong lan, Shiyu Liu, Yuqi Peng, Gang YU, Shifeng Chen

机构 * Southern University of Science and Technology(南方科技大学) StepFun Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院) Shenzhen University of Advanced Technology(深圳理工大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 本文提出RealRestorer,通过构建大规模数据集和训练先进开源模型,提升现实世界图像修复的泛化能力,并引入RealIR-Bench评估基准,实验表明其在开源方法中表现最佳。

Comments 27 pages, 15 figures, Project homepage: https://yfyang007.github.io/RealRestorer/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12200 2026-03-27 cs.CV 79%

CompBench: Benchmarking Complex Instruction-guided Image Editing

CompBench:复杂指令引导图像编辑的基准测试

Bohan Jia, Wenxuan Huang, Yuntian Tang, Junbo Qiao, Jincheng Liao, Shaosheng Cao, Fei Zhao, Zhaopeng Feng, Zhouhong Gu, Zhenfei Yin, Lei Bai, Wanli Ouyang, Lin Chen, Fei Zhao, Yao Hu, Zihan Wang, Yuan Xie, Shaohui Lin

机构 * East China Normal University(华东师范大学) Xiaohongshu Inc.(小红书) KLATASDS, MOE, China(中国教育部统计与数据科学重点实验室) The Chinese University of Hong Kong(香港中文大学) Zhejiang University(浙江大学) Fudan University(复旦大学) University of Oxford(牛津大学) Shanghai Jiao Tong University(上海交通大学) University of Science and Technology of China(中国科学技术大学) Nanjing University(南京大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 CompBench旨在解决现有图像编辑基准测试对任务复杂度简化的问题,通过引入复杂指令引导的图像编辑基准,评估模型在精细操控能力上的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08881 2026-03-27 cs.CV cs.AI 70%

TAG-MoE: Task-Aware Gating for Unified Generative Mixture-of-Experts

TAG-MoE:基于任务的门控用于统一的生成混合专家

Yu Xu, Hongbin Yan, Juan Cao, Yiji Cheng, Tiankai Hang, Runze He, Zijin Yin, Shiyi Zhang, Yuxin Zhang, Jintao Li, Chunyu Wang, Qinglin Lu, Tong-Yee Lee, Fan Tang

机构 * University of Chinese Academy of Sciences(中国科学院大学) Tencent Hunyuan(腾讯文言) National Cheng-Kung University(国立成功大学)

专题命中 图像编辑 :image generation(abstract);diffusion(abstract);分类 cs.CV

AI总结 本文提出TAG-MoE框架,通过引入层次化任务语义标注方案和预测对齐正则化,解决密集扩散变换器架构中任务干扰问题,提升生成质量和保真度。

Comments Accept by CVPR 2026. Project page: https://yuci-gpt.github.io/TAG-MoE/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22883 2026-03-27 cs.CV 57%

Group Editing: Edit Multiple Images in One Go

组级编辑:一次操作编辑多张图像

Yue Ma, Xinyu Wang, Qianli Ma, Qinghe Wang, Mingzhe Zheng, Xiangpeng Yang, Hao Li, Chongbo Zhao, Jixuan Ying, Harry Yang, Hongyu Liu, Qifeng Chen

机构 * HKUST(香港科技大学) THU(清华大学) SJTU(上海交通大学) University of Technology Sydney(悉尼科技大学)

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

AI总结 本文提出组级编辑框架,通过显式和隐式关系建立实现多图像一致修改,引入融合机制和新数据集提升编辑质量与一致性。

Comments Accepted by CVPR 2026, Project page: https://group-editing.github.io/, Github: https://github.com/mayuelala/GroupEditing

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 扩散模型 62 篇

2603.25181 2026-03-27 cs.CV 89%

VolDiT: Controllable Volumetric Medical Image Synthesis with Diffusion Transformers

VolDiT:基于扩散变换器的可控体积医学图像合成

Marvin Seyfarth, Salman Ul Hassan Dar, Yannik Frisch, Philipp Wild, Norbert Frey, Florian André, Sandy Engelhardt

机构 * Institute for Artificial Intelligence in Cardiovascular Medicine, Medical Faculty of Heidelberg University, Heidelberg University(海德堡大学医学院心血管医学人工智能研究所) Department of Cardiology, Angiology, Pneumology, Heidelberg University Hospital(海德堡大学医院心脏病学、血管学、肺病学系) DZHK (German Centre for Cardiovascular Research), Partner Site Heidelberg/Mannheim(德国心血管研究中心(DZHK)海德堡/曼海姆合作站点) University Medical Center of the Johannes Gutenberg-University Mainz(美因茨约翰内斯·古腾堡大学医学中心)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(title,abstract);image generation(abstract);分类 cs.CV

AI总结 本文提出VolDiT,首个纯变压器架构的3D扩散模型,通过体积块嵌入和全局自注意力实现3D数据处理,引入时间步门控控制适配器提升生成可控性,实验证明其在医学图像合成中具有更高的全局一致性与生成保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.11605 2026-03-27 cs.CV cs.AI cs.LG 87%

Scalable High-Resolution Pixel-Space Image Synthesis with Hourglass Diffusion Transformers

可扩展的高分辨率像素空间图像合成与Hourglass扩散变换器

Katherine Crowson, Stefan Andreas Baumann, Alex Birch, Tanishq Mathew Abraham, Daniel Z. Kaplan, Enrico Shippole

机构 * Birchlabs, England, United Kingdom(英国英格兰Birchlabs实验室) Independent Researcher, Florida, United States(美国佛罗里达独立研究员)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(title);分类 cs.CV

AI总结 本文提出Hourglass Diffusion Transformer,通过线性扩展像素数量实现高分辨率图像生成,无需传统高分辨率训练技术, 在ImageNet和FFHQ数据集上取得新突破。

Comments 20 pages, 13 figures, project page and code available at https://crowsonkb.github.io/hourglass-diffusion-transformers/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25194 2026-03-27 cs.CV 83%

CardioDiT: Latent Diffusion Transformers for 4D Cardiac MRI Synthesis

CardioDiT:用于4D心脏MRI合成的潜在扩散变换器

Marvin Seyfarth, Sarah Kaye Müller, Arman Ghanaat, Isabelle Ayx, Fabian Fastenrath, Philipp Wild, Alexander Hertel, Theano Papavassiliu, Salman Ul Hassan Dar, Sandy Engelhardt

机构 * Institute for Artificial Intelligence in Cardiovascular Medicine, Medical Faculty of Heidelberg University, Heidelberg University(海德堡大学医学院心血管医学人工智能研究所,海德堡大学) Department of Cardiology, Angiology, Pneumology, Heidelberg University Hospital(海德堡大学医院心脏病学、血管学、肺病学系) DZHK (German Centre for Cardiovascular Research), Partner Site Heidelberg/Mannheim(德国心血管研究中心(DZHK),海德堡/曼海姆合作站点) Department of Radiology and Nuclear Medicine, University Medical Center Mannheim(曼海姆大学医学中心放射学与核医学系) Section for Invasive Cardiology and Electrophysiology, I. Medical Department, Cardiology, Hemostasiology and Intensive Care, University Medical Centre Mannheim(曼海姆大学医学中心第一内科(心脏病学、止血学与重症监护)介入心脏病学与电生理学科) University Medical Center of the Johannes Gutenberg-University Mainz(美因茨约翰内斯·古腾堡大学医学中心) Department of Cardiology, Angiology, Hemostasis, and Medical Intensive Care, University Medical Centre Mannheim, Medical Faculty Mannheim, University of Heidelberg(海德堡大学曼海姆医学院曼海姆大学医学中心心脏病学、血管学、止血学与内科重症监护系)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

AI总结 本文提出CardioDiT,一种基于扩散变换器的4D潜在扩散模型,用于合成短轴 cine CMR,通过联合建模空间和时间实现连续心脏动态生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17900 2026-03-27 cs.CV cs.RO 83%

Diffusion Forcing for Multi-Agent Interaction Sequence Modeling

扩散力场用于多智能体交互序列建模

Vongani H. Maluleke, Kie Horiuchi, Lea Wilken, Evonne Ng, Jitendra Malik, Angjoo Kanazawa

机构 * Sony Group Corporation(索尼集团公司) Meta UC Berkeley(加州大学伯克利分校)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

AI总结 本文提出MAGNet框架,通过灵活的条件和采样生成多智能体运动序列,支持多种交互任务,实现长序列生成和智能体间协调。

Comments Project page: https://von31.github.io/MAGNet/ ; Code: https://github.com/Von31/MAGNet-code

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23022 2026-03-27 cs.CV 83%

DMAligner: Enhancing Image Alignment via Diffusion Model Based View Synthesis

DMAligner:通过扩散模型基于视角合成增强图像对齐

Xinglong Luo, Ao Luo, Zhengning Wang, Yueqi Yang, Chaoyu Feng, Lei Lei, Bing Zeng, Shuaicheng Liu

机构 * University of Electronic Science and Technology of China(电子科技大学) Qianyuan Laboratory(钱元实验室) Southwest Jiaotong University(西南交通大学) Independent Researcher(独立研究者)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

AI总结 DMAligner通过扩散模型基于视角合成的方法提升图像对齐效果,解决传统光流方法在遮挡和光照变化下的局限性,提出动态感知扩散训练和动态场景图像对齐数据集。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15132 2026-03-27 cs.CV 79%

WiT: Waypoint Diffusion Transformers via Trajectory Conflict Navigation

WiT:通过轨迹冲突导航实现方式点扩散变换

Hainuo Wang, Mingjia Li, Xiaojie Guo

机构 * College of Intelligence and Computing, Tianjin University(天津大学智能与计算学部)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出WiT,通过分解连续向量场中的语义方式点,解决像素空间中的轨迹冲突问题,提升扩散生成效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02193 2026-03-27 cs.CV 79%

SSI-DM: Singularity Skipping Inversion of Diffusion Models

SSI-DM:扩散模型的奇点跳过反演

Chen Min, Enze Jiang, Jishen Peng, Zheng Ma

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出SSI-DM方法,通过在标准反演前添加小噪声跳过奇点,实现具有自然高斯性质的噪声反演,提升扩散模型的重建和插值性能。

Comments A complete revision is needed

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18822 2026-03-27 cs.CV 79%

DiP: Taming Diffusion Models in Pixel Space

DiP:在像素空间中驯服扩散模型

Zhennan Chen, Junwei Zhu, Xu Chen, Jiangning Zhang, Xiaobin Hu, Hanzhen Zhao, Chengjie Wang, Jian Yang, Ying Tai

机构 * Nanjing University(南京大学) Tencent Youtu Lab(腾讯优图实验室) National University of Singapore(新加坡国立大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 DiP提出一种高效的像素空间扩散框架,通过解耦生成过程为全局和局部阶段,结合Diffusion Transformer和轻量级Patch Detailer Head,在不依赖VAE的情况下实现高效生成,推理速度提升10倍,FID分数达1.79。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24938 2026-03-27 cs.CV 79%

Infinite Gaze Generation for Videos with Autoregressive Diffusion

视频无限 gaze 生成的自回归扩散模型

Jenna Kang, Colin Groth, Tong Wu, Finley Torrens, Patsorn Sangkloy, Gordon Wetzstein, Qi Sun

机构 * New York University(纽约大学) Stanford University(斯坦福大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出一种自回归扩散模型,用于生成任意长度视频的无限 horizon 原始 gaze,通过在 saliency-aware 视觉潜在空间中条件化,提升长程时空准确性和轨迹真实性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24764 2026-03-27 cs.CV cs.LG 79%

Synthetic Cardiac MRI Image Generation using Deep Generative Models

利用深度生成模型合成心脏MRI图像

Ishan Kumarasinghe, Dasuni Kawya, Madhura Edirisooriya, Isuri Devindi, Isuru Nawinne, Vajira Thambawita

机构 * Department of Computer Engineering(计算机工程系) University of Peradeniya(珀德尼亚大学) University of Maryland(马里兰大学) Department of Holistic Systems(整体系统系) SimulaMet Oslo, Norway(挪威奥斯陆)

专题命中 扩散模型 :image generation(title);diffusion(abstract);分类 cs.CV

AI总结 本文综述了通过深度生成模型生成合成心脏MRI图像的方法,探讨了在保真度、实用性和隐私方面现有技术的局限性,并强调了需要集成评估驱动框架以确保临床工作流程的可靠性。

Comments 12 pages, 2 figures, Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20951 2026-03-27 cs.CV cs.AI 79%

See and Fix the Flaws: Enabling VLMs and Diffusion Models to Comprehend Visual Artifacts via Agentic Data Synthesis

查看并修复缺陷:通过代理数据合成使VLMs和扩散模型能够理解视觉缺陷

Jaehyun Park, Minyoung Ahn, Minkyu Kim, Jonghyun Lee, Jae-Gil Lee, Dongmin Park

机构 * KAIST(韩国科学技术院) Seoul National University(首尔国立大学) KRAFTON

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出ArtiAgent,通过代理数据合成生成真实与带缺陷图像对,有效减少视觉缺陷,提升模型对视觉缺陷的理解能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25659 2026-03-27 cond-mat.quant-gas cond-mat.stat-mech 78%

Diffusion in interacting two-dimensional systems under a uniform magnetic field

二维相互作用系统在均匀磁场下的扩散

Łukasz Iwanek, Marcin Mierzejewski, Adam S. Sajna

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 研究二维费米子系统在均匀磁场下的扩散行为,发现强相互作用抑制磁场效应,而当相互作用与动能相当时,磁场显著降低扩散。

Comments 9 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25462 2026-03-27 cs.RO cs.AI 78%

Temporally Decoupled Diffusion Planning for Autonomous Driving

时间解耦的扩散规划用于自动驾驶

Xiang Li, Bikun Wang, John Zhang, Jianjun Wang

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出时间解耦扩散模型(TDDM),通过噪声掩码方法解决动态城市环境中即时安全与长期目标的平衡问题,改进轨迹生成并提升复杂场景下的规划性能。

Comments icaps

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06754 2026-03-27 physics.data-an hep-ex 78%

Learning the Standard Model Manifold: Bayesian Latent Diffusion for Collider Anomaly Detection

学习标准模型流形:基于贝叶斯潜在扩散的碰撞异常检测

Jigar Patel, Tommaso Dorigo

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出基于贝叶斯潜在扩散模型的碰撞数据异常检测框架,结合概率编码与潜在空间扩散动力学,通过物理约束提升密度估计稳定性,通过实验验证其在LHC喷注数据中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21251 2026-03-27 cond-mat.soft 78%

Tracer Diffusion in Granular Suspensions: Testing the Enskog Kinetic Theory with DSMC and Molecular Dynamics

颗粒悬浮液中的示踪扩散:利用DSMC和分子动力学测试Enskog动力学理论

Antonio M. Puertas, Rubén Gómez González

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 研究颗粒气体中示踪粒子的扩散,结合DSMC和分子动力学模拟,验证Enskog动力学理论在不同摩擦参数和颗粒质量下的可靠性。

Comments 20 pages, 11 figures, to be published in Physical Review E

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24296 2026-03-27 cs.CL cs.AI 78%

DiffuGuard: How Intrinsic Safety is Lost and Found in Diffusion Large Language Models

DiffuGuard: 差分扩散语言模型中内在安全的丧失与恢复

Zherui Li, Zheng Nie, Zhenhong Zhou, Yue Liu, Yitong Zhang, Yu Cheng, Qingsong Wen, Kun Wang, Yufei Guo, Jiaheng Zhang

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学) Tsinghua University(清华大学) The Chinese University of Hong Kong(香港中文大学) Squirrel Ai Learning(松鼠AI) Peking University(北京大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文分析了差分扩散语言模型在对抗攻击中的脆弱性,提出DiffuGuard框架通过随机退火重标记和块级审计修复提升模型安全性,有效降低攻击成功率。

Comments Accepted by ICLR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19897 2026-03-27 stat.ML cs.AI cs.LG 78%

The Information Dynamics of Generative Diffusion

生成扩散的信息动力学

Dejan Stancevic, Luca Ambrogioni

机构 * Donders Institute for Brain, Cognition and Behaviour(唐德斯脑、认知与行为研究所) Radboud University(拉德堡德大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文从信息论、动力学和热力学角度探讨生成扩散模型,揭示生成带宽由分数函数发散率决定,通过轨迹分支和生成分岔现象,建立受控噪声诱导对称破缺过程。

Comments 25 pages

Journal ref Entropy 2026, 28(2), 195

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.10431 2026-03-27 cs.LG stat.ML 78%

Continuous Diffusion for Mixed-Type Tabular Data

连续扩散用于混合类型表格数据

Markus Mueller, Kathrin Gruber, Dennis Fok

机构 * Econometric Institute, Erasmus University Rotterdam(伊拉斯姆斯大学鹿特丹分校经济计量研究所)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出CDTD模型,通过结合分数匹配与分数插值,统一连续和分类特征的噪声分布,提升混合类型表格数据生成性能。

Comments published at ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏