arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-08-14 至 2026-08-14 共收录 102 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 78 篇

2608.03025 2026-08-14 cs.AI 版本更新 78%

DiffImaginE: Imagine to Verify Entity Types with Diffusion

DiffImaginE:通过想象验证实体类型

Feng Zhang, Feiyu Han, Rongxin Yang, Yang Liu, Yancheng Chen, Rui Wang, Yingguang Yang, Tian Xueyun, Chongyang Zhang, Hao Zheng, Xu Kefu, Congjing Ran, Fuhai Chen, Bin Chong

机构 * Fuzhou University(福州大学) Chinese Academy of Sciences(中国科学院) Peking University(北京大学) Alibaba Group(阿里巴巴集团) University of Science and Technology of China(中国科学技术大学) Fullive Innovation (Beijing) AI Technology Co., Ltd.(福莱创新(北京)人工智能科技有限公司) Baidu(百度) Wuhan University(武汉大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 DiffImaginE将多模态命名实体识别的类型验证建模为条件潜在扩散推理,在Twitter-2015和Twitter-2017数据集上,相比确定性对照模型取得了一致的性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02575 2026-08-14 cs.LG stat.ML 版本更新 78%

Pseudorandom Streams within Diffusion Models Act as Learnable Inputs That Affect Generation Quality

扩散模型中的伪随机流是影响生成质量的可学习输入

Shengzhi Deng, Chenqi Ye, Yanze Guo

机构 * School of Mathematics, Harbin Institute of Technology(哈尔滨工业大学数学学院) Software College, Northeastern University(东北大学软件学院)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 该研究发现扩散模型的伪随机流是可学习输入,会影响生成质量,相关指标与生成退化相关,伪随机源兼具分布选择与结构化输入属性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00675 2026-08-14 stat.ML cs.LG physics.comp-ph physics.plasm-ph 版本更新 78%

Round-Trip Consistency: Bidirectional Diffusion Models Can Predict Their Own Rollout Errors

往返一致性:双向扩散模型可预测自身的推演误差

Alexander Scheinker

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 该研究提出双向扩散模型的往返偏差可作为自监督代理预测生成模型推演误差,在多类任务中验证其有效性,兼具逆求解功能且训练成本低。

Comments Code: https://github.com/alexscheinker/round-trip-consistency

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28166 2026-08-14 cs.CL cs.AI 版本更新 78%

Commit Locally, Exit Globally: Coordinating Adaptive Sampling and Early Exit in Diffusion Language Models

提交时机与位置:扩散语言模型的候选感知解码

Chia-Ming Lee, Shao-Kai Liu, Ming-Ching Chang, Xin Li, Yu-Lun Liu, Chih-Chung Hsu

机构 * National Yang Ming Chiao Tung University(国立阳明交通大学) University at Albany, SUNY(纽约州立大学奥尔巴尼分校)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 该研究针对扩散语言模型解码过早终止问题,提出无训练的候选感知提前退出框架LATCH,结合CVC与BWEC,在零样本11项任务上,以准确率损失极小的代价实现多倍解码速度提升。

Comments Code is available at https://github.com/ming053l/C4-dLLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10523 2026-08-14 quant-ph 78%

Quantum Mechanics as a Reversible Diffusion Theory

量子力学作为可逆扩散理论

Charalampos Antonakos

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文通过时间对称随机动力学和非经典概率论,将波函数及其复共轭解释为复扩散方程中的复概率分布,提出量子力学的一种新诠释,并基于纯概率论推导叠加原理,解释经典与量子行为的差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02143 2026-08-14 physics.flu-dyn 版本更新 78%

Turbulence generation and data assimilation in wall-bounded flows with a latent diffusion model

基于潜扩散模型的壁面湍流生成与数据同化

Fabian Steinbrenner, Baris Turan, Hao Teng, Heng Xiao

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 提出一种结合β-VAE与基于Transformer的扩散模型的生成框架,用于壁面湍流的数据同化,在雷诺数Re_h=1300的平面库埃特流中实现了O(10^5)的压缩比,并揭示了条件扩散模型在保持物理保真度与样本多样性之间的权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10006 2026-08-14 math.AP nlin.PS 版本更新 78%

Geometry-induced pulse dynamics in a bulk-surface reaction-diffusion system for cell polarization

几何诱导的脉冲动力学在细胞极化的大体积-表面反应扩散系统中

Riku Watanabe

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文研究了二维域中细胞极化的大体积-表面反应扩散系统,通过波固定机制形成局部模式,结合细胞形状效应,利用奇异性扰动方法推导了描述波固定动力学的常微分方程,并分析了由域几何引起的现象,如非平凡脉冲位置和超临界及亚临界分岔。

Comments 35 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05197 2026-08-14 cs.CL 版本更新 78%

Masked diffusion LLMs can use EoS tokens for hidden reasoning

扩散语言模型可以按EoS进行思考

Sarah Breckner, Sebastian Schuster

机构 * Faculty of Computer Science, University of Vienna(维也纳大学计算机科学系) UniVie Doctoral School Computer Science, University of Vienna(维也纳大学计算机科学博士学院)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 研究发现扩散语言模型通过EoS标记进行推理,通过实验验证EoS标记作为隐藏计算空间的作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12455 2026-08-14 physics.flu-dyn 78%

Generative Reconstruction of Spatiotemporal Wall-Pressure in Turbulent Boundary Layers via Patchwise Latent Diffusion

Xiantao Fan, Meet Hemant Parikh, Yi Liu, Xin-Yang Liu, Junyi Guo, Meng Wang, Jian-Xun Wang

专题命中 扩散模型 :diffusion(title,abstract)

Comments 57 pages, 38 figures

Journal ref Phys. Rev. Fluids 11, 084607, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21805 2026-08-14 cs.IR cs.AI cs.LG 版本更新 78%

DiffGRM: Diffusion-based Generative Recommendation Model

DiffGRM:基于扩散的生成式推荐模型

Zhao Liu, Yichen Zhu, Yiqing Yang, Xiao Lv, Guoping Tang, Rui Huang, Qiang Luo, Ruiming Tang, Kun Gai, Guorui Zhou

机构 * Kuaishou Technology(快手科技)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 针对生成式推荐中SID的结构问题,提出DiffGRM模型,通过MDM、PSE、OCN、CPD等技术优化,在多数据集上使NDCG@10提升6.9%-15.5%。

Comments 12 pages, 6 figures. Accepted at The ACM Web Conference 2026. Camera-ready version; author list updated to match the published version; presentation revised, results unchanged

Journal ref Proceedings of the ACM Web Conference 2026 (WWW '26), pp. 5853-5864, ACM, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09151 2026-08-14 cs.LG math.ST stat.ML stat.TH 版本更新 78%

Regularization can make diffusion models more efficient

正则化可提升扩散模型的效率

Mahsa Taheri, Johannes Lederer

机构 * University of Hamburg(汉堡大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 该研究针对扩散模型计算成本高的问题,提出利用统计学中的稀疏性概念,通过数学证明和实验验证表明,引入稀疏性可降低计算复杂度并提升样本质量,从而实现更高效的扩散模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11692 2026-08-14 math.AP 版本更新 78%

Asymptotic large time behavior of singular entire solutions of the fast diffusion equation

快扩散方程奇异整体解的渐近大时间行为

Kin Ming Hui, Jongmyeong Kim

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 该研究针对快扩散方程,采用不动点方法证明了一类满足特定条件的奇异径向对称前向自相似解的存在性,得到解在原点附近的渐近展开,并分析了满足对应初值条件的奇异解的渐近大时间行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21783 2026-08-14 cs.CV 版本更新 77%

SHARP: Spectrum-aware Highly-dynamic Adaptation for Resolution Promotion in Remote Sensing Synthesis

SHARP: 为遥感合成促进分辨率提升的频谱感知高动态适应

Bingxuan Zhao, Qing Zhou, Chuang Yang, Junyu Gao, Qi Wang

机构 * School of Computer Science, Northwestern Polytechnical University, Xi'an, China(计算机科学学院,西北工业大学,西安,中国) School of Artificial Intelligence, OPtics and ElectroNics (iOPEN), Northwestern Polytechnical University, Xi'an, China(人工智能学院,光学与电子学(iOPEN),西北工业大学,西安,中国)

专题命中 扩散模型 :text-to-image(abstract);diffusion(abstract);image synthesis(abstract);分类 cs.CV

AI总结 本文提出SHARP方法,通过频谱感知的高动态适应策略,在无需训练的情况下提升遥感图像分辨率,优于现有无训练基线,在CLIP分数、审美分数和HPSv2上表现更优。

Comments Accepted by the 34th ACM International Conference on Multimedia (ACM MM 2026)

Journal ref Proceedings of the 34th ACM International Conference on Multimedia (ACM MM 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13205 2026-08-14 cs.CV 新提交 74%

HPSD: Hybrid-Policy Self-Distillation for Text-Image-to-Video Diffusion Models

HPSD:用于文本-图像转视频扩散模型的混合策略自蒸馏

Jiazi Bu, Pengyang Ling, Yujie Zhou, Yibin Wang, Yuhang Zang, Xuanlang Dai, Shengyuan Ding, Tianyi Wei, Xiaohang Zhan, Jiaqi Wang, Tong Wu, Dahua Lin, Xingang Pan

机构 * Shanghai Jiao Tong University(上海交通大学) S-Lab, Nanyang Technological University(新加坡南洋理工大学S-Lab实验室) University of Science and Technology of China(中国科学技术大学) Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) Shanghai AI Laboratory(上海人工智能实验室) Adobe Research(奥多比研究院) The Chinese University of Hong Kong(香港中文大学) CPII under InnoHK(InnoHK下属CPII机构)

专题命中 扩散模型 :diffusion(title);分类 cs.CV

AI总结 本研究提出HPSD混合策略自蒸馏框架,通过让同一TI2V模型在不同条件下分别充当教师与学生,解决现有自蒸馏方法的缺陷,显著提升T2V及TI2V生成性能,强化模型基础生成能力。

Comments Project Website: https://bujiazi.github.io/hpsd.github.io/ Code: https://github.com/Bujiazi/HPSD

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12344 2026-08-14 cs.CL cs.CY stat.AP 新提交 71%

Predicting consumer-technology ownership without a diffusion history

基于扩散历史预测消费技术拥有情况

Irina Vartanova, Niels Selling, Jennifer Viberg Johansson, Pontus Strimling

专题命中 扩散模型 :diffusion(title)

AI总结 该研究利用人类及Anthropic Claude Opus 4.7、OpenAI GPT-5.5两款语言模型对消费技术的属性评分,通过符号约束惩罚回归预测技术拥有率,其效果优于上市年限基准模型,还对2025-2026年新品做了2027年拥有率预测。

Comments 31 pages, 4 figures, supplementary material included (Tables S1-S6, Figure S1), data and code at https://osf.io/dr5ct

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02711 2026-08-14 cs.CV 版本更新 70%

Hunyuan3D-Buffalo 1.0: A Unified Multimodal Model for Scalable 3D Generation, Understanding, and Editing

Hunyuan3D-Buffalo 1.0:用于可扩展3D生成、理解与编辑的统一多模态模型

Junliang Ye, Kenkun Liu, Guocun Wang, Yang Li, Yansong Qu, Chunshi Wang, Jingwei Xu, Yunhan Yang, Zibo Zhao, Jiachen Xu, Jiaao Yu, Lifu Wang, Zhihao Liang, Xin Huang, Zhuo Chen, Chunchao Guo

机构 * Tencent Hunyuan(腾讯混元)

专题命中 扩散模型 :image generation(abstract);diffusion(abstract);分类 cs.CV

AI总结 Hunyuan3D-Buffalo 1.0是支持3D理解、文本到3D生成等功能的统一多模态模型,构建87M规模语料库训练,在相关基准上达SOTA或领先性能,验证了统一训练的有效性。

Comments Project Page: https://tencent-hunyuan.github.io/Hunyuan3D-Buffalo1.0

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12416 2026-08-14 cs.RO 新提交 67%

RoboSynChallenge: Mastering Real-World Dexterity via Generalizing Synthesized Manipulation Skills

RoboSynChallenge:通过泛化合成操作技能掌握真实世界灵巧操作

Runyi Zhao, Ruixin Wu, Chengkun Li, Hongrui Zhang, Ang Li, Ruixing Jin, Yueci Deng, Yingying Guo, Lihe Ding, Shaocong Dong, Tianfan Xue, Yanjun Gao, Yudong Luo, Pascal Poupart, Simo Wu, Kui Jia, Wei-shi Zheng, Guiliang Liu

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) DexForce(德克斯力公司) The Chinese University of Hong Kong(香港中文大学) The Hong Kong University of Science and Technology(香港科技大学) University of Colorado Anschutz(科罗拉多大学安舒茨医学中心) Mila - Quebec AI Institute(米拉-魁北克人工智能研究所) Vector Institute(向量研究所) University of Waterloo(滑铁卢大学) Fudan University(复旦大学) Sun Yat-sen University(中山大学) Shenzhen Loop Area Institute (SLAI)(深圳环区研究所)

专题命中 扩散模型 :diffusion(abstract,abstract_cn)

AI总结 RoboSynChallenge竞赛推出统一基准,结合合成数据与真实评估,提供多类基准策略,旨在推动开发泛化性强、数据高效的机器人操作系统,助力通用机器人智能发展。

Comments NeurIPS 2026 Competition Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14614 2026-08-14 q-fin.MF 版本更新 67%

Pricing options on the cryptocurrency futures contracts

加密货币期货合约上的期权定价

Julia Kończal

专题命中 扩散模型 :diffusion(abstract,abstract_cn)

AI总结 本研究针对加密货币期权市场特性,校准评估多种期权定价模型,发现Kou模型对BTC期权、Bates模型对ETH期权定价误差最低,凸显纳入跳跃与随机波动率的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13460 2026-08-14 cs.CV 新提交 57%

SNM-VFI: Symmetric Nonlinear Motion-Guided Generative Video Frame Interpolation

SNM-VFI:对称非线性运动引导的生成式视频帧插值

Jisoo Jeong, Hong Cai, Jamie Menjay Lin, Hanno Ackermann, Hyeonjun Sim, Yinhao Zhu, Yunxiao Shi, Fatih Porikli

机构 * Qualcomm(高通公司)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 提出无需训练的SNM-VFI框架,结合预训练光流与视频扩散模型,用对称非线性运动模型引导生成过程,经多基准评估实现了优质视频帧插值效果。

Comments ECCVW 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13037 2026-08-14 cs.CV 新提交 57%

Spatially-Grounded Text-to-Video Generation via Inference-Time Gradient-Free Optimization

基于推理时无梯度优化的空间接地文本到视频生成

Guillaume Jeanneret, Mathis Koroglu, Hugo Caselles-Dupré, Arnaud Dapogny, Matthieu Cord

机构 * ISIR - Sorbonne Université(ISIR - 索邦大学) Obvious Research

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 针对文本到视频生成的空间可控性挑战,提出无训练无梯度的GATO-Vid方法,通过解析求解交叉注意力分数实现精确空间引导,在提升定位精度的同时降低计算开销。

Comments Final Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13028 2026-08-14 cs.CV cs.RO 新提交 57%

RGB-D Video Generation for Improving Human-to-Robot Object Handover Prediction

用于改进人机物体交接预测的RGB-D视频生成

Tianyu Sun, Zhoujie Fu, Zihui Gao, Bang Zhang, Guosheng Lin

机构 * Nanyang Technological University(南洋理工大学) College of Computing and Data Science(计算与数据科学学院) Zhejiang University(浙江大学) College of Computer Science and Technology(计算机科学与技术学院) Alibaba Group(阿里巴巴集团)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 针对人机物体交接数据集稀缺及现实-模拟差距问题,提出Hand2Bot数据集与PassGen生成流水线,实现高意图识别准确率与低误触发率,支持机器人稳健零样本迁移与早期意图预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12997 2026-08-14 cs.CV 新提交 57%

PixSDS: Why Latent SDS Makes Noisy Pixels

PixSDS:潜在SDS为何会产生带噪像素

Vsevolod Skorokhodov

机构 * EPFL(洛桑联邦理工学院)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 针对潜在SDS生成3D时的像素漂移问题,提出轻量级VAE一致性梯度修复方法PixSDS,减少结构化伪影并保留语义内容。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12780 2026-08-14 cs.CV 新提交 57%

SCOPE: Subspace Clustering with Online Per-Head Top-K Estimation for Sparse Video Attention

SCOPE:用于稀疏视频注意力的在线分头Top-K估计的子空间聚类

Qi Zhao, Qirui Li, Hanlin Tang, Yiduo Li, Zhen Guo, Cuifeng Shen, Chao Xu, Zhaosheng Chi, Xiaojin Lu, Kan Liu, Tao Lan, Lin Qu, Xi Li

机构 * Zhejiang University(浙江大学) Alibaba Group(阿里巴巴集团)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 SCOPE是一种无训练稀疏注意力框架,通过子空间聚类与在线分头Top-k估计解决视频DiTs的高成本问题,在6种配置中优于基线,实现1.99倍加速且保持28.46 dB PSNR。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11745 2026-08-14 cs.CV 版本更新 57%

LiveAnimate: Stable Long-Form Streaming Human Animation in Real-Time

LiveAnimate:稳定的长时长流驱动人体动画实时生成系统

Yuxuan Zhang, Haozhong Xiong, Yubo Huang, Jiayi Song, Jinpeng Yu, Haofan Wang, Jiaming Liu, Ruihua Huang, Liwei Wang

机构 * The Chinese University of Hong Kong(香港中文大学) Qwen Applications Business Group of Alibaba(阿里巴巴通义千问应用业务组) Liblib AI

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 LiveAnimate基于14B参数视频DiT,经两阶段训练结合PR-Sink等设计,实现19.63 FPS长时长流人体动画生成,兼顾实时性、质量与稳定性,优于现有系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30045 2026-08-14 cs.CV 版本更新 57%

DualEraser: Joint Video Object and Effect Removal via Balanced Text-Mask Guidance and Decoupled Locator-Preserver

GenEraser:通过平衡文本-掩码引导和解耦定位器-保持器实现可泛化的视频对象移除

Yuqing Chen, Lin Liu, Haisu Wu, Xiaopeng Zhang, Yaowei Wang, Yujiu Yang, Qi Tian

机构 * Tsinghua University(清华大学) Pengcheng National Laboratory(鹏城实验室) Huawei(华为) Southeast University(东南大学) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 提出GenEraser框架,通过多条件混合专家、可学习深度CFG融合机制和解耦专家架构,解决视频对象移除中目标与物理效应同时消除的泛化难题,在ROSE和VOR-Eval上分别提升2.16 dB和1.44 dB。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01296 2026-08-14 cs.CV 版本更新 57%

SIFT-VTON: Geometric Correspondence Supervision on Cross-Attention for Virtual Try-On

SIFT-VTON:跨注意力中的几何对应监督用于虚拟试穿

Kosuke Takemoto, Takafumi Koshinaka

机构 * The Graduate School of Data Science, Yokohama City University, Kanagawa, Japan(数据科学研究生院, Yokohama 市立大学,神奈川县,日本)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本文提出SIFT-VTON方法,利用SIFT关键点匹配提供显式几何指导,提升扩散模型在虚拟试穿中的细节保留能力。

Comments Accepted at ICPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17897 2026-08-14 cs.CV cs.AI cs.LG cs.RO 版本更新 57%

RadarGen: Automotive Radar Point Cloud Generation from Cameras

RadarGen:从摄像头生成汽车雷达点云

Tomer Borreda, Fangqiang Ding, Sanja Fidler, Shengyu Huang, Or Litany

机构 * Technion(技术学院) MIT(麻省理工学院) NVIDIA(英伟达) University of Toronto(多伦多大学) Vector Institute(向量研究所)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 RadarGen通过扩散模型从摄像头图像生成逼真的雷达点云,结合BEV对齐的深度、语义和运动线索,提升雷达生成的物理合理性与多模态模拟能力。

Comments ECCV 2026. Project page: https://radargen.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05967 2026-08-14 cs.CV cs.AI 57%

Adapted Foundation Models for Breast MRI Triaging in Contrast-Enhanced and Non-Contrast Enhanced Protocols

Tri-Thien Nguyen, Lorenz A. Kapsner, Tobias Hepp, Shirin Heidarikahkesh, Hannes Schreiter, Luise Brock, Dominika Skwierawska, Dominique Hadler, Julian Hossbach, Evelyn Wenkel, Sabine Ohlmeyer, Frederik B. Laun, Andrzej Liebert, Andreas Maier, Michael Uder, Sebastian Bickelhaupt

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

Comments 23 pages, 6 figures, 4 tables. Originally submitted to Radiology (RAD-25-2541); under consideration for transfer to Radiology: Artificial Intelligence (RSNA Portfolio Journal)

Journal ref European Radiology (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13418 2026-08-14 stat.ML cs.LG 新提交 50%

Wasserstein Filtering: A Sample Selection Method for Robust Distribution Learning

Wasserstein滤波:一种用于鲁棒分布学习的样本选择方法

Yikai Xu, Zhao Chen, Jian Huang

专题命中 扩散模型 :diffusion(abstract)

AI总结 针对存在部分样本被污染的数据集,提出Wasserstein滤波样本选择框架,引入三种算法,在FELP污染模型下证明其估计量的极小极大最优性,经实验验证其为实用的模型无关预处理工具,兼具良好异常检测性能与生成建模下游效益。

Comments 48 pages, 3 figures, and 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12398 2026-08-14 q-bio.NC cs.AI 新提交 50%

A Hierarchical Energy-Based Model for Multimodal Cognition

面向多模态认知的分层能量基模型

Subir Varma

专题命中 扩散模型 :diffusion(abstract)

AI总结 该研究提出IM-LEPP多模态能量基模型,扩展单模态LEPP整合视觉与语言,能解释注意现象、复现心理语言学发现,还与Transformer模型形成可证伪对比并提出实验预测。

Comments 48 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏