arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-06-11 至 2026-06-11 共收录 33 信号源:cs.CV, cs.GR, cs.MM

1. 图像编辑 1 篇

2605.30437 2026-06-11 cs.CV 版本更新 74%

Mitigating Content Shift and Hallucination in GenAI Image Editing via Structural Refinement

通过结构细化减轻生成式AI图像编辑中的内容偏移和幻觉

Luxi Zhao, Michael S. Brown

机构 * Department of Electrical Engineering & Computer Science(电气工程与计算机科学系)

专题命中 图像编辑 :image editing(title);分类 cs.CV

AI总结 提出一种后处理框架,通过建立粗空间和光度对应关系并融合输入图像与GenAI增强图像,在保留感知增强的同时抑制幻觉内容,从而解决黑盒GenAI图像编辑中的结构保持问题。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 扩散模型 26 篇

2512.14096 2026-06-11 cs.CV 版本更新 83%

RSTR: Reducing SpatioTemporal Redundancy in Diffusion Transformers

RSTR: 减少扩散Transformer中的时空冗余

Ruitong Sun, Tianze Yang, Wei Niu, Jin Sun

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

AI总结 提出RSTR框架,通过进化搜索和自适应秩分配联合减少扩散Transformer中的时空冗余,实现50%-70%计算节省并保持或提升生成质量。

Comments International Conference on Machine Learning (ICML)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18291 2026-06-11 cs.AI 版本更新 82%

Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies

扩散以协调:高效在线多智能体扩散策略

Zhuoran Li, Hai Zhong, Xun Wang, Qingxin Xia, Lihua Zhang, Longbo Huang

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract)

AI总结 提出首个在线离线策略多智能体强化学习框架OMAD,利用扩散策略和松弛策略目标最大化缩放联合熵,实现高效探索与协调,在MPE和MAMuJoCo上样本效率提升2.5至5倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.02849 2026-06-11 cs.CV 版本更新 79%

Active Sampling for Ultra-Low-Bit-Rate Video Compression via Conditional Controlled Diffusion

通过条件控制扩散实现超低比特率视频压缩的主动采样

Amirhosein Javadi, Shirin Saeedi Bidokhti, Tara Javidi

机构 * Department of Electrical and Computer Engineering, University of California San Diego(电子与计算机工程系,加州大学圣地亚哥分校) Department of Electrical and Systems Engineering, University of Pennsylvania(电子与系统工程系,宾夕法尼亚大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 提出ActDiff-VC框架,利用条件扩散模型和主动采样策略(自适应关键帧选择与预算感知稀疏轨迹选择),在超低比特率下实现高感知质量视频压缩。

Comments 21 pages, 11 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22335 2026-06-11 cs.CV cs.AI 版本更新 79%

Moving Beyond Diffusion: Hierarchy-to-Hierarchy Autoregression for fMRI-to-Image Reconstruction

超越扩散:层级到层级自回归用于fMRI到图像重建

Xu Zhang, Ruijie Quan, Wenguan Wang, Yi Yang

机构 * The State Key Lab of Brain-Machine Intelligence, Zhejiang University, China(脑机智能国家重点实验室,浙江大学,中国) ReLER, CCAI, College of Artificial Intelligence, Zhejiang University, China(ReLER、中国人工智能学会、人工智能学院、浙江大学、中国)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 提出MindHier框架,通过层级fMRI编码器、层级对齐和尺度感知粗到细引导策略,实现从粗到细的fMRI到图像重建,优于扩散方法。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03933 2026-06-11 cs.CV cs.AI 版本更新 79%

Diffusion-based Cumulative Adversarial Purification for Vision Language Models

基于扩散的累积对抗净化方法用于视觉语言模型

Jia Fu, Yongtao Wu, Yihang Chen, Kunyu Peng, Xiao Zhang, Volkan Cevher, Sepideh Pashami, Anders Holst

机构 * KTH Royal Institute of Technology(皇家理工学院) Swiss Federal Institute of Technology Lausanne(洛桑联邦理工学院) University of California, Los Angeles(加州大学洛杉矶分校) Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) CISPA Helmholtz Center for Information Security(信息安全赫尔姆霍兹中心) RISE Research Institutes of Sweden(瑞典RISE研究机构) Halmstad University(哈马碧大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 提出DiffCAP,一种基于扩散的对抗净化策略,通过理论证明对抗效应随扩散单调衰减,并利用噪声注入与VLM嵌入相似度阈值自适应净化,显著提升防御效果并加速去噪。

Comments Accepted to Transactions on Machine Learning Research (TMLR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25820 2026-06-11 cs.LG 版本更新 78%

Visual-Redundancy-Controlled Parallel Decoding for Diffusion-Based Multimodal Large Language Models

基于扩散的多模态大语言模型的视觉冗余控制并行解码

Yulin Yuan, Hongshuo Zhao, Xiangming Meng

机构 * Zhejiang University(浙江大学) ZJUI-UIUC Institute(ZJUI-UIUC研究院)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 针对扩散型多模态大语言模型并行解码中视觉冗余问题,提出视觉冗余指数(VRI)和无需训练的视觉冗余控制解码(VRCD)方法,通过令牌到图像的注意力优先选择视觉互补位置,在多个基准上提升准确率。

Comments 18 pages, 5 figures, preprint. Code is available at https://github.com/infiniteYuanyl/VRCD

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12901 2026-06-11 stat.ML cond-mat.dis-nn cs.IT cs.LG math.IT 版本更新 78%

A theory of learning data statistics in diffusion models, from easy to hard

扩散模型中学习数据统计的理论:从容易到困难

Lorenzo Bardone, Claudia Merger, Sebastian Goldt

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文研究了扩散模型在学习数据统计时的分布简单性偏差,揭示了学习 pairwise 统计和 higher-order 统计所需的样本复杂度差异,并引入了扩散信息指数这一不变量。

Journal ref ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13097 2026-06-11 nlin.SI math-ph math.MP 版本更新 78%

Symmetries and exact solutions of a reaction-diffusion system arising in population dynamics

种群动力学中反应-扩散系统的对称性与精确解

Philip Broadbridge, Roman Cherniha, Vasyl' Davydovych, Ian Marquette

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 研究种群动力学中两个三次反应-扩散方程系统的所有李对称和Q-条件对称,构造包含Lambert函数的新精确解,并给出寻找非线性演化系统Q-条件对称的通用算法。

Comments 22 pages

Journal ref Quaestiones Mathematicae, (28 May 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08136 2026-06-11 cs.LG cs.SY eess.SY 版本更新 78%

Reverse Flow Matching: A Unified Framework for Online Reinforcement Learning with Diffusion and Flow Policies

反向流匹配:基于扩散与流策略的在线强化学习统一框架

Zeyang Li, Sunbochen Tang, Navid Azizan

机构 * Zeyang Li(李泽阳) Sunbochen Tang(唐顺波晨) Navid Azizan(阿齐兹安纳维)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 针对在线强化学习中扩散与流策略缺乏目标样本的问题,提出反向流匹配框架,通过后验均值估计和Langevin Stein算子构造控制变量,统一了噪声期望与梯度期望两类方法,并扩展到流策略,提升训练效率与稳定性。

Comments ICML 2026 (Spotlight); Code: https://github.com/azizanlab/ReverseFlowMatching

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12942 2026-06-11 cs.AI 版本更新 78%

Offline Diffusion Policy for Multi-User Delay-Constrained Scheduling

面向多用户延迟约束调度的离线扩散策略

Zhuoran Li, Ruishuo Chen, Hai Zhong, Longbo Huang

机构 * Institute for Interdisciplinary Information Sciences (IIIS), Tsinghua University(交叉信息学院(IIIS),清华大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 提出基于离线强化学习的SOCD算法,利用扩散策略和批评网络指导,从离线数据中学习高效调度策略,避免在线交互,在部分可观测和大规模环境中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.08188 2026-06-11 math.AP math.OC 版本更新 78%

Bounded weak solutions for Keller-Segel equations with generalized diffusion and logistic source via an unbalanced Optimal Transport splitting scheme

具有广义扩散和逻辑源的Keller-Segel方程的有界弱解:基于非平衡最优输运分裂格式

Kyungkeun Kang, Hwa Kil Kim, Geuntaek Seo

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 针对具有广义扩散和逻辑源的抛物-椭圆型Keller-Segel方程,在齐次Neumann边界条件下,通过非平衡最优输运框架构造了全局有界弱解,并量化了趋化敏感性与降解参数及初始密度界的关系。

Comments 29 pages. Revised version with corrections. To appear in Nonlinear Analysis

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.01472 2026-06-11 cs.AI cs.LG cs.MA 版本更新 78%

Improving Generalization and Data Efficiency with Diffusion in Offline Multi-agent RL

通过扩散模型提升离线多智能体强化学习的泛化能力与数据效率

Zhuoran Li, Ling Pan, Jiatai Huang, Longbo Huang

机构 * Institute for Interdisciplinary Information Sciences(交叉信息学院) Tsinghua University(清华大学) Department of Electronic and Computer Engineering(电子与计算机工程系) Hong Kong University of Science and Technology(香港科学与技术大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 提出扩散离线多智能体模型(DOM2),利用扩散模型增强策略表达力和多样性,结合轨迹数据重加权,在离线MARL中显著提升性能、泛化能力和数据效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
1910.07712 2026-06-11 stat.AP stat.CO stat.ME 版本更新 78%

Estimating Spatially-Smoothed Fiber Orientation Distribution from Diffusion-MRI Experiments

从扩散MRI实验估计空间平滑的纤维取向分布

Jilei Yang, Seungyong Hwang, Mengjie Shi, Jie Peng

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 提出最近邻自适应回归模型(NARM),通过加权局部似然估计和空间邻域嵌套实现纤维取向分布(FOD)的空间自适应估计,引入体素级重缩放和数据驱动停止规则防止过平滑,并基于配置感知策略选择相似性平滑参数,在模拟和人类连接组项目数据中提高了估计准确性和可重复性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.21072 2026-06-11 cs.CR cs.AI cs.LG 版本更新 67%

Erased but Not Forgotten: How Backdoors Compromise Concept Erasure

擦除但未遗忘:后门如何破坏概念擦除

Tobias Braun, Jonas Henry Grebe, Marcus Rohrbach, Anna Rohrbach

专题命中 扩散模型 :text-to-image(abstract);diffusion(abstract)

AI总结 本文揭示了一种名为擦除规避后门(EEB)的漏洞,攻击者将后门触发器绑定到待擦除概念上,使得该恶意链接在后续擦除后仍然存在,从而绕过多种概念擦除方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08073 2026-06-11 cs.CV cs.LG 版本更新 57%

Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection

物理驱动的时空建模用于AI生成视频检测

Shuhai Zhang, ZiHao Lian, Jiahao Yang, Daiyuan Li, Guoxuan Pang, Feng Liu, Bo Han, Shutao Li, Mingkui Tan

机构 * South China University of Technology(华南理工大学) University of Science and Technology of China(中国科学技术大学) Key Laboratory of Big Data and Intelligent Robot, Ministry of Education(教育部大数据与智能机器人重点实验室) Pazhou Lab(琶洲实验室) University of Melbourne(墨尔本大学) Hunan University(湖南大学) Hong Kong Baptist University(香港 Baptist大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 提出基于概率流守恒的物理驱动AI生成视频检测范式,通过归一化时空梯度(NSG)统计量捕捉物理异常,结合预训练扩散模型估计NSG,并利用最大均值差异(MMD)进行检测,在Recall和F1-Score上分别提升16.00%和10.75%。

Comments Accepted at NeurIPS 2025 spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03185 2026-06-11 math.AP 版本更新 50%

Fractional Sobolev embeddings on noncommutative torus

非交换环面上的分数阶Sobolev嵌入

F. Sukochev, R. Tastankul, K. Tulenov, D. Zanin

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究非交换环面上的非交换分数阶对称Sobolev空间,通过证明非交换分布分数阶Sobolev不等式和O'Neil不等式的非交换版本,得到Sobolev嵌入、Cwikel-Solomyak型估计以及扩散方程Cauchy问题温和解的L2时间衰减。

Comments 30 pages. One reference is added. Welcome to any comments!

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00140 2026-06-11 cs.LG cs.AI 版本更新 50%

Geometric Erasure by Contrastive Velocity Matching in Rectified Flows

整流流中对比速度匹配的几何擦除

Jonas Henry Grebe, Tobias Braun, Anna Rohrbach, Marcus Rohrbach

机构 * University of California, Berkeley(加州大学伯克利分校) ETH Zurich(苏黎世联邦理工学院)

专题命中 扩散模型 :diffusion(abstract)

AI总结 提出GEM框架,通过对比速度匹配实现整流流模型中的概念擦除,结合生成流网络与教师引导的流匹配,有效抑制有害内容生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.10200 2026-06-11 cond-mat.supr-con 版本更新 50%

Dynamics of Topological Defects in Type-II Superconductors under Gradients of Temperature/Spin Density

第二类超导体中温度/自旋密度梯度下的拓扑缺陷动力学

Takuma Kanakubo, Hiroto Adachi, Masanori Ichioka, Yusuke Kato

专题命中 扩散模型 :diffusion(abstract)

AI总结 通过时变金兹堡-朗道方程与热/自旋扩散方程耦合模型,研究温度或自旋积累不均匀驱动的畴壁和涡旋运动,发现它们向抑制序参量的区域移动,并基于动量平衡分析驱动力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20266 2026-06-11 math.PR math.ST q-bio.PE stat.TH 版本更新 50%

Multiple Poisson-Dirichlet diffusions on generalized Kingman simplices

广义Kingman单纯形上的多重Poisson-Dirichlet扩散

Cristina Costantini, Matteo Ruggiero

专题命中 扩散模型 :diffusion(abstract)

AI总结 构造了有限标记广义Kingman单纯形上的无穷维扩散过程,通过分块斜积分解和极限过程,得到了多重Poisson-Dirichlet平稳分布。

Comments Revised version; dedicated to the memory of T.G. Kurtz

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23278 2026-06-11 cs.LG cs.AR cs.CL 版本更新 50%

FOCUS: DLLMs Know How to Tame Their Compute Bound

FOCUS: DLLMs 知道如何驯服它们的计算瓶颈

Kaihua Liang, Xin Tan, An Zhong, Hong Xu, Marco Canini

机构 * University of California, Berkeley(加州大学伯克利分校) University of Toronto(多伦多大学)

专题命中 扩散模型 :diffusion(abstract)

AI总结 针对扩散大语言模型解码中大部分计算浪费在不可解码令牌上的问题,提出 FOCUS 推理系统,通过动态聚焦可解码令牌并驱逐不可解码令牌,提升有效批大小,实现高达 3.52 倍的吞吐量提升。

Comments ICML 2026 camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23581 2026-06-11 stat.ME 版本更新 50%

Profile Bayesian Optimization for Expensive Computer Experiments

面向昂贵计算机实验的轮廓贝叶斯优化

Courtney Kyger, James Fernandez, John A. Grunenwald, James Braun, Annie Booth

专题命中 扩散模型 :diffusion(abstract)

AI总结 提出一种新型贝叶斯优化方法,通过两阶段采集策略和深度/浅层高斯过程代理,在控制参数范围内高效识别轮廓最优解,应用于旋转爆震发动机扩散器设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25070 2026-06-11 astro-ph.GA astro-ph.IM astro-ph.SR physics.chem-ph 版本更新 50%

Interstellar Dust-Catalyzed Molecular Hydrogen Formation Enabled by Nuclear Quantum Effects

星际尘埃催化的分子氢形成:核量子效应的作用

Xiaolong Yang, Lile Wang, Di Li, Shenzhen Xu

专题命中 扩散模型 :diffusion(abstract)

AI总结 通过多尺度模拟,发现核量子效应在低温下克服经典玻尔兹曼抑制,使化学吸附氢原子高效形成H₂,为星际H₂形成提供第一性原理量子基础。

Comments 29 pages, 20 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19887 2026-06-11 quant-ph cs.NA math.NA 版本更新 50%

Dynamically Optimal Unraveling Schemes for Simulating Lindblad Equations

模拟Lindblad方程的动态最优解缠方案

Yu Cao, Mingfeng He, Xiantao Li

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究随机解缠方案模拟Lindblad方程的最优性,提出动态最优量子态扩散(DO-QSD)和动态最优量子跳跃过程(DO-QJP),DO-QSD在方差和表达简洁性上优于跳跃过程,数值实验显示可显著降低可观测量方差和模拟误差。

Journal ref J. Phys. A: Math. Theor. (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17077 2026-06-11 stat.ML cs.LG 版本更新 50%

CP4SBI: Local Conformal Calibration of Credible Sets in Simulation-Based Inference

CP4SBI: 基于模拟推断中可信集的局部共形校准

Luben M. C. Cabezas, Vagner S. Santos, Thiago R. Ramos, Pedro L. C. Rodrigues, Rafael Izbicki

机构 * Department of Statistics, Federal University of São Carlos(统计系,圣卡洛斯联邦大学) Institute of Mathematics and Computer Science, University of São Paulo(数学与计算机科学学院,圣保罗大学) Univ. Grenoble Alpes, Inria, CNRS, Grenoble INP, LJK(格勒诺布尔阿尔卑斯大学,法国国家信息与自动化研究所,法国国家科学研究中心,格勒诺布尔INP,LJK)

专题命中 扩散模型 :diffusion(abstract)

AI总结 提出CP4SBI框架,通过回归树和CDF校准实现局部贝叶斯覆盖,为任意评分函数提供有限样本局部覆盖保证,提升神经后验估计的不确定性量化质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06717 2026-06-11 q-fin.TR 版本更新 50%

Optimal Execution and Macroscopic Market Making

最优执行与宏观市场做市

Ivan Guo, Shijia Jin

专题命中 扩散模型 :diffusion(abstract)

AI总结 提出一个随机博弈模型,刻画做市商与交易者之间的策略互动,通过FBSDEs刻画纳什均衡,并在特定模型中建立全局适定性,模拟揭示报价与策略订单负相关。

Comments 42 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.10119 2026-06-11 physics.optics cond-mat.dis-nn 版本更新 50%

Modeling scattering matrix containing evanescent modes for wavefront shaping applications in disordered media

包含倏逝模式的散射矩阵建模及其在无序介质波前整形中的应用

Michael Raju, Baptiste Jayet, Stefan Andersson-Engels

专题命中 扩散模型 :diffusion(abstract)

AI总结 提出开源标量波传输模型,通过扩展Fisher-Lee关系包含倏逝模式,估计无序介质的广义散射矩阵,并演示最优相位共轭波前聚焦倏逝模式时传输值为2/3的普适现象。

Comments Manuscript accepted in Physical Review Research

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 可控生成 2 篇

2603.12261 2026-06-11 cs.LG cs.AI cs.CV 版本更新 70%

The Latent Color Subspace: Emergent Order in High-Dimensional Chaos

潜在颜色子空间:高维混沌中的涌现秩序

Mateusz Pach, Jessica Bader, Quentin Bouniot, Serge Belongie, Zeynep Akata

机构 * University of California, Berkeley(加州大学伯克利分校) University of Toronto(多伦多大学) University of Cambridge(剑桥大学) University of Oxford(牛津大学)

专题命中 可控生成 :image generation(abstract);text-to-image(abstract);分类 cs.CV

AI总结 本文揭示了FLUX.1变分自编码器潜在空间中颜色表示的HSL结构,并提出一种无需训练的闭式潜在空间操作方法,实现对生成图像颜色的预测与显式控制。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.07269 2026-06-11 math.AP 版本更新 50%

Hamilton-Jacobi-Bellman Equations in Random Geometries: Homogenization on Continuum Percolation Clusters

连续渗流簇上的Hamilton-Jacobi-Bellman方程的随机均匀化

Rodrigo Bazaes, Alexander Mielke, Chiranjib Mukherjee

专题命中 可控生成 :diffusion(abstract)

AI总结 研究连续渗流簇上退化随机Hamilton-Jacobi-Bellman方程的均匀化性质,利用Hamiltonian的强制性和相对熵结构,结合连续渗流随机几何,证明了几乎必然的均匀化结果。

Comments Completely revised manuscript, some earlier assumptions corrected; the revised assumptions are now sharp and apply to a substantially broader class of models, large parts of the proofs have been rewritten and are new

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 图像生成评测 2 篇

2601.22725 2026-06-11 cs.CV cs.AI 版本更新 57%

OpenVTON-Bench: A Large-Scale High-Resolution Benchmark for Controllable Virtual Try-On Evaluation

OpenVTON-Bench:用于可控虚拟试穿评估的大规模高分辨率基准

Jin Li, Tao Chen, Kai Wen, Siqi Yin, Shuai Jiang, Weijie Wang, Jingwen Luo, Chenhui Wu

机构 * Renxing Intelligence, Hangzhou, China Hangzhou Dianzi University, Hangzhou, China(杭州电子科技大学)

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV

AI总结 提出OpenVTON-Bench,包含约10万对高分辨率图像,通过DINOv3聚类和Gemini描述构建,并设计多模态评估协议,沿五个维度衡量试穿质量,与人类判断高度一致。

Comments Under review for the NeurIPS 2026 Datasets and Benchmarks Track

详情

展开后加载摘要…

URL PDF HTML 收藏