arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-06-10 至 2026-06-10 共收录 93 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 72 篇

2606.10419 2026-06-10 cond-mat.str-el 新提交 50%

Antiferromagnetic order and magnetic polarons in lightly doped Li$_x$CoO$_2$ (x $\sim$ 0.9)

轻掺杂Li$_x$CoO$_2$ (x $\sim$ 0.9)中的反铁磁序和磁极化子

Sudip Pal, Pampa Sadhukhan, Waqar Suleman, Andrej Pustogow, S. B. Roy

专题命中 扩散模型 :diffusion(abstract)

AI总结 通过宏观磁化、比热、NMR和EPR测量,研究了Li$_x$CoO$_2$ (x~0.9)的磁性,发现部分反铁磁转变($T_N\sim$10 K)和弱铁磁响应,提出高温下掺杂空穴形成磁极化子导致铁磁团簇,EPR谱随温度变化可用磁极化子扩散解释。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10397 2026-06-10 cond-mat.str-el cond-mat.mtrl-sci 新提交 50%

Improved selector behavior in ultrathin chromium-doped V$_2$O$_3$ films

超薄掺铬V$_2$O$_3$薄膜中改进的选择器行为

Johannes Mohr, Tyler Hennen, Yudi Wang, Xiaoyu Xu, Loc Vinh, Dirk J. Wouters, Rainer Waser, Joyeeta Nag, Daniel Bedau

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究超薄掺铬V$_2$O$_3$薄膜的负微分电阻效应,发现5nm薄膜仍保持开关效应且性能提升,归因于界面非晶层和元素扩散。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10828 2026-06-10 astro-ph.HE 新提交 50%

A Multiwavelength Interpretation of HESS J1857+026 Emission Using the Fermi-LAT, VERITAS, and HAWC Observatories

利用Fermi-LAT、VERITAS和HAWC天文台对HESS J1857+026辐射的多波段解释

Jordan Eagle, Yu Chen, Ramiro Torres-Escobedo, Youyou Li, Ruo-Yu Shang

专题命中 扩散模型 :diffusion(abstract)

AI总结 利用Fermi-LAT、VERITAS和HAWC数据研究HESS J1857+026的MeV-TeV伽马射线起源,通过空间和光谱分析及辐射模型确定其主要来自脉冲星风云PWN,并约束了系统年龄和磁场强度。

Comments 24 pages. Accepted for publication in ApJ

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06888 2026-06-10 cs.LG 版本更新 50%

Data-Constrained Language Model Pretraining: Improved Regularization and Scaling Laws

数据受限的语言模型预训练:改进的正则化与缩放定律

Zhiwei Xu, Shihao Wu, Hanseul Cho, Wei Hu, Yixin Wang

机构 * University of Michigan(密歇根大学) KAIST AI(韩国科学技术院人工智能研究所)

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究数据受限下语言模型预训练的正则化与缩放,提出掩码输入正则化(MIR)改善验证损失,并设计SoftQ缩放定律更准确拟合重复数据下的模型与数据规模交互。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20242 2026-06-10 cond-mat.stat-mech math-ph math.MP 版本更新 50%

How the arrow of time emerges from Hamiltonian systems by our incomplete knowledge

时间之箭如何从哈密顿系统中因我们的不完全知识而涌现

Katerina Mlada, Michal Pavelka, Vaclav Klika

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文通过路径积分形式的不匹配约化方法,证明不可逆性从可逆哈密顿力学中涌现,并推导出GENERIC框架,无需拟合参数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07413 2026-06-10 cs.RO 版本更新 50%

Going with the Flow: Koopman Behavioral Models as Pseudo Planners for Visuo-Motor Dexterity

随流而行:Koopman行为模型作为视觉运动灵巧性的伪规划器

Yunhai Han, Jiaqi Fu, Linhao Bai, Ziyu Xiao, Zhaodong Yang, Yogita Choudhary, Krishna Jha, Chuizheng Kong, Shreyas Kousik, Harish Ravichandar

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 扩散模型 :diffusion(abstract)

AI总结 提出统一行为模型(UBM),将灵巧技能建模为耦合动力系统,确保时间一致性;基于Koopman算子实现线性潜空间,通过在线重规划实现反应性和适应性,在模拟和真实任务中达到或超越现有方法。

Comments Website: https://k-ubm.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08021 2026-06-10 cond-mat.stat-mech 50%

Boundary-Induced Drift and Negative Mobility in Constrained Stochastic Systems

边界诱导的漂移与受限随机系统中的负迁移

Meitar Goldfarb, Stanislav Burov

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究受限随机动力学中边界几何与各向异性扩散张量的组合如何产生定向运动,并通过一维双粒子系统展示局部边界诱导漂移如何导致宏观传输,包括恒定力下的绝对负迁移。

Journal ref Physical Review E 113, 064119 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08432 2026-06-10 quant-ph math.OC 版本更新 50%

A Grover-compatible manifold optimization algorithm for quantum search

一种兼容Grover算法的流形优化算法用于量子搜索

Zhijian Lai, Dong An, Jiang Hu, Zaiwen Wen

专题命中 扩散模型 :diffusion(abstract)

AI总结 将无结构搜索问题重新表述为酉流形上的最大化问题,通过引入Grover兼容的收缩映射,利用黎曼梯度上升法实现线性收敛,迭代复杂度为O(√N log(1/ε)),匹配Grover算法的二次加速。

Comments Newly added supplementary materials

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20083 2026-06-10 nucl-th hep-th 版本更新 50%

Covariant equations of motion of massive spinning particles in a background Yang-Mills field

背景杨-米尔斯场中自旋有质量粒子的协变运动方程

Jie Zhou, Ying Shan Zhao, Yifeng Sun

专题命中 扩散模型 :diffusion(abstract)

AI总结 通过狄拉克-伯格曼算法,推导出自旋1/2夸克在背景非阿贝尔杨-米尔斯场中满足洛伦兹协变、任意色磁矩和物理约束的自洽运动方程,用于重离子碰撞中硬探针的动量扩散和自旋极化研究。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00491 2026-06-10 cs.RO cs.AI 50%

HannesImitation: Grasping with the Hannes Prosthetic Hand via Imitation Learning

HannesImitation:通过模仿学习控制Hannes假手进行抓取

Carlo Alessi, Federico Vasile, Federico Ceola, Giulia Pasquale, Nicolò Boccardo, Lorenzo Natale

机构 * Humanoid Sensing and Perception(人形感知与感知实验室) Istituto Italiano di Tecnologia(意大利技术研究院) Rehab Technologies Lab(康复技术实验室)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出HannesImitationPolicy,通过模仿学习控制Hannes假手在无结构环境中抓取物体,并引入HannesImitationDataset进行训练,实验表明其在无结构场景中优于基于分割的视觉伺服控制器。

Comments Paper accepted at IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

Journal ref IEEE/RSJ International Conference on Intelligent Robots and Systems, Hangzhou, China, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.07264 2026-06-10 physics.bio-ph q-bio.CB 50%

Chemotaxing E. coli do not count single molecules

趋化E. coli不计单分子

Henry H. Mattingly, Keita Kamino, Jude Ong, Rafaela Kottou, Thierry Emonet, Benjamin B. Machta

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究发现E. coli趋化感知受限于内部噪声而非分子扩散物理限制,通过信息率分析显示其信息编码量远低于物理极限。

Comments 27 pages of main text, 4 figures, 43 pages of supplement + supplementary figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08200 2026-06-10 physics.plasm-ph 50%

Vidyut3d: a GPU accelerated fluid solver for non-equilibrium plasmas on adaptive grids

Vidyut3d:一种基于自适应网格的GPU加速非平衡等离子体流体求解器

Hariswaran Sitaraman, Nicholas Deak, Taaresh Taneja

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种利用CPU和GPU架构的非平衡等离子体流体求解器,采用自适应笛卡尔网格解决物种传输、静电泊松方程和电子温度的耦合守恒方程,验证了其二阶精度和五阶WENO方案,并在两个3D模拟案例中展示了性能优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01090 2026-06-10 physics.optics 50%

Diffuse Optical Ptychography

扩散光学影子成像

Mingwei He, Sujit K. Sahoo, Chengyuan Xiao, Cuong Dang

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出扩散光学影子成像(DOP),通过多重重叠照明模式获取空间信息,实现对厚散射介质中二值和灰度物体的高分辨率重建,具有1毫米分辨率和无需校准的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.21649 2026-06-10 q-fin.MF 版本更新 50%

Second-Order Esscher Pricing for Lévy Models with Applications: Risk Management and Fear Quantification

Lévy模型的二阶Esscher定价及其在风险管理和恐惧量化中的应用

Tahir Choulli, Ella Elazkany, Mich`ele Vanmaele

专题命中 扩散模型 :diffusion(abstract)

AI总结 提出二阶Esscher变换作为经典Esscher框架的可处理扩展,用于Lévy驱动市场的期权定价和风险管理,推导了定价公式,并实证表明其参数与市场压力指标(如VIX)强相关。

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.09295 2026-06-10 q-fin.RM math.PR stat.AP 版本更新 50%

On the Impact of Insurance on Households Susceptible to Random Proportional Losses: An Analysis of Poverty Trapping

保险对面临随机比例损失的贫困家庭的影响:贫困陷阱分析

Kira Henshaw, Jorge Ramirez, José Miguel Flores-Contró, Enrique A. Thomann, Sooie-Hoe Loke, Corina Constantinescu

专题命中 扩散模型 :diffusion(abstract)

AI总结 通过比例损失模型研究保险对贫困陷阱概率的影响,推导无保险时幂律分布下的新闭式解,以及有保险时均匀分布下的非局部微分方程,分析参数约束并数值计算陷阱概率。

Comments 42 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 可控生成 5 篇

2606.11096 2026-06-10 cs.CV 新提交 57%

IDEAL: In-DEpth ALignment Makes A Discrete Representation AutoEncoder

IDEAL: 深度对齐实现离散表示自编码器

Yitong Chen, Zijie Diao, Junke Wang, Lingyu Kong, Yixuan Ren, Bo He, Yu-Gang Jiang, Zuxuan Wu

机构 * Institute of Trustworthy Embodied AI, Fudan University(复旦大学可信具身人工智能研究所) Shanghai Innovation Institute(上海创新研究院) University of Maryland, College Park(马里兰大学帕克分校)

专题命中 可控生成 :image generation(abstract);分类 cs.CV

AI总结 提出IDEAL框架,通过联合对齐量化令牌与浅层和深层VFM特征,提升离散表示自编码器的重建质量,在ImageNet上实现0.61 rFID,并创下自回归图像生成新纪录(gFID 1.89)。

Comments Code is available at https://github.com/Row11n/IDEAL

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10902 2026-06-10 cs.CV cs.AI 新提交 57%

Pose-ICL: 3D-Aware In-Context Learning for Pose-Controllable Subject Customization

Pose-ICL:面向姿态可控主体定制的3D感知上下文学习

Xuan Han, Yihao Zhao, Mingyu You

机构 * College of Electronic and Information Engineering, Tongji University, Shanghai, China(同济大学电子与信息工程学院) State Key Laboratory of Autonomous Intelligent Unmanned Systems, Frontiers Science Center for Intelligent Autonomous Systems, Ministry of Education, Shanghai, China(自主智能无人系统国家重点实验室,智能自主系统前沿科学中心,教育部,上海,中国)

专题命中 可控生成 :image generation(abstract);分类 cs.CV

AI总结 提出Pose-ICL框架,通过3D感知上下文学习和表面锚定位置嵌入(SAPE)实现无调优的姿态可控主体定制,显著提升姿态准确性和身份一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10025 2026-06-10 cs.RO cs.CV cs.LG 新提交 57%

GHOST: Hierarchical Sub-Goal Policies for Generalizing Robot Manipulation

GHOST: 用于泛化机器人操作的层次化子目标策略

Sriram Krishna, Ben Eisner, Haotian Zhan, Ying Yuan, Haoyu Zhen, Chuang Gan, Shubham Tulsiani, David Held

机构 * Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所) UMass Amherst(马萨诸塞大学阿姆赫斯特分校)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 提出GHOST框架,通过将控制分解为高层子目标预测和低层目标条件控制器,实现视觉运动操作策略的泛化,并利用人类演示适应新物体和任务变化。

Comments Accepted at RSS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10340 2026-06-10 cs.RO 新提交 50%

OMG: Omni-Modal Motion Generation for Generalist Humanoid Control

OMG: 面向通用人形机器人的全模态运动生成

Siqiao Huang, Kun-Ying Lee, Dongming Qiao, Guanqi He, Zhenyu Wang, Yitang Li, Shaoting Zhu, Hang Zhao

机构 * Tsinghua University(清华大学)

专题命中 可控生成 :diffusion(abstract)

AI总结 提出OMG框架,通过精心策划的数据流程和扩散模型,实现基于语言、音频和参考动作的全模态全身控制,展示了最先进的性能和可扩展性。

Comments Project Page: https://tsinghua-mars-lab.github.io/OMG/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10948 2026-06-10 nlin.AO nlin.CD 新提交 50%

Complexity synchronization as a diagnostic and control principle for adaptive systems

自适应系统的复杂性同步作为诊断与控制原则

Korosh Mahmoodi, Scott E. Kerick, Piotr J. Franaszczuk, David L. Boothe, Paolo Grigolini, Bruce J. West

专题命中 可控生成 :diffusion(abstract)

AI总结 提出复杂性同步(CS)作为自适应系统的诊断与干预原则,通过多智能体模型验证其与协作性能的关系,揭示功能相关子系统并指导修复。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 个性化与一致性 4 篇

2606.10617 2026-06-10 cs.CV 新提交 79%

SSR-Merge: Subspace Signal Routing for Training-Free LoRA Merging in Diffusion Models

SSR-Merge: 面向扩散模型中免训练的LoRA合并的子空间信号路由

Zhengxuan Wei, Yi Dong, Zonghui Li, Xianhui Lin, Xing Liu, Hong Gu, Shaofeng Zhang, Wenbin Li, Qi Fan

机构 * Stanford University(斯坦福大学)

专题命中 个性化与一致性 :diffusion(title,abstract);分类 cs.CV

AI总结 提出子空间信号路由(SSR)方法,通过沿秩维度拼接LoRA构建统一子空间,利用逆相关矩阵去相关和方向引导矩阵分离信号,解决参数合并中的干扰问题,理论证明其等价于OLS最优解,并设计流式算法降低开销。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12675 2026-06-10 cs.CV cs.AI 版本更新 79%

Scone: Bridging Composition and Distinction in Subject-Driven Image Generation via Unified Understanding-Generation Modeling

Scone:通过统一理解-生成建模弥合主体驱动图像生成中的组合与区分

Yuran Wang, Bohan Zeng, Chengzhuo Tong, Wenxuan Liu, Yang Shi, Xiaochen Ma, Hao Liang, Yuanxing Zhang, Wentao Zhang

机构 * Peking University(北京大学) Kling Team, Kuaishou Technology(快手科技 Kling 团队) Zhongguancun Academy(中关村学院) HKUST(香港科技大学) Beijing Key Laboratory of Data Intelligence and Security (Peking University)(北京数据智能与安全重点实验室(北京大学))

专题命中 个性化与一致性 :image generation(title,abstract);分类 cs.CV

AI总结 提出Scone方法,通过统一理解-生成模型结合组合与区分能力,采用两阶段训练实现主体身份保持与干扰最小化,在双基准上优于现有开源模型。

Comments CVPR 2026 Highlight. Code: https://github.com/Ryann-Ran/Scone

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10620 2026-06-10 cs.CV cs.AI 新提交 57%

Can Image Models Imagine Time? ImageTime: A Novel Benchmark for Probing Visual World Modeling Through Spatiotemporal Consistency

图像模型能想象时间吗?ImageTime:通过时空一致性探究视觉世界建模的新基准

Xinrui Wu, Lichen Huang

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 个性化与一致性 :image generation(abstract);分类 cs.CV

AI总结 提出ImageTime基准,通过四关键帧协议(初始状态、动作开始、过渡状态、最终状态)评估图像生成模型在时空一致性上的表现,揭示模型在维持连贯视觉世界状态方面的能力与不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10126 2026-06-10 cs.CL cs.AI cs.CY cs.LG 新提交 50%

Pareto-Guided Teacher Alignment for Fair Personalized Text Generation

帕累托引导的教师对齐用于公平个性化文本生成

Tunazzina Islam

机构 * Purdue University(普渡大学)

专题命中 个性化与一致性 :personalized generation(abstract)

AI总结 提出帕累托引导的教师对齐框架,通过修订候选生成、对感知可行性门控、帕累托候选选择和偏好优化,在减少人口统计差异的同时保持个性化保真度,实验表明公平缓解效果依赖于目标且跨域迁移不一致。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 图像生成评测 4 篇

2606.10894 2026-06-10 cs.CV 新提交 70%

The 1st PortraitCraft Challenge: A CVPR 2026 Workshop Competition on Portrait Composition Understanding and Generation

首届PortraitCraft挑战赛:CVPR 2026研讨会肖像构图理解与生成竞赛

Zijie Lou, Youyun Tang, Xiaochao Qu, Haoxiang Li, Ting Liu, Luoqi Liu, Xun Zhu, Zheng Zhang, Xi Chen, Miao Li, Ji Wu, Dizhe Zhang, Xian Ge, Sujia Wang, Ruiyang Zhang, Jiaming Wang, Xianshun Wang, Lu Qi, Boao Kang, Wei Zhou, Jinghui Sun, Zhenyu Yan, Jiliang Zhao, Rui Yang, Yipo Huang, Boyuan Liu, Shanglin Li, Zifan Xie, Yichen Zhang, Anlan Wang, Wenfeng Lin, Mingyu Guo, Dong Li, Xinghao Wang, Yanting Li, Shanzhao Tong, Shuai He, Qiu Zhou, Yongqi Yang, Taoyang Mu, Dianqiao Lei, Anlong Ming, Huadong Ma

机构 * CVPR 2026

专题命中 图像生成评测 :image generation(abstract);image synthesis(abstract);分类 cs.CV

AI总结 提出PortraitCraft挑战赛,包含构图理解与生成两个赛道,并发布约5万张肖像数据集,推动肖像美学与可控图像生成研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02817 2026-06-10 cs.LG cs.AI cs.CV cs.IT math.IT 版本更新 70%

Conditional Vendi Score: Prompt-Aware Diversity Evaluation for Generative AI Models and LLMs

条件 Vendi 分数:生成式 AI 模型和 LLM 的提示感知多样性评估

Mohammad Jalali, Azim Ospanov, Amin Gohari, Farzan Farnia

机构 * Department of Computer Science and Engineering, The Chinese University of Hong Kong(计算机科学与工程系,香港中文大学) Department of Information Engineering, The Chinese University of Hong Kong(信息工程系,香港中文大学)

专题命中 图像生成评测 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 针对文本提示引导的生成模型,提出条件 Vendi 和条件 RKE 分数,通过条件熵分离模型自身多样性,并证明收敛性及在多个任务中恢复真实多样性排序。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09809 2026-06-10 cs.CV 版本更新 57%

SciFlow-Bench: Evaluating Structure-Aware Scientific Diagram Generation via Inverse Parsing

SciFlow-Bench:通过逆解析评估结构感知的科学图表生成

Tong Zhang, Honglin Lin, Zhou Liu, Chong Chen, Wentao Zhang

机构 * Peking University(北京大学) Shanghai Jiao Tong University(上海交通大学) Huawei Cloud BU(华为云业务部) Zhongguancun Academy(中关村学院) Beijing Key Laboratory of Data Intelligence and Security (Peking University)(北京数据智能与安全重点实验室(北京大学))

专题命中 图像生成评测 :text-to-image(abstract);分类 cs.CV

AI总结 提出SciFlow-Bench基准,通过逆解析将生成的图表图像转换为结构化图进行比较,以结构可恢复性而非视觉相似性评估科学图表生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10071 2026-06-10 cs.LG cs.AI 新提交 50%

Temporal Sheaf Neural Networks with Dynamic Orthogonal Transport

时序层神经网络与动态正交传输

Md Sadek Hossain Asif, Tanzila Khan, Md. Mosaddek Khan

机构 * University of Dhaka(达卡大学)

专题命中 图像生成评测 :diffusion(abstract)

AI总结 提出时序层神经网络(TSNN),通过动态正交帧和局部坐标系间显式传输实现时序链接预测,在多种基准上超越现有方法,尤其适用于节点角色异质性强的图。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 效率与蒸馏 5 篇

2506.14753 2026-06-10 cs.CV cs.LG 版本更新 89%

Cost-Aware Routing for Efficient Text-To-Image Generation

面向文本到图像生成的高效路由:成本感知方法

Qinchan Li, Kenneth Chen, Changyue Su, Wittawat Jitkrittum, Qi Sun, Patsorn Sangkloy

机构 * Tandon School of Engineering, New York University(纽约大学Tandon工程学院) Google(谷歌) Eigen 4D Inc.(Eigen 4D公司)

专题命中 效率与蒸馏 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 提出成本感知路由框架,根据提示复杂度自动选择不同去噪步数或模型,在保证高质量的同时降低计算成本,优于单一模型。

Comments Accepted by TMLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13358 2026-06-10 cs.CV 版本更新 83%

One-Step Residual Shifting Diffusion for Image Super-Resolution via Distillation

一步残差移位扩散用于图像超分辨率通过蒸馏

Daniil Selikhanovych, David Li, Aleksei Leonov, Nikita Gushchin, Sergei Kushneriuk, Alexander Filippov, Evgeny Burnaev, Iaroslav Koshelev, Alexander Korotin

机构 * Kandinsky Lab(坎迪斯基实验室) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Luzin Research Center(卢津研究所) Moscow Independent Research Institute of Artificial Intelligence(莫斯科独立人工智能研究 institute) Applied AI Institute(应用人工智能研究所)

专题命中 效率与蒸馏 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

AI总结 提出RSD蒸馏方法,通过训练学生网络使基于其生成图像的虚拟ResShift模型与教师一致,实现单步超分辨率,在感知指标上超越教师和SinSR,且参数和计算成本更低。

Comments ICML-2026

详情

展开后加载摘要…

URL PDF HTML 收藏