arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-04-23 至 2026-04-23 共收录 62 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 46 篇

2604.20317 2026-04-23 cs.CV 57%

MD-Face: MoE-Enhanced Label-Free Disentangled Representation for Interactive Facial Attribute Editing

MD-Face: 基于MoE的无标签解耦表示用于交互式面部属性编辑

Xuan Cui, Yunfei Zhao, Bo Liu, Wei Duan, Xingrong Fan

机构 * Xuan Cui(徐传) Yunfei Zhao(赵云飞) Bo Liu(刘波) Wei Duan(段伟) Xingrong Fan(范星荣)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 MD-Face提出一种基于MoE的无标签解耦表示框架,通过动态专家分配机制和几何感知损失提升面部属性编辑效果,实验显示其在图像质量和推理延迟方面优于扩散方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20128 2026-04-23 cs.CV 57%

Semi-Supervised Flow Matching for Mosaiced and Panchromatic Fusion Imaging

半监督流匹配用于拼接与全色融合成像

Peiming Luo, Nan Wang, Litong Liu, Jiahan Huang, Chenxu Wu, Renwei Dian, Junming Hou

机构 * Southeast University(东南大学) Hunan University(湖南大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本文提出半监督流匹配框架,用于拼接超光谱图像与全色图像融合,通过两阶段训练提升生成效率与鲁棒性,实验表明其在多个数据集上表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20041 2026-04-23 cs.CV cs.AI 57%

Normalizing Flows with Iterative Denoising

归一化流与迭代去噪

Tianrong Chen, Jiatao Gu, David Berthelot, Joshua Susskind, Shuangfei Zhai

机构 * Apple Machine Learning Research(苹果机器学习研究)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本文提出iTARFlow,通过迭代去噪提升归一化流生成模型性能,展现其在图像生成中的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20800 2026-04-23 cs.CV cs.LG 57%

LEXIS: LatEnt ProXimal Interaction Signatures for 3D HOI from an Image

LEXIS: 用于从图像中重建3D人体-物体交互的潜在近邻交互签名

Dimitrije Antić, Alvaro Budria, George Paschalidis, Sai Kumar Dwivedi, Dimitrios Tzionas

机构 * University of Amsterdam, The Netherlands(阿姆斯特丹大学) Aristotle University of Thessaloniki, Greece(雅典大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本文提出LEXIS方法,通过VQ-VAE学习交互签名,结合InterFields实现人体和物体的密集连续接近建模,提升3D交互重建的精度与真实感。

Comments 26 pages, 11 figures, 4 tables. Project page: https://anticdimi.github.io/lexis

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20469 2026-04-23 math.AP q-bio.PE 50%

Indirect Prey-taxis VS a Shortwave External Signal in Multiple Dimensions

间接猎物趋性与多维短波外部信号

Andrey Morgulis, Karrar Malal

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究多维空间中短波外部信号对捕食者-猎物系统稳定性的影响,通过构建短波渐近展开分析外部信号对趋性运输的抑制作用及物种平衡的鲁棒性。

Comments 30 pages, 1 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20372 2026-04-23 physics.flu-dyn cs.AI cs.LG nlin.PS 50%

AI models of unstable flow exhibit hallucination

AI模型在不稳定流中的表现出现幻觉

Ramdhan Wibawa, Birendra Jha

机构 * University of Southern California(南加州大学)

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究发现AI模型在模拟不稳定流时出现物理不合理的幻觉现象,通过DeepFingers框架改进了多尺度流体动态建模。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20362 2026-04-23 cond-mat.stat-mech 50%

Spectral Fluctuation-Dissipation-Response Inequalities

谱波动-耗散-响应不等式

Jie Gu

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文推导了有限状态马尔可夫跳跃过程的谱波动-耗散-响应不等式,通过比较因果响应与平衡态参考,建立了频域分辨和积分不等式,以稳态熵产率、探针方差、短时扰动扩散和可逆弛豫时间尺度为界。

Comments 5+10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20339 2026-04-23 math.AP 50%

Comparison principles and long time behavior for a diffusive Energy Balance Model with vertical resolution

比较原理和长期行为研究:具有垂直分辨率的扩散能量平衡模型

Piermarco Cannarsa, Valerio Lucarini, Patrick Martinez, Cristina Urbani, Judith Vancostenoble

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究了一个两层一维能量平衡模型,探讨了垂直能量交换和经向能量传输对系统长期行为的影响,通过比较原理和正则性性质分析了大气吸收率对解存在性的影响。

Comments 50 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20282 2026-04-23 math.NA cs.NA 50%

Cayley-transform analysis and numerical validation of the convergent Born series for the Helmholtz equation

柯西-阿达马变换分析及收敛Born级数在亥姆霍兹方程中的数值验证

Morten Jakobsen

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出一种算子理论框架,用于高频率亥姆霍兹问题中收敛Born级数(CBS)方法的分析,通过自共轭背景算子的残差算子推导出单位柯西-阿达马变换表示,并验证了其在任意有界域和复波数下的收敛性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20188 2026-04-23 cs.LG math.DS 50%

Structure-Aware Variational Learning of a Class of Generalized Diffusions

具有结构意识的变分学习一类广义扩散过程

Yubin Lu, Xiaofan Li, Chun Liu, Qi Tang, Yiwei Wang

机构 * School of Mathematics, South China University of Technology(华南理工大学数学学院) Department of Applied Mathematics, Illinois Institute of Technology(伊利诺伊理工学院应用数学系) School of Computational Science and Engineering, Georgia Institute of Technology(佐治亚理工学院计算科学与工程学院)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出基于能量的变分学习框架,通过能量耗散原理从部分和噪声观测中学习随机梯度系统的潜在能量函数,提升对观测时间、噪声水平和数据多样性的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20186 2026-04-23 physics.chem-ph 50%

Chromatographic Peak Shape from a Stochastic-Diffusive Model with Multiple Retention Mechanisms: Analytic Time-Domain Expression and Derivatives

从具有多种保留机制的随机扩散模型中获得色谱峰形状:解析时域表达式和导数

Hernán R. Sánchez

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种基于随机扩散模型的色谱峰形状解析表达式,结合轴向扩散、有限初始空间方差和多种保留机制,通过高效评估方案提升了计算效率,并在多个文献峰拟合中表现出更优的精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20124 2026-04-23 physics.comp-ph 50%

SPRAY: A smoothed particle radiation hydrodynamics code for modeling high intensity laser-plasma interactions

SPRAY:一种用于建模高强度激光-等离子体相互作用的光滑粒子辐射水力学代码

Min Ki Jung, Hakhyeon Kim, Su-San Park, Eung Soo Kim, Yong-Su Na, Sang June Hahn

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文介绍SPRAY,一种基于光滑粒子水力学的辐射水力学代码,用于模拟高强度激光-等离子体相互作用。该代码采用无网格、拉格朗日方法,解决了传统方法的数值难题,首次将SPH方法应用于高能密度物理研究。

Journal ref J. Comput. Phys. 508, 113000 (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20025 2026-04-23 math.NA cs.NA 50%

Error estimates for the patch bubble method for convection-dominated channel flow problem

对对流占优通道流问题的补丁气泡方法的误差估计

Eberhard Bänsch, Pedro Morin, Itatí Zocola

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文针对对流占优情形下的对流扩散方程,研究了结合元素气泡和残差自由气泡的BMZ方法的误差估计,通过数值实验验证了方法的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19891 2026-04-23 cs.CR 50%

A Data-Free Membership Inference Attack on Federated Learning in Hardware Assurance

一种无数据的联邦学习在硬件保证中的成员推断攻击

Gijung Lee, Wavid Bowman, Olivia P. Dizon-Paradis, Reiner N. Dizon-Paradis, Ronald Wilson, Damon L. Woodard, Domenic Forte

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出一种无数据的成员推断攻击,利用标准单元库布局引导梯度反向攻击,从拦截的模型更新中重建图像,推断敏感硬件特性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19842 2026-04-23 q-bio.OT 50%

Energy gradients as potential drivers of pre-cellular chemical organization

能量梯度作为非细胞化学组织的潜在驱动因素

Arturo Tozzi

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究探讨了在无膜环境下,环境梯度如何驱动化学物质的空间定位与功能耦合,提出能量可用性变化可作为组织变量,促进化学动态的自组织。

Comments 14 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18139 2026-04-23 cond-mat.mtrl-sci cond-mat.other 50%

Evaluating dispersion models for ab initio simulation of G-I and G-II molten fluoride salts

评估用于初态模拟G-I和G-II熔融氟化物盐的色散模型

Shubhojit Banerjee, Rajni Chahal-Crockett, Julian Barra, Stephen T Lam

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文评估了Grimme的DFT-D和非本地van der Waals修正对熔融氟化物盐的影响,发现色散修正对密度预测有显著影响,但对结合能影响较小。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18075 2026-04-23 hep-ph 50%

Hidden-charm $uds\,c\bar c$ pentaquarks as flavor eigenstates in a constituent quark model

隐藏charm $uds\,c\bar c$ 五夸克态作为味特征态在构成夸克模型中的表现

M. C. Gordillo, J. M. Alcaraz-Pelegrina, J. Segovia

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文利用扩散蒙特卡洛算法研究了$udsc\bar c$五夸克态的非相对论构成夸克模型,发现需满足SU(3)味算符的本征态条件以解释$P_{cs}(4338)$和$P_{cs}(4459)$五夸克态的存在,预测了两种结构与$J/ψΛ$谱质量一致的态。

Comments Typo in the flavor of IIa structure corrected

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02276 2026-04-23 cs.LG stat.ML 50%

Latent Stochastic Interpolants

隐式随机插值

Saurabh Singh, Dmitry Lagun

机构 * Poetiq AI Google DeepMind(谷歌DeepMind)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出隐式随机插值(LSI),通过端到端优化编码器、解码器和隐式随机插值模型,在潜在空间中实现联合学习,有效学习潜在表示并生成过程。

Comments Accepted at ICLR 2026 as a conference paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20678 2026-04-23 cond-mat.soft physics.flu-dyn 50%

Flow-history-dependent orientational relaxation in dilute polydisperse colloidal rod suspensions

稀释非均质棒状胶体悬浮液中流史依赖的取向弛豫

Yuto Yokoyama, Vincenzo Calabrese, Fabian Hillebrand, Henry J. London, Simon J. Haward, Amy Q. Shen

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究稀释非均质棒状胶体悬浮液在流体作用下的取向弛豫行为,揭示流史对取向弛豫动态的影响,建立基于旋转扩散系数的Péclet数模型解释实验数据。

Comments 17 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20619 2026-04-23 hep-th cond-mat.stat-mech quant-ph 50%

Stochastic Krylov Dynamics: Revisiting Operator Growth in Open Quantum Systems

随机Krylov动力学:重新审视开放量子系统中的算子增长

Arpan Bhattacharyya, S. Shajidul Haque, Jeff Murugan, Mpho Tladi, Hendrik J. R. Van Zyl

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究通过Schwinger-Keldysh方法推导了Krylov位置的全计数统计有效作用量,揭示环境耦合使算子增长的动力学从Hamiltonian转变为随机过程,从而扩展并破坏了超几何机制。

Comments 35 pages, 2 appendices, 0 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02931 2026-04-23 cs.CL 50%

Memorization, Emergence, and Explaining Reversal Failures: A Controlled Study of Relational Semantics in LLMs

记忆、涌现与解释反转失败:对LLMs中关系语义的受控研究

Yihua Zhu, Qianying Liu, Jiaxin Wang, Fei Cheng, Chaoran Liu, Akiko Aizawa, Sadao Kurohashi, Hidetoshi Shimodaira

机构 * Kyoto University(京都大学) University of Tokyo(东京大学) NII LLMC(日本信息处理学会LLMC) RIKEN(理化学研究所)

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究通过受控知识图谱框架探讨LLMs在关系任务中的记忆、逻辑推理和泛化能力,发现关系语义在足够逻辑监督下涌现,并揭示反转失败主要由自回归顺序偏差引起。

Comments ACL2026 Main Long Paper

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 可控生成 2 篇

2604.19954 2026-04-23 cs.CV 88%

Camera Control for Text-to-Image Generation via Learning Viewpoint Tokens

通过学习视角令牌实现文本到图像生成的相机控制

Xinxuan Lu, Charless Fowlkes, Alexander C. Berg

机构 * University of California, Irvine(加州大学尔湾分校)

专题命中 可控生成 :image generation(title,abstract);text-to-image(title,abstract);分类 cs.CV

AI总结 本文提出通过学习参数化相机令牌实现文本到图像生成中的精确相机控制,结合3D渲染图像和真实增强图像,提升生成图像的准确性和保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19683 2026-04-23 cs.RO 50%

Mask World Model: Predicting What Matters for Robust Robot Policy Learning

遮罩世界模型:为鲁棒机器人策略学习预测重要的内容

Yunfan Lou, Xiaowei Chi, Xiaojie Zhang, Zezhong Qian, Chengxuan Li, Rongyu Zhang, Yaoxu Lyu, Guoyu Song, Chuyao Fu, Haoxuan Xu, Pengwei Wang, Shanghang Zhang

机构 * Peking University, Beijing, China State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University Beijing Academy of Artificial Intelligence, Beijing, China National University of Singapore, Singapore The Hong Kong University of Science Nanjing University, Nanjing, China

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出Mask World Model,通过预测语义遮罩而非像素,提升机器人策略学习的鲁棒性与泛化能力,实验证明其在仿真和现实任务中均优于现有方法。

Comments 16 pages,5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 个性化与一致性 2 篇

2510.18263 2026-04-23 cs.LG cs.CV cs.GR 84%

From Competition to Synergy: Unlocking Reinforcement Learning for Subject-Driven Image Generation

从竞争到协同:解锁受主体驱动的图像生成中的强化学习

Ziwei Huang, Ying Shu, Hao Fang, Quanyu Long, Wenya Wang, Qiushi Guo, Tiezheng Ge, Leilei Gan

机构 * Zhejiang University(浙江大学) Alibaba Group(阿里巴巴集团) Nanyang Technological University(南洋理工大学)

专题命中 个性化与一致性 :image generation(title,abstract);diffusion(abstract);分类 cs.CV、cs.GR

AI总结 本文提出Customized-GRPO方法,通过Synergy-Aware Reward Shaping和Time-Aware Dynamic Weighting解决强化学习中身份保持与提示遵循的平衡问题,提升图像生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10647 2026-04-23 cs.RO 50%

OmniUMI: Towards Physically Grounded Robot Learning via Human-Aligned Multimodal Interaction

OmniUMI: 通过人对齐的多模态交互实现物理基础的机器人学习

Shaqi Luo, Yuanyuan Li, Youhao Hu, Chenhao Yu, Chaoran Xu, Jiachen Zhang, Guocai Yao, Tiejun Huang, Ran He, Zhongyuan Wang

机构 * Beijing Academy of Artificial Intelligence(北京人工智能研究院) MAIS & NLPR, Institute of Automation, Chinese Academy of Sciences(自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Beijing Institute of Technology(北京理工大学) Beijing University of Posts and Telecommunications(北京邮电大学) Peking University(北京大学)

专题命中 个性化与一致性 :diffusion(abstract)

AI总结 OmniUMI通过人对齐的多模态交互实现物理基础的机器人学习,整合视觉、触觉和力觉数据,提升接触密集操作的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 图像生成评测 2 篇

2604.19829 2026-04-23 cs.CV 57%

TactileEval: A Step Towards Automated Fine-Grained Evaluation and Editing of Tactile Graphics

TactileEval: 向自动细粒度评估和编辑触觉图形迈出一步

Adnan Khan, Abbas Akkasi, Majid Komeili

机构 * School of Computer Science, Carleton University(卡莱顿大学计算机科学学院)

专题命中 图像生成评测 :image editing(abstract);分类 cs.CV

AI总结 本文提出TactileEval,通过三阶段流程实现触觉图形的自动细粒度评估与编辑,基于专家评论建立质量分类体系,并利用ViT模型实现高精度任务识别与针对性修正。

Comments Code, data, and models are available at https://TactileEval.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18873 2026-04-23 cs.LG 50%

Best Policy Learning from Trajectory Preference Feedback

最佳策略学习从轨迹偏好反馈

Akhil Agnihotri, Rahul Jain, Deepak Ramachandran, Zheng Wen

机构 * University of Southern California(南加州大学) Google(谷歌) DeepMind(深度Mind) OpenAI

专题命中 图像生成评测 :image generation(abstract)

AI总结 本文研究了基于偏好强化学习的最佳策略识别问题,提出PSPL算法,通过维护奖励模型和动态的后验分布,提供首个贝叶斯简单遗憾保证,并在模拟和图像生成基准中优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 效率与蒸馏 5 篇

2505.02242 2026-04-23 cs.CV 79%

Sampling-Aware Quantization for Diffusion Models

面向采样意识的扩散模型量化

Qian Zeng, Jie Song, Yuanyu Wan, Huiqiong Wang, Mingli Song

机构 * School of Software Technology, Zhejiang University(浙江大学软件技术学院) Ningbo Innovation Center, Zhejiang University(浙大宁波创新中心) State Key Laboratory of Blockchain and Security, Zhejiang University(浙江大学区块链与安全国家重点实验室) Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security(杭州高新技术区(滨江)区块链与数据安全研究院)

专题命中 效率与蒸馏 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出面向采样意识的量化策略,通过混合阶轨迹对齐技术提升采样精度与效率,实验表明在保持高速采样器收敛特性的同时,生成质量更优。

Comments 17 pages, 12 figures, CVPR2026 accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20079 2026-04-23 cs.LG cs.CL 78%

On the Quantization Robustness of Diffusion Language Models in Coding Benchmarks

扩散语言模型在编码基准中的量化鲁棒性研究

Aarav Gupta, Gururaj Deshpande, Chandreyi Chakraborty

机构 * College of Computing(计算机学院) Georgia Institute of Technology(佐治亚理工学院)

专题命中 效率与蒸馏 :diffusion(title,abstract)

AI总结 本文研究了扩散语言模型在量化后的鲁棒性,发现CoDA在低比特宽度下比Qwen3-1.7B更稳健,且混合精度配置在精度、延迟和内存间提供平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.09232 2026-04-23 cs.LG math.ST stat.TH 71%

Diffusion Approximations for Thompson Sampling in the Small Gap Regime

差分方程近似在小间隙情形下的汤普森采样

Lin Fan, Peter W. Glynn

机构 * Kellogg School of Management, Northwestern University(西北大学凯洛格管理学院) Department of Management Science and Engineering, Stanford University(斯坦福大学管理科学与工程系)

专题命中 效率与蒸馏 :diffusion(title)

AI总结 研究小间隙情形下汤普森采样及相关采样算法的过程动态,展示其弱收敛于随机微分方程解,发现算法不变原理及对模型误设定的不敏感性。

详情

展开后加载摘要…

URL PDF HTML 收藏