arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-07-23 至 2026-07-23 共收录 30 信号源:cs.CV, cs.GR, cs.MM

1. 图像编辑 2 篇

2607.20197 2026-07-23 cs.CV 新提交 79%

RS-RIE-Bench: Benchmarking Reasoning-Guided Remote Sensing Image Editing

RS-RIE-Bench:推理引导的遥感图像编辑基准测试

Zihan Qin, Boao Xu, Zhao Dong, Yingping Sun, Ziheng Jiao, Junying Wang, Hongwei Wang

机构 * Huawei(华为)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 该研究针对遥感图像编辑,引入RS-RIE-Bench基准,将任务分类,通过特定评估协议和方法评估模型,经实验发现当前模型在推理引导的遥感编辑中有局限,为未来模型提供了基准和研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19777 2026-07-23 cs.CV 新提交 57%

Look Before You Edit: Attention-Guided Camera Placement and Multi-View Alignment for 3D Gaussian Splatting Editing

编辑前先观察:用于3D高斯点渲染编辑的注意力引导相机放置和多视图对齐

Jaeyeon Park, Taeho Kang, Youngki Lee

机构 * Seoul National University(首尔国立大学)

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

AI总结 针对3D高斯点渲染编辑受固定相机限制的问题,提出LB-Edit框架。通过注意力引导相机放置确定编辑相机位置,多视图注意力对齐使视图编辑一致。实验表明该方法在多方面表现优,减少视图数量并降低延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 扩散模型 25 篇

2607.19919 2026-07-23 cs.RO cs.LG 新提交 85%

Diffusion ReRoll: Revisable Denoising for Robotic Sequential Prediction

扩散重滚动:用于机器人序列预测的可修正去噪

Seonsoo Kim, Seongil Hong, Jun-Gill Kang

机构 * Agency for Defense Development(国防发展局)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract)

AI总结 研究提出扩散重滚动框架用于机器人序列预测,能选择性重新去噪局部稳定区域,实现跨视野迭代修正。通过与其他方法对比评估,在多任务基准测试中取得更好性能,支持结构化重新去噪是可修正机器人序列生成的有效机制。

Comments Project Page: https://seonsoo-p1.github.io/DiffusionReRoll/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19895 2026-07-23 cs.CV cs.AI 新提交 83%

OSVE: One Step Video Editing with One Step Diffusion Models

OSVE:使用单步扩散模型进行单步视频编辑

Habin Lim, Gyeong-Moon Park

机构 * Korea University(韩国大学)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

AI总结 研究针对扩散模型文本引导视频编辑慢的问题,提出OSVE框架。通过训练可学习编码器预测初始噪声,引入UFE技术及滑动窗口策略保持一致性,实现高质量视频编辑,速度比现有方法快约155 - 171倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20293 2026-07-23 cs.CV 新提交 79%

Evolving Cache Schedules for Fast Diffusion Policy Inference

用于快速扩散策略推理的演进缓存调度

Siying Wang, Kangye Ji, Di Wang, Fei Cheng

机构 * School of Telecommunications Engineering, Xidian University(西安电子科技大学通信工程学院) School of Computer Science and Technology, Xidian University(西安电子科技大学计算机科学与技术学院) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 研究针对扩散策略实时部署计算需求大的问题,提出演进缓存调度(EVO)框架,通过进化搜索全局调度缓存刷新,引入冗余感知初始化和目标条件早期停止,大幅减少计算量并保留性能,实现动作生成加速和FLOPs降低。

Comments 15 pages, 3 figures, supplementary material included. Accepted by PRCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20048 2026-07-23 cs.CV 新提交 79%

Importance-Aware OBS Pruning for Diffusion Models

用于扩散模型的重要性感知OBS剪枝

Ba-Thinh Lam, Srijan Das, Hieu Le

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 针对扩散模型提出重要性感知剪枝框架,通过纳入空间重要性映射到剪枝目标,在MS-COCO数据集上高压缩率下保持主题保真度和结构正确性,证明内容感知目标对生成模型感知忠实压缩很关键。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19943 2026-07-23 cs.CV 新提交 79%

SIINR: Structurally Informed Implicit Neural Representations for super-resolution with uncertainty quantification of clinical quality diffusion MRI datasets

SIINR:用于临床质量扩散MRI数据集超分辨率及不确定性量化的结构信息隐式神经表示

Tom Hendriks, William Consagra, Anna Vilanova, Yogesh Rathi, Maxime Chamberland

机构 * Eindhoven University of Technology(埃因霍温理工大学) University of South Carolina(南卡罗来纳大学) Brigham and Women’s Hospital, Harvard Medical School(布莱根妇女医院,哈佛医学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 针对临床dMRI数据集平面外分辨率低的问题,提出SIINR框架,利用监督3D U-net和自监督INR结合,实现超分辨率及不确定性量化,在多数据集和临床病例实验中表现优异,为临床dMRI增强及指标解释提供方法。

Comments 27 pages, 8 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19886 2026-07-23 cs.CV 新提交 79%

MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation

MTVDiff:用于增强热红外到可见光面部翻译的多模态条件潜扩散

Zhiyuan Xia, Haojie Li, Jingyu Lin, Yiguo Qiao, Cunjian Chen

机构 * School of Computer Science and Engineering, Southeast University(东南大学计算机科学与工程学院) Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications (Southeast University)(新一代人工智能技术及其交叉应用重点实验室(东南大学)) Monash University(莫纳什大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 针对热红外到可见光面部翻译的挑战,提出MTVDiff框架,通过双分支交叉注意力融合等三个核心技术,整合深度和文本信息,在多指标上优于现有方法,提升图像质量和面部验证性能,推动跨光谱面部图像翻译发展。

Comments Accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19701 2026-07-23 cs.CV 新提交 79%

SafeGen: Goal-Conditioned Video Diffusion of Safety-Critical Scenarios for VLM-Based Autonomous Driving

SafeGen:基于视觉语言模型的自动驾驶安全关键场景的目标条件视频扩散

Jiangfan Liu, Zexuan Cui, Tianyuan Zhang, Zonglei Jing, Zonghao Ying, Yaoyuan Zhang, Jiakai Wang, Xiaoqi Jiang, Aishan Liu, Xianglong Liu

机构 * Beihang University(北京航空航天大学) Zhongguancun Laboratory(中关村实验室) Chery Automobile Co., Ltd.(奇瑞汽车股份有限公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 研究针对VLM在自动驾驶系统中的应用,提出SafeGen框架,将场景生成设为目标条件扩散过程,引入上下文接地最终状态推理和最终状态条件下的视频演化,实验表明该框架能提升评判得分,微调后可提高真实驾驶场景性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19522 2026-07-23 cs.LG cs.CV 新提交 79%

Geospatial Diffusion-based Evolution Synthesis (GeoDES) for Storm-Centered Weather Augmentation

基于地理空间扩散的风暴中心天气增强演化合成(GeoDES)

Sonia Cromp, Satya Sai Srinath Namburi GNVV, Youran Wang, Grace Kisslinger, Frederic Sala, James Booth, Allegra LeGrande

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 研究针对机器学习天气模型预测风暴结构难题,提出基于地理空间扩散的演化合成(GeoDES)模型,该模型能合成高保真天气事件,经评估在关键指标上优于先前方法,可用于测试预测模型和扩展气象数据集。

Comments 31 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19459 2026-07-23 astro-ph.IM astro-ph.CO cs.CV stat.ML 新提交 79%

Strong Gravitational Lensing Posterior Sampling in Pixel-Space Using Diffusion Models and Recurrent Inference Machines

使用扩散模型和循环推理机在像素空间中进行强引力透镜后验采样

Guillaume Payeur, Laurence Perreault-Levasseur, Gabriel Missael Barco, Yashar Hezaveh

机构 * Department of Physics, Universit\'e de Montr\'eal, Montreal QC, Canada Mila - Quebec AI Institute, Montreal QC, Canada Ciela Institute, Institute for Astrophysics Trottier Space Institute, McGill University, Montreal QC, Canada Center for Computational Astrophysics, Flatiron Institute, New York, USA Perimeter Institute for Theoretical Physics, Waterloo ON, Canada

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 研究星系-星系强引力透镜问题,提出结合扩散生成建模与循环推理机的方法,能生成源星系和前景质量分布的联合后验样本作为像素化图像,可对含背景和前景星系的真实引力透镜模拟建模至噪声水平。

Comments 31 pages, 34 figures, Extension of an article accepted at the ICML 2026 Workshop on AI for Physics

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19486 2026-07-23 cond-mat.stat-mech physics.soc-ph 新提交 78%

Localization transitions of diffusion dynamics in physical networks

物理网络中扩散动力学的定位转变

Jun Yamamoto, Ivan Bonamassa, Márton Pósfai

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 研究物理网络中扩散动力学的定位转变,核心方法是求解分析模型,发现度-体积比为无序参数,其失谐重组拉普拉斯谱,揭示了特征丰富驱动的定位控制机制,表明物理特性重塑网络动力学无序格局。

Comments 6 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19808 2026-07-23 astro-ph.GA astro-ph.CO 新提交 78%

From Dark Matter to Galaxies: Halo-Free Mock Generation via Conditional Point-Cloud Diffusion

从暗物质到星系:通过条件点云扩散生成无晕模拟

Kana Moriwaki, Ken Osato, Naoki Yoshida

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 研究提出基于扩散的生成模型,以暗物质密度场为输入生成含位置和物理性质的星系点云。在IllustrisTNG模拟目录上训练,能再现星系与暗物质场关系及多种分布,还可绕过晕发现,为相关实验提供实用引擎及新推断途径。

Comments 9 pages, 9 figures, submitted to MNRAS

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19437 2026-07-23 eess.IV cs.CV cs.MM 新提交 62%

Group-of-Latents: Perceptual Video Compression at Extreme Bitrates via Masked Latent Generative Modeling

潜在组:通过掩码潜在生成建模实现极端比特率下的感知视频压缩

Shaokang Wang, Jinchang Xu, Peidong Jia, Zhijian Hao, Siyuan Qian, Fei Zhao, Rui Ma, Xiaozhu Ju, Jian Tang, Xiaodong Xie, Shanghang Zhang, Huizhu Jia

机构 * State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University, Beijing, China(多媒体信息处理国家重点实验室,计算机科学学院,北京大学,北京,中国) State Key Discipline Laboratory of Wide Band-Gap Semiconductor Technology, School of Microelectronics, Xidian University, Xi'an, China(宽带隙半导体技术重点学科实验室,微电子学院,西安电子科技大学,西安,中国)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV、cs.MM

AI总结 针对极低比特率视频压缩未充分探索的问题,提出统一生成框架,通过潜在组策略、深度压缩模块和统一潜在去噪模块,在极低比特率下实现高感知质量,有丰富空间细节和强大时间一致性,达到最新水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20159 2026-07-23 cs.CV 新提交 57%

SHFormer: Dynamic Spectral Filtering Convolutional Neural Network and High-pass Kernel Generation Transformer for Adaptive MRI Reconstruction

SHFormer:用于自适应MRI重建的动态频谱滤波卷积神经网络和高通内核生成变压器

Sriprabha Ramanarayanan, Rahul G. S., Mohammad Al Fahim, Keerthi Ram, Ramesh Venkatesan, Mohanasankar Sivaprakasam

机构 * Indian Institute of Technology Madras (IITM)(印度理工学院马德拉斯分校) Healthcare Technology Innovation Centre(医疗技术创新中心) GE John F Welch Technology Center(通用电气约翰·F·韦尔奇技术中心)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 针对基于注意力机制的MRI重建模型在高频表示和多模态数据处理上的不足,提出含频谱滤波CNN和动态高通内核生成变压器的网络进行可扩展MRI重建,在未见场景下有良好重建效果,提升了PSNR和SSIM。

Comments Published in Neural Networks (Elsevier), Vol. 187, Article 107334, July 2025. DOI: 10.1016/j.neunet.2025.107334

Journal ref Neural Networks, Vol. 187, Article 107334, July 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20125 2026-07-23 cs.CV cs.LG 新提交 57%

HeadCast: Casting Attention Heads for Efficient Autoregressive Video Generation

HeadCast:为高效自回归视频生成分配注意力头

Jinliang Shen, Lianghao Su, Zheming Li, Kang He, ZiLiang Lai, Yanbing Jiang, Chengru Song

机构 * KlingAI Research(克林人工智能研究公司)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 研究针对自回归视频扩散模型注意力成本高的问题,提出HeadCast框架,基于预训练模型注意力头行为进行一次性分类,重组KV缓存,保留全局头,在不同分辨率下有效加速推理且保持质量,减少闪烁。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19986 2026-07-23 cs.CV 新提交 57%

STEREOFLOW: Progressive Stereo Matching with StereoDiT and Transition Flow Matching

STEREOFLOW:基于StereoDiT和过渡流匹配的渐进式立体匹配

Hao Wang, Haoran Geng, Xiaotong Yang, Jing Tang, Songlin Wei, Linlong Lang, Yeying Jin, Zheng Zhu, Zhaoxin Fan, Biao Leng

机构 * School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院) University of California, Berkeley(加州大学伯克利分校) University of Southern California(南加州大学) Google(谷歌公司) State Key Laboratory of Intelligent Manufacturing Equipment and Technology, Huazhong University of Science and Technology(华中科技大学智能制造装备与技术国家重点实验室) Tencent(腾讯公司) GigaAI(未知(可能是公司或组织,由于未找到确切对应中文名,按原文保留))

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 研究针对立体匹配问题,提出先验引导的生成框架StereoFlow,通过两阶段渐进级联匹配网络、像素扩散变压器StereoDiT和过渡流匹配实现高效优化,在多基准测试中取得多个最新结果,提升了立体匹配效果。

Comments 10 pages, 6 figures, submitted to TVCG

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19623 2026-07-23 cs.AR cs.LG 新提交 50%

From Bit-Position Sensitivity to Unequal Error Protection for DNN Inference Memory

从位位置敏感性到深度神经网络推理内存的不等错误保护

Muhammad Husnain Mubarik, Karthik Mohan Kumar, Pedro Antonio Pena, Keshavan Varadarajan, Kunal Tyagi

机构 * Advanced Micro Devices, Inc.(Advanced Micro Devices 公司)

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究在多种工作负载和浮点格式中表征DNN推理内存的位位置故障敏感性,发现位敏感性转变,提出不等错误保护方法,得出数据类型下限和工作负载感知层级,驱动UEP编解码器及双分区架构,减少ECC面积、降低读取能量。

Comments Accepted to appear at the 59th IEEE/ACM International Symposium on Microarchitecture (MICRO 2026). 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19524 2026-07-23 cs.LG cs.AI cs.DC 新提交 50%

SynPre-FL: Synthetic data-driven pretraining integrated Federated Learning training framework

SynPre-FL:合成数据驱动的预训练集成联邦学习训练框架

Akarsh K Nair, Muhammad Arifur Rahman, Nicholas Shopland, Andy Burton, Jun He, Yuan Shen, David Baldwin, Emma O'Dowd, Amna Burzic, Mufti Mahmud, David J. Brown

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究针对联邦学习在临床风险预测中面临的问题及局限,提出SynPre-FL框架,结合合成EHR生成与合成预训练联邦学习,通过潜在自动编码器扩散模型等技术,提升非IID条件下预测的稳健性、可扩展性与可解释性。

Comments 18 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20373 2026-07-23 math.PR math.ST stat.TH 新提交 50%

Embedding martingale diffusions as binary posteriors in sequential inference

在序贯推断中将鞅扩散嵌入为二元后验概率

Steven Campbell, Karl Kristian Engelund

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究将鞅扩散嵌入二元后验概率的问题,通过显式二元序贯实验实现,给出了包括吸收布朗运动等在内的有界鞅扩散的序贯推断解释,揭示了相关条件及不同情况下后验性质。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20288 2026-07-23 math.AP 新提交 50%

Principal spectral theory and variational characterizations for nonlocal coupled cooperative systems and applications

非局部耦合合作系统的主谱理论及变分特征与应用

Xiandong Lin, Jiazhuo Cheng, Qiru Wang

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究非局部耦合合作系统主谱理论,通过置换矩阵重排算子分量分解为子算子,刻画谱界。基于此给出非局部扩散系统基本再生数变分特征,分析多基因型干细胞再生模型动力学行为及非强耦合时的阈值动力学。

Comments 30 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19583 2026-07-23 math.PR 新提交 50%

Density-Dependent McKean--Vlasov Diffusions: Subgaussian Occupancy Bounds and Polynomial Propagation of Chaos

密度依赖的McKean-Vlasov扩散:次高斯占有界与混沌的多项式传播

Denis Belomestny, Ekaterina Morozova

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究密度依赖的McKean-Vlasov扩散及直方图粒子近似,在两个解析条件下用路径空间熵证明,得出相关占有界和误差估计,还介绍了直方图估计器的可扩展性及低评估成本。

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19502 2026-07-23 cs.IT cs.ET cs.SY eess.SY math.IT 新提交 50%

MC-BRIDGE: A Modular Receiver-Chain Simulation Framework for OECT-Based Molecular Communication

MC-BRIDGE:用于基于有机电化学晶体管的分子通信的模块化接收链仿真框架

Hongbin Ni, Ozgur B. Akan

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究基于OECT的分子通信,提出MC-BRIDGE模块化框架,连接多种过程到电荷域检测,能生成噪声、支持多种键控,通过公共接口估计相关指标并分析干扰,经测试得出满足SER目标的预算上限,揭示多种因素对接收器结论的影响。

Comments 13 pages, 7 figures, submitted to IEEE Transactions on Molecular, Biological, and Multi-Scale Communications (TMBMC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20029 2026-07-23 physics.flu-dyn 新提交 50%

Discrete Boltzmann model at Burnett level for compressible multicomponent flows under external forces

外力作用下可压缩多组分流的伯内特水平离散玻尔兹曼模型

Demei Li, Huilin Lai, Chuandong Lin, Suni Chen

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究将伯内特水平离散玻尔兹曼模型扩展到外力作用下的多组分可压缩流,采用高各向同性离散速度集和矩匹配策略,经查普曼-恩斯科格展开验证,并通过五个基准案例验证,该模型能高精度捕捉相关特征。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19631 2026-07-23 physics.flu-dyn 新提交 50%

svMultiPhysics: a finite element-based solver for cardiovascular simulations

svMultiPhysics:一种用于心血管模拟的基于有限元的求解器

David Codoni, Sujal Dave, David W. Parker, Aaron L. Brown, Javiera Jilberto, Han Zhao, Divya Adil, Zachary A. Sexton, Martin R. Pfaller, Michele Bucelli, Shawn C. Shadden, Charles A. Taylor, Alison L. Marsden

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究旨在借助计算建模改善心脏病相关研究。核心方法是用C++编写的开源并行有限元求解器svMultiPhysics,它能统一模拟多物理场心血管问题的方程,可独立或耦合求解。主要贡献是为心血管研究提供强大平台,实现多物理场耦合模拟,加速模拟且促进开源协作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20279 2026-07-23 cond-mat.stat-mech math-ph math.MP math.PR 新提交 50%

Random walks in Dirichlet random environment in dimension $d+1$

维度 \(d + 1\) 中狄利克雷随机环境下的随机游走

Guillaume Barraquand, Alexander K. Hartmann, Pierre Le Doussal

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究维度 \(d = 1\)、\(2\)、\(3\) 中狄利克雷随机环境下随机游走,通过数值研究其与 KPZ 增长的关系,验证 \(d = 1\) 和 \(d = 2\) 时的兼容性,确认 \(d = 3\) 时的相变并获下界,发现不同无序相特点及可计算样本间方差。

Comments 27 pages, 13 figures. Data gnuplot files for plots available at https://dare.uol.de/dataset.xhtml?persistentId=doi:10.57782/G0HPXH

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19789 2026-07-23 cond-mat.mtrl-sci physics.optics 新提交 50%

Numerical exploration on unveiling the photovoltaic potential of MgXS3(X = Ti, Zr, Hf) chalcogenide perovskites

揭示MgXS3(X = Ti、Zr、Hf)硫族钙钛矿光伏潜力的数值探索

Md. Mizanur Rahman, Md. Nahid Hasan, Tanvir Ahmed, Jaker Hossain

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究无铅硫族钙钛矿MgXS3(X = Ti、Zr、Hf)在太阳能电池中的光伏潜力,通过3D有限元模拟分析其器件性能,研究多种因素影响,给出优化条件下不同成分器件的性能数据,证实其为有前景的无铅吸收材料并提供设计指导。

Comments 37 pages, 11 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 个性化与一致性 2 篇

2607.19947 2026-07-23 cs.CV 新提交 57%

ETPDesigner: Multi-Agent Orchestration for Interactive Multimodal Electronic Theater Program

ETPDesigner:用于交互式多模态电子剧院节目的多智能体编排

Mengtian Li, Xinru Guo, Xiaoru Lin, Xiao Rong, Zhifeng Xie, Chaofeng Chen

机构 * Shanghai University(上海大学) Shanghai Engineering Research Center of Motion Picture Special Effects(上海电影特效工程技术研究中心) Institute for Math and AI, Wuhan School of Artificial Intelligence, Wuhan University(武汉大学数学与人工智能研究院武汉人工智能学院)

专题命中 个性化与一致性 :text-to-image(abstract);分类 cs.CV

AI总结 研究针对电子剧院节目设计难题,提出ETPDesigner多智能体框架,能从戏剧脚本合成高质量ETP,通过全局风格锚定机制保证一致性,还实现交互功能,经ETP-Pro基准测试验证了方法在多方面的优越性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20127 2026-07-23 cs.CL 新提交 50%

Back to Back with a Copy: A Computational Analysis of AI-Generated Visual Contemporary Art Pastiches

与仿作并肩:人工智能生成的视觉当代艺术模仿作品的计算分析

Anca Dinu, Andreiana Mihail, Andra-Maria Florescu, Claudiu Creanga, Liviu Dinu

机构 * University of Bucharest(布加勒斯特大学)

专题命中 个性化与一致性 :image generation(abstract)

AI总结 本文研究更新的生成模型模仿当代艺术作品的能力及不同语言模型中风格评估的多维度一致性。利用五个计算机视觉模型,通过余弦距离捕捉多种特征,对比新旧模型。结果显示新模型语义对齐改进、多样性增加,但浅层特征表现稍弱,还通过艺术家反馈进行情境化。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 图像生成评测 1 篇

2607.19923 2026-07-23 cs.CV 新提交 57%

WearWow: Native 2K Multi-Garment Virtual Try-On via Adaptive Token Packing and Preference Alignment

WearWow:通过自适应令牌打包和偏好对齐实现原生2K多服装虚拟试穿

Xujie Zhang, Runyan Du, Song Chang, Jiang Li, Dongliang Shao, Liping Wu, Wei Luo, Xiaochao Qu, Luoqi Liu, Xiaodan Liang

机构 * Shenzhen Campus of Sun Yat-sen University(中山大学深圳校区) Meitu Lab(美图实验室)

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV

AI总结 研究针对原生2K多服装虚拟试穿难题,提出WearWow框架。用自适应2D令牌打包减轻内存爆炸,多维试穿奖励系统纠正纹理退化,还构建高质量数据集。实验证明该框架在原生2K多服装合成上达新水平,超越现有商业基线。

详情

展开后加载摘要…

URL PDF HTML 收藏