arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-03-16 至 2026-03-16 共收录 72 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 5 篇

2603.13070 2026-03-16 cs.CV 88%

Mitigating Memorization in Text-to-Image Diffusion via Region-Aware Prompt Augmentation and Multimodal Copy Detection

通过区域感知提示增强和多模态复制检测缓解文本到图像扩散中的记忆化

Yunzhuo Chen, Jordan Vice, Naveed Akhtar, Nur Al Hasan Haldar, Ajmal Mian

机构 * The University of Western Australia(西澳大学) The University of Melbourne(墨尔本大学) Curtin University(科廷大学)

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);分类 cs.CV

AI总结 本文提出区域感知提示增强和多模态复制检测方法,通过增强提示多样性与检测复制行为,提升文本到图像扩散模型的生成质量与安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14041 2026-03-16 cs.CV cs.AI 77%

BitDance: Scaling Autoregressive Generative Models with Binary Tokens

BitDance: 通过二进制令牌扩展自回归生成模型

Yuang Ai, Jiaming Han, Shaobin Zhuang, Weijia Mao, Xuefeng Hu, Ziyan Yang, Zhenheng Yang, Yali Wang, Huaibo Huang, Xiangyu Yue, Hao Chen

专题命中 文生图 :image generation(abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 BitDance通过二进制令牌生成高熵表示,结合二进制扩散头和next-patch扩散方法,实现高效图像生成,达到最佳FID分数并显著提升推理速度。

Comments Code and models: https://github.com/shallowdream204/BitDance

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12998 2026-03-16 cs.CV 70%

A Closed-Form Solution for Debiasing Vision-Language Models with Utility Guarantees Across Modalities and Tasks

为跨模态和任务提供具有实用保障的视觉-语言模型去偏方法

Tangzheng Lian, Guanyu Hu, Yijing Ren, Dimitrios Kollias, Oya Celiktutan

机构 * King’s College London(伦敦国王学院) Queen Mary University of London(伦敦女王学院)

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

AI总结 本文提出一种无需标注数据的训练自由去偏方法,在跨模态空间中获得帕累托最优公平性,同时保持有限的实用性损失,实验显示其在多种公平度量和任务中优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13116 2026-03-16 cs.HC 67%

Memory Printer: Exploring Everyday Reminiscing by Combining Slow Design with Generative AI-based Image Creation

记忆打印机:通过结合缓慢设计与基于生成AI的图像创作探索日常回忆

Zhou Fang, Janet Yi-Ching Huang

专题命中 文生图 :image generation(abstract);text-to-image(abstract)

AI总结 本文提出Memory Printer,结合丝网印刷隐喻与文本到图像生成,通过分层重建、物理木刮刀和内置打印,探索慢互动如何重塑人机关系,发现记忆唤起与控制感提升等机遇及算法偏见等挑战。

Comments Accepted to CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13118 2026-03-16 cs.CV 57%

NOIR: Neural Operator mapping for Implicit Representations

NOIR:用于隐式表示的神经算子映射

Sidaty El Hadramy, Nazim Haouchine, Michael Wehrli, Philippe C. Cattin

机构 * Department of Biomedical Engineering, University of Basel(巴塞尔大学生物医学工程系) Harvard Medical School, Brigham and Women’s Hospital(哈佛医学院布里奇沃特医院)

专题命中 文生图 :image synthesis(abstract);分类 cs.CV

AI总结 NOIR框架将医学影像任务重新表述为连续函数空间间的算子学习,实现分辨率无关的功能到功能转换,展示了对未见过离散化的强鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 图像编辑 2 篇

2603.12949 2026-03-16 eess.IV cs.CR cs.MM 83%

Editing Away the Evidence: Diffusion-Based Image Manipulation and the Failure Modes of Robust Watermarking

去除证据:基于扩散的图像篡改与鲁棒水印的失效模式

Qian Qi, Jiangyun Tang, Jim Lee, Emily Davis, Finn Carter

专题命中 图像编辑 :diffusion(title,abstract);image editing(abstract);分类 cs.MM

AI总结 本文分析了基于扩散的图像编辑对鲁棒水印的影响,指出非对抗性编辑可能无意中降低或消除水印,提出水印信号与噪声比和互信息的界限,揭示信息论上无法恢复的条件。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13028 2026-03-16 cs.CR cs.AI 67%

Purify Once, Edit Freely: Breaking Image Protections under Model Mismatch

一次净化,自由编辑:在模型不匹配下突破图像保护

Qichen Zhao, Shengfang Zhai, Xinjian Bai, Qingni Shen, Qiqi Lin, Yansong Gao, Zhonghai Wu

机构 * Peking University(北京大学) National University of Singapore(国立新加坡大学) The University of Western Australia(西澳大学)

专题命中 图像编辑 :diffusion(abstract);image editing(abstract)

AI总结 研究提出统一的后期净化框架,评估模型不匹配下的保护有效性,提出VAE-Trans和EditorClean两种实用净化器,显著提升图像编辑质量,揭示一次净化后保护信号失效的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 扩散模型 48 篇

2602.07786 2026-03-16 gr-qc astro-ph.HE astro-ph.IM 86%

Accelerating Black Hole Image Generation via Latent Space Diffusion Models

通过潜在空间扩散模型加速黑洞图像生成

Ao Liu, Xudong Zhang, Lin Ding, Cuihong Wen, Wentao Liu, Jieci Wang

专题命中 扩散模型 :diffusion(title,abstract);image generation(title)

AI总结 本文提出一种基于潜在空间的扩散模型,通过物理条件生成高保真黑洞图像,显著提升生成效率和图像质量,减少计算成本四倍以上。

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13162 2026-03-16 eess.IV cs.CV 83%

DiT-IC: Aligned Diffusion Transformer for Efficient Image Compression

DiT-IC:面向高效图像压缩的对齐扩散变换器

Junqi Shi, Ming Lu, Xingchen Li, Anle Ke, Ruiqi Zhang, Zhan Ma

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

AI总结 本文提出DiT-IC,通过三种对齐机制在紧凑的潜在空间中实现高效图像压缩,显著提升解码速度和降低内存使用,实现状态领先的感知质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14815 2026-03-16 cs.CV cs.AI cs.CE cs.LG physics.geo-ph 83%

Latent diffusion models for parameterization and data assimilation of facies-based geomodels

基于潜扩散模型的地质体参数化与数据同化

Guido Di Federico, Louis J. Durlofsky

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

AI总结 本文提出利用潜扩散模型对基于岩性地质体进行参数化与数据同化,通过变分自编码器和U-Net实现降维与去噪,生成与参考模型一致的地质体实现。

Journal ref 10.1016/j.cageo.2024.105755

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13069 2026-03-16 cs.LG cs.CV cs.IT math.DS math.IT 79%

Fractals made Practical: Denoising Diffusion as Partitioned Iterated Function Systems

分形的实用化:去噪扩散作为分段迭代函数系统

Ann Dooms

机构 * Department of Mathematics & Data Science(数学与数据科学系)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文通过分段迭代函数系统框架,揭示扩散模型的去噪动态,并提出三种可计算的几何量,解释了扩散模型的双阶段行为,同时推导出三个最优设计准则。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13007 2026-03-16 eess.IV cs.CV cs.LG physics.med-ph 79%

Accelerating Stroke MRI with Diffusion Probabilistic Models through Large-Scale Pre-training and Target-Specific Fine-Tuning

通过大规模预训练和目标特定微调加速中风MRI

Yamin Arefeen, Sidharth Kumar, Steven Warach, Hamidreza Saber, Jonathan Tamir

机构 * Chandra Family Department of Electrical and Computer Engineering(查克拉家族电气与计算机工程系) Department of Imaging Physics(成像物理系) Dell Medical School Department of Neurology(德莱尔医学院神经学系) Dell Medical School Department of Neurosurgery(德莱尔医学院神经外科系) Dell Medical School Department of Diagnostic Medicine(德莱尔医学院诊断医学系) Oden Institute for Computational Engineering and Sciences(奥登计算工程与科学研究院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出一种高效策略,利用扩散概率生成模型在有限数据下加速MRI重建,通过大规模预训练和目标特定微调实现临床中风MRI的快速扫描。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19577 2026-03-16 cs.CV 79%

MaDiS: Taming Masked Diffusion Language Models for Sign Language Generation

MaDiS:驯服掩码扩散语言模型用于手语生成

Ronglai Zuo, Rolandos Alexandros Potamias, Qi Sun, Evangelos Ververas, Jiankang Deng, Stefanos Zafeiriou

机构 * Imperial College London(伦敦帝国学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出MaDiS,一种基于掩码扩散的语言模型,用于手语生成,通过双向依赖捕捉和高效并行多令牌生成,提升生成效率和质量,同时引入三级交叉模态预训练方案和混合部分嵌入层,实现多层级手语表示。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12581 2026-03-16 eess.IV cs.AI cs.CV 79%

Multiscale Structure-Guided Latent Diffusion for Multimodal MRI Translation

多尺度结构引导的潜在扩散模型用于多模态MRI翻译

Jianqiang Lin, Zhiqiang Shen, Peng Cao, Jinzhu Yang, Osmar R. Zaiane, Xiaoli Liu

机构 * Computer Science and Engineering, Northeastern University, Shenyang, China(东北大学计算机科学与工程系,沈阳,中国) Key Laboratory of Intelligent Computing in Medical Image of Ministry of Education, Northeastern University, Shenyang, China(教育部医学图像智能计算重点实验室,东北大学,沈阳,中国) National Frontiers Science Center for Industrial Intelligence and Systems Optimization, Shenyang, China(工业智能与系统优化国家级前沿科学中心,沈阳,中国) Amii, University of Alberta, Edmonton, Alberta, Canada(阿尔伯塔大学阿米人工智能研究所,埃德蒙顿,阿尔伯塔,加拿大) AiShiWeiLai AI Research, Beijing, China(人工智能研究(北京)有限公司,北京,中国)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出MSG-LDM框架,通过多尺度特征空间分离风格与结构信息,提升多模态MRI翻译的结构一致性与纹理细节。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08820 2026-03-16 cs.CV 79%

Omni-Video 2: Scaling MLLM-Conditioned Diffusion for Unified Video Generation and Editing

Omni-Video 2:基于MLLM条件扩散模型的统一视频生成与编辑扩展

Hao Yang, Zhiyu Tan, Jia Gong, Luozheng Qin, Hesen Chen, Xiaomeng Yang, Yuqing Sun, Yuetan Lin, Mengping Yang, Hao Li

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出Omni-Video 2,通过连接预训练多模态大语言模型与视频扩散模型,实现视频生成与编辑的统一。核心方法是利用MLLM生成明确的目标描述以指导生成过程,并通过轻量适配器高效注入多模态条件token,提升复杂编辑任务性能。

Comments Technical Report, Project: https://howellyoung-s.github.io/Omni-Video2-project/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07540 2026-03-16 cs.CV 79%

Enhancing Novel View Synthesis via Geometry Grounded Set Diffusion

通过几何引导的集扩散增强新视角合成

Farhad G. Zanjani, Hong Cai, Amirhossein Habibian

机构 * Qualcomm AI Research(高通人工智能研究)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出SetDiff框架,结合3D先验、坐标映射和姿态感知的Plucker射线嵌入,提升多视角扩散模型在处理可变参考和目标视角时的鲁棒性和视觉保真度。

Comments Paper and supplementary materials

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02267 2026-03-16 cs.CV 79%

DiffProxy: Multi-View Human Mesh Recovery via Diffusion-Generated Dense Proxies

DiffProxy:通过扩散生成的密集代理进行多视图人体网格恢复

Renke Wang, Zhenyu Zhang, Ying Tai, Jun Li, Jian Yang

机构 * PCA Lab(PCA实验室) Nanjing University of Science and Technology(南京理工大学) School of Intelligent Science and Technology(智能科学与技术学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 DiffProxy利用预训练扩散模型生成密集像素到表面对应关系,通过多条件代理生成器和手部细化技术,实现高精度人体网格恢复,无需真实数据训练。

Comments Page: https://wrk226.github.io/DiffProxy.html, Code: https://github.com/wrk226/DiffProxy

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14327 2026-03-16 cs.CV 79%

MoVieDrive: Urban Scene Synthesis with Multi-Modal Multi-View Video Diffusion Transformer

MoVieDrive:基于多模态多视角视频扩散变换器的城市场景合成

Guile Wu, David Huang, Dongfeng Bai, Bingbing Liu

机构 * Huawei Noah’s Ark Lab(华为诺亚实验室) University of Toronto(多伦多大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出MoVieDrive,通过多模态多视角视频扩散变换器生成城市驾驶场景视频,实现多模态数据生成与可控生成。

Comments CVPR 2026 Findings Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05914 2026-03-16 cs.LG 79%

Accelerating Diffusion Model Training under Minimal Budgets: A Condensation-Based Perspective

在有限预算下加速扩散模型训练:基于凝聚的视角

Rui Huang, Shitong Shao, Zikai Zhou, Pukun Zhao, Hangyu Guo, Tian Ye, Lichen Bai, Shuo Yang, Zeke Xie

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出D2C框架,通过选择和附加两阶段方法,从大规模数据集中凝聚出小数据集,从而在有限资源下加速扩散模型训练并保持生成质量。

Comments CVPR 2026 camera-ready version. Introduces D2C, a framework for efficient diffusion model training

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13155 2026-03-16 math.OC 78%

Reinforcement Learning for Discounted and Ergodic Control of Diffusion Processes

强化学习用于扩散过程的折扣和ergodic控制

Erhan Bayraktar, Ali D. Kara, Somnath Pradhan, Serdar Yuksel

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出量化Q学习算法,用于连续时间扩散过程的折扣与ergodic控制,证明其在近优策略下几乎必然收敛,并在温和条件下保证近优性速率。

Comments 29 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04096 2026-03-16 cs.LG 78%

CORE: Context-Robust Remasking for Diffusion Language Models

CORE: 用于扩散语言模型的上下文鲁棒重掩码

Kevin Zhai, Sabbir Mollah, Zhenyi Wang, Mubarak Shah

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 CORE通过上下文鲁棒重掩码方法改进扩散模型解码,通过检测上下文敏感性token提升生成稳定性,在推理阶段实现高效修正,优于现有基线方法。

Comments Project Page: https://ucf-crcv.github.io/core/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20315 2026-03-16 physics.optics cond-mat.soft 78%

From Light Diffusion to Photocatalytic Rates: Compact Scaling Laws for Strongly Scattering Porous Slabs

从光扩散到光催化速率:强散射多孔板的紧凑标度律

Renaud A. L. Vallée, Rénal Backov

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出了一种紧凑的分析框架,统一了纳米粒子负载光催化板中的多重散射、边界损失、光化学效率和表面动力学过程,通过有限板扩散模型推导出辐照场的闭式表达式,并结合光化学量子效率和一级表面动力学,得到体积和面积速率常数的依赖关系。

Comments 25 pages, 4 figures

Journal ref Journal of Quantitative Spectroscopy & Radiative Transfer 352 (2026) 109819

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12868 2026-03-16 cs.RO 78%

Beyond Imitation: Reinforcement Learning Fine-Tuning for Adaptive Diffusion Navigation Policies

超越模仿:用于自适应扩散导航策略的强化学习微调

Junhe Sheng, Ruofei Bai, Kuan Xu, Ruimeng Liu, Jie Chen, Shenghai Yuan, Wei-Yun Yau, Lihua Xie

机构 * Nanyang Technological University, Singapore(南洋理工大学,新加坡) A*STAR, Singapore(A*STAR,新加坡) National University of Singapore, Singapore(新加坡国立大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出一种针对扩散导航的强化学习微调框架,通过Group Relative Policy Optimization提升策略适应性,在Isaac Sim中提升成功率和SPL,减少碰撞,展示出更强的零样本迁移能力和安全泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12834 2026-03-16 physics.flu-dyn 78%

Physics-Constrained Diffusion Model for Synthesis of 3D Turbulent Data

具有物理约束的扩散模型用于三维湍流数据合成

Tianyi Li, Michele Buzzicotti, Fabio Bonaccorso, Luca Biferale

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出一种融合物理约束的扩散模型,用于生成三维湍流速度场,解决了高维、多尺度和强间断性的问题,展示了其在中等分辨率下的稳定性和统计准确性。

Comments 14 pages, 9 figures. Submitted to a journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16447 2026-03-16 cs.LG 78%

Local Mechanisms of Compositional Generalization in Conditional Diffusion

条件扩散模型中组合泛化性的局部机制

Arwen Bradley

机构 * Apple(苹果公司)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文研究了条件扩散模型在长度泛化中的能力,发现局部条件分数与组合结构存在等价关系,并通过实验验证了局部条件分数对泛化能力的影响。

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.02739 2026-03-16 cs.LG q-bio.QM stat.ML 78%

Denoising Diffusion Variational Inference: Diffusion Models as Expressive Variational Posteriors

去噪扩散变分推断:将扩散模型作为表达性变分后验

Wasu Top Piriyakulkij, Yingheng Wang, Volodymyr Kuleshov

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出DDVI,一种基于扩散模型的黑盒变分推断算法,通过迭代优化潜在空间后验,提升深度潜在变量模型的推理与学习性能。

Comments published at AAAI 2025; the first two authors contribute equally to this work; code available at https://github.com/topwasu/DDVI

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11647 2026-03-16 cs.MM cs.CV cs.SD 62%

OmniForcing: Unleashing Real-time Joint Audio-Visual Generation

OmniForcing:释放实时联合音频视觉生成

Yaofeng Su, Yuming Li, Zeyue Xue, Jie Huang, Siming Fu, Haoran Li, Ying Li, Zezhong Qian, Haoyang Huang, Nan Duan

机构 * JD Explore Academy(京东探索学院) Fudan University(复旦大学) Peking University(北京大学) The University of Hong Kong(香港大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV、cs.MM

AI总结 本文提出OmniForcing框架,通过因果蒸馏将双向扩散模型转化为高保真流式自回归生成器,解决双流架构中的训练不稳定问题,实现25FPS的实时生成性能。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01000 2026-03-16 cs.CV 57%

Let Your Image Move with Your Motion! -- Implicit Multi-Object Multi-Motion Transfer

让您的图像随您的动作移动!-- 隐式多对象多动作转移

Yuze Li, Dong Gong, Xiao Cao, Junchao Yuan, Dongsheng Li, Lei Zhou, Yun Sing Koh, Cheng Yan, Xinyu Zhang

机构 * Tianjin University(天津大学) University of New South Wales(新南威尔士大学) University of Electronic Science and Technology of China(电子科技大学) Hainan University(海南大学) University of Auckland(奥克兰大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本文提出FlexiMMT框架,实现多对象多动作的隐式图像到视频转换,通过解耦注意力机制和改进的掩码传播机制,实现精确且高质量的多对象动作迁移。

Comments 15 pages, 11 figures, cvpr 2026, see https://ethan-li123.github.io/FlexiMMT_page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14027 2026-03-16 cs.CV 57%

Train Short, Inference Long: Training-free Horizon Extension for Autoregressive Video Generation

训练短,推理长:无训练 horizon 延伸用于自回归视频生成

Jia Li, Xiaomeng Fu, Xurui Peng, Weifeng Chen, Youwei Zheng, Tianyu Zhao, Jiexi Wang, Fangmin Chen, Xing Wang, Hayden Kwok-Hay So

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本文提出FLEX框架,通过频率感知RoPE调制和抗相位噪声采样,解决自回归视频扩散模型在延伸horizon时的 extrapolation失败问题,实现6倍延伸性能提升。

Comments 19 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12722 2026-03-16 cs.CV cs.AI 57%

CognitionCapturerPro: Towards High-Fidelity Visual Decoding from EEG/MEG via Multi-modal Information and Asymmetric Alignment

CognitionCapturerPro:通过多模态信息和非对称对齐实现从EEG/MEG的高保真视觉解码

Kaifan Zhang, Lihuo He, Junjie Ke, Yuqi Ji, Lukun Wu, Lizi Wang, Xinbo Gao

机构 * Visual Information Processing Laboratory, School of Electronic Engineering, Xidian University(电子科技大学信息处理实验室,电子工程学院) School of Artificial Intelligence, Beijing Normal University(北京师范大学人工智能学院)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本文提出CognitionCapturerPro框架,通过整合EEG与多模态先验信息,提升EEG视觉重建的保真度与检索准确率,改进Top-1和Top-5准确率达25.9%和10.6%。

详情

展开后加载摘要…

URL PDF HTML 收藏