arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-03-05 至 2026-03-05 共收录 51 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 51 篇

2603.03973 2026-03-05 cs.LG cs.CV 85%

Dual-Solver: A Generalized ODE Solver for Diffusion Models with Dual Prediction

Dual-Solver: 一种用于扩散模型的通用微分方程求解器,具有双预测功能

Soochul Park, Yeon Ju Lee

机构 * SteAI MODULABS Korea University(韩国大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

AI总结 Dual-Solver通过可学习参数泛化多步采样器,提高扩散模型在低NFE下的生成质量。

Comments Published as a conference paper at ICLR 2026. 36 pages, 18 figures

Journal ref Published as a conference paper at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08184 2026-03-05 cs.CV 85%

Scaling Laws For Diffusion Transformers

扩散变换器的扩展定律

Zhengyang Liang, Hao He, Ceyuan Yang, Bo Dai

机构 * University of Toronto(多伦多大学) Vector Institute(向量研究所) The Chinese University of Hong Kong(香港中文大学) The University of Hong Kong(香港大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

AI总结 本文研究了扩散变换器的扩展定律,通过实验验证了模型大小、数据需求与计算预算之间的幂律关系,并展示了预训练损失与生成性能的一致性,为模型性能和数据质量评估提供了可预测的基准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04064 2026-03-05 cs.LG cs.CV 83%

Tuning Just Enough: Lightweight Backdoor Attacks on Multi-Encoder Diffusion Models

适度调优:针对多编码扩散模型的轻量级后门攻击

Ziyuan Chen, Yujin Jeong, Tobias Braun, Anna Rohrbach

机构 * Computer Science Department, TU Darmstadt, Germany(图恩大学计算机科学系) Hessian Center for Artificial Intelligence (hessian.AI), Darmstadt, Germany(海德堡人工智能中心)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

AI总结 针对多编码扩散模型的轻量级后门攻击研究,通过仅调优少量参数实现有效攻击,揭示多编码器设置下的新漏洞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12880 2026-03-05 cs.CV 83%

Stochastic Self-Guidance for Training-Free Enhancement of Diffusion Models

扩散模型训练无关增强的随机自引导

Chubin Chen, Jiashu Zhu, Xiaokun Feng, Nisha Huang, Chen Zhu, Meiqi Wu, Fangyuan Mao, Jiahong Wu, Xiangxiang Chu, Xiu Li

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

AI总结 本文提出S$^2$-Guidance方法,通过随机块丢弃构建子网络,提升扩散模型在文本到图像和视频生成任务中的性能。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.17505 2026-03-05 cs.CV cs.AI cs.CL 83%

Catch Me If You Can Describe Me: Open-Vocabulary Camouflaged Instance Segmentation with Diffusion

捕捉我如果你能描述我:基于扩散的开放词汇伪装实例分割

Tuan-Anh Vu, Duc Thanh Nguyen, Qing Guo, Nhat Chung, Binh-Son Hua, Ivor W. Tsang, Sai-Kit Yeung

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) CFAR & IHPC, A*STAR(CFAR与IHPC,A*STAR) Deakin University(德克萨斯大学) Nankai University(南开大学) National University of Singapore(新加坡国立大学) Trinity College Dublin(都柏林大学)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

AI总结 本文提出基于扩散模型的开放词汇伪装实例分割方法,通过多尺度文本-视觉特征学习,提升伪装对象和新类别分割的性能。

Comments Accepted to IJCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04307 2026-03-05 cs.CV 79%

Dual Diffusion Models for Multi-modal Guided 3D Avatar Generation

多模态引导的3D人像生成双扩散模型

Hong Li, Yutang Feng, Minqi Meng, Yichen Yang, Xuhui Liu, Baochang Zhang

机构 * Beihang University(北航大学) KAUST(卡塔尔科技大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出PromptAvatar,通过双扩散模型实现多模态引导的3D人像生成,提升生成质量与效率。

Comments 18 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03792 2026-03-05 cs.CV cs.LG 79%

TAP: A Token-Adaptive Predictor Framework for Training-Free Diffusion Acceleration

TAP:一种用于无训练扩散加速的令牌自适应预测框架

Haowei Zhu, Tingxuan Huang, Xing Wang, Tianyu Zhao, Jiexi Wang, Weifeng Chen, Xurui Peng, Fangmin Chen, Junhai Yong, Bin Wang

机构 * Tsinghua University(清华大学) ByteDance(字节跳动)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 TAP通过为每个令牌自适应选择预测器,实现无训练的扩散模型加速,提升生成效率并减少感知质量损失。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03602 2026-03-05 cs.CV 79%

DM-CFO: A Diffusion Model for Compositional 3D Tooth Generation with Collision-Free Optimization

DM-CFO: 一种用于无碰撞优化的组合3D牙齿生成扩散模型

Yan Tian, Pengcheng Xue, Weiping Ding, Mahmoud Hassaballah, Karen Egiazarian, Aura Conci, Abdulkadir Sengur, Leszek Rutkowski

机构 * School of Computer Science and Technology, Zhejiang Gongshang University(浙江工商大学计算机科学与技术学院) AGH University of Krakow(克拉科夫AGH大学) Polish Ministry of Science and Higher Education(波兰教育部) Tongxiang Institute of General Artificial Intelligence(同祥通用人工智能研究院) State Key Laboratory of Advanced Medical Materials and Devices(先进医学材料与器件国家重点实验室) School of Artificial Intelligence and Computer Science, Nantong University(南通大学人工智能与计算机科学学院) Department of Computer Science, College of Computer Engineering and Sciences, Prince Sattam Bin Abdulaziz University(普莱斯·本·阿卜杜勒阿齐兹大学计算机科学系) Department of Computer Science, Qena University(基纳大学计算机科学系) Department of Computing Sciences, Tampere University(塔尔库大学计算科学系) Department of Computer Science, Universidade Federal Fluminense(里约热内卢联邦大学计算机科学系) Shining3D Tech Co., Ltd.(Shining3D科技有限公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 DM-CFO通过扩散模型和无碰撞优化生成组合3D牙齿,提升生成牙齿的多视图一致性和真实性。

Comments Received by IEEE Transactions on Visualization and Computer Graphics

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21574 2026-03-05 cs.CV cs.LG 79%

Do We Need All the Synthetic Data? Targeted Image Augmentation via Diffusion Models

我们是否需要所有合成数据?通过扩散模型的目标图像增强

Dang Nguyen, Jiping Li, Jinghao Zheng, Baharan Mirzasoleiman

机构 * University of California Los Angeles (UCLA)(加州大学洛杉矶分校) Ecole Polytechnique Federale de Lausanne (EPFL)(瑞士联邦理工学院洛桑分校)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 TADA通过选择性增强训练初期未被学习的示例,利用扩散模型提高图像分类的泛化能力,实验表明仅增强30-40%的数据即可提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19289 2026-03-05 cs.CV 79%

FINE: Factorizing Knowledge for Initialization of Variable-sized Diffusion Models

FINE: 用于变量大小扩散模型初始化的知识因子化

Yucheng Xie, Fu Feng, Ruixiao Shi, Jianlu Shen, Jing Wang, Yong Rui, Xin Geng

机构 * School of Computer Science and Engineering, Southeast University, Nanjing, China(计算机科学与工程学院,东南大学,南京,中国) Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications (Southeast University), Ministry of Education, China(新一代人工智能技术及其交叉应用关键实验室(东南大学),教育部,中国)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 FINE通过分解知识为learngenes,实现变量大小扩散模型的高效初始化,无需重复预训练,提升资源受限部署下的性能与适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07093 2026-03-05 cs.CV cs.AI 79%

3D Wavelet-Based Structural Priors for Controlled Diffusion in Whole-Body Low-Dose PET Denoising

基于3D小波的结构先验用于控制扩散的全身体低剂量PET去噪

Peiyuan Jing, Yue Yang, Chun-Wun Cheng, Zhenxuan Zhang, Liutao Yang, Thiago V. Lima, Klaus Strobel, Antoine Leimgruber, Angelica Aviles-Rivero, Guang Yang, Javier A. Montoya-Zegarra

机构 * School of Engineering, Zurich University of Applied Sciences, CH Bioengineering Department Imperial-X, Imperial College London, UK DAMTP, University of Cambridge, UK Lucerne University Teaching Research Hospital, CH Lung Institute, Imperial College London, UK Cardiovascular Research Centre, Royal Brompton Hospital, UK School of Biomedical Engineering \& Imaging Sciences, King's College London, UK Yau Mathematical Sciences Center, Tsinghua University, CN

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 WCC-Net通过引入3D小波结构先验,提升低剂量PET去噪效果,实现更稳定的解剖结构与噪声分离。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04122 2026-03-05 cs.SD cs.LG 78%

FastWave: Optimized Diffusion Model for Audio Super-Resolution

FastWave: 优化的扩散模型用于音频超分辨率

Nikita Kuznetsov, Maksim Kaledin

机构 * HSE University(俄罗斯高等经济大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 FastWave通过优化扩散模型训练,实现高效的音频超分辨率,具有更低的计算成本和更快的训练速度,优于NU-Wave 2并可与最新模型竞争。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03847 2026-03-05 math.NA cs.NA 78%

Optimal convergence of local discontinuous Galerkin methods for convection-diffusion equations

局部间断伽辽金方法在对流扩散方程中的最优收敛性

Wenjie Liu, Ruiyi Xie, Li-Lian Wang, Zhimin Zhang

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文通过建立新的逼近结果,研究了局部间断伽辽金方法在对流扩散方程中的最优收敛性,解决了理论估计与数值实验之间的差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.04878 2026-03-05 cs.CR 78%

Plug-and-Hide: Provable and Adjustable Diffusion Generative Steganography

插件隐藏:可证明且可调节的扩散生成隐写术

Jiahao Zhu, Zixuan Chen, Jiali Liu, Weiqi Luo, Yi Zhou, Xiaohua Xie

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 提出PA-B2G方法,实现可证明且可调节的扩散生成隐写术,兼顾图像质量、安全性和提取可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03363 2026-03-05 physics.geo-ph cond-mat.mtrl-sci 78%

Superhydrophobic Sand Mulch Shifts Soil Evaporation from Temperature-Controlled to Diffusion-Limited Regimes

超疏水砂 mulch 改变土壤蒸发从温度控制到扩散限制的 regime

Amr Al-Zu'bi, Muhammad Subkhi Sadullah, Jiaqi Zheng, Lisa Exposito, Adair Gallo, Himanshu Mishra

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 超疏水砂mulch通过改变土壤蒸发机制,减少蒸发损失,提升干旱地区灌溉效率。

Comments 13 pages, 7 figures, and 1 ESI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01343 2026-03-05 cs.LG 78%

CNFP: Optimizing Cloud-Native Network Function Placement with Diffusion Models on the Cloud Continuum

CNFP: 基于云连续体的云原生网络功能放置优化:利用扩散模型

Álvaro Vázquez Rodríguez, Manuel Fernández-Veiga, Carlos Giraldo-Rodríguez

机构 * atlanTTic - I&C Lab - Universidade de Vigo(atlanTTic - I&C实验室 - 维戈大学) Centro Tecnolóxico de Telecomunicacións de Galicia (GRADIANT)(加利西亚电信技术中心(GRADIANT))

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出基于扩散模型的云原生网络功能放置方法,通过图神经网络生成可行解,提升云连续体编排的效率和可扩展性。

Comments 14 pages, 11 figures, 4 tables, Submitted to Computer Networks

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02601 2026-03-05 cs.LG 78%

Diffusion & Adversarial Schrödinger Bridges via Iterative Proportional Markovian Fitting

扩散与对抗性施罗德桥 via 迭代比例马尔可夫拟合

Sergei Kholkin, Grigoriy Ksenofontov, David Li, Nikita Kornilov, Nikita Gushchin, Alexandra Suvorikova, Alexey Kroshnin, Evgeny Burnaev, Alexander Korotin

机构 * Applied AI Institute(应用人工智能研究所) AXXX Moscow Independent Research Institute of Artificial Intelligence(莫斯科独立人工智能研究所) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Weierstrass Institute for Applied Analysis and Stochastics(魏尔斯特拉斯应用分析与随机学研究所) Mathematical Foundations of Machine Learning Institute(机器学习数学基础研究所) Basic Research of Artificial Intelligence Laboratory(人工智能基础研究实验室)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出IPMF方法,结合IMF和IPF解决施罗德桥问题,实现图像生成与翻译任务中的平衡优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08714 2026-03-05 cs.CV cs.CL cs.LG 77%

Generating Fine Details of Entity Interactions

生成实体交互的细节

Xinyi Gu, Jiayuan Mao

机构 * Massachusetts Institute of Technology(麻省理工学院)

专题命中 扩散模型 :image generation(abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 本文提出了一种基于多模态大语言模型的方法,通过分解和细化过程提升图像中实体交互细节的生成质量。

Comments EMNLP 2025. Project Page: https://detailscribe.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03469 2026-03-05 cs.LG cond-mat.dis-nn cond-mat.stat-mech 71%

Biased Generalization in Diffusion Models

扩散模型中的偏见泛化

Jerome Garnier-Brun, Luca Biggio, Davide Beltrame, Marc Mézard, Luca Saglietti

机构 * Department of Computing Sciences, Bocconi University, Milan, Italy(计算科学系,博科尼大学,米兰,意大利)

专题命中 扩散模型 :diffusion(title)

AI总结 本文研究了扩散模型中偏见泛化的现象,揭示了模型在训练过程中持续降低测试损失的同时,倾向于生成与训练数据异常接近的样本,指出早期停止策略在隐私敏感应用中的局限性。

Comments 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04340 2026-03-05 cs.CV cs.LG 70%

Balancing Fidelity, Utility, and Privacy in Synthetic Cardiac MRI Generation: A Comparative Study

在合成心脏磁共振成像生成中平衡保真度、实用性与隐私:一项比较研究

Madhura Edirisooriya, Dasuni Kawya, Ishan Kumarasinghe, Isuri Devindi, Mary M. Maleckar, Roshan Ragel, Isuru Nawinne, Vajira Thambawita

机构 * University of Peradeniya, Sri Lanka(斯里兰卡大学) University of Maryland, College Park, USA(美国马里兰大学 College Park 分校) Tulane University School of Medicine, USA(美国 Tulane 大学医学院) Simula Research Laboratory, Norway(挪威 Simula 研究实验室) SimulaMet, Norway(挪威 SimulaMet)

专题命中 扩散模型 :diffusion(abstract);image synthesis(abstract);分类 cs.CV

AI总结 本研究比较了三种生成模型在合成心脏MRI中的性能,发现DDPM在保真度、实用性和隐私保护之间达到最佳平衡,而FM在隐私方面表现突出但性能略低。

Comments 7 pages, 4 figures, Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04343 2026-03-05 cs.CV cs.LG 57%

Enhancing Authorship Attribution with Synthetic Paintings

通过合成绘画增强作者归属

Clarissa Loures, Caio Hosken, Luan Oliveira, Gianlucca Zuin, Adriano Veloso

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本研究通过结合真实和合成数据提升绘画作者归属的准确率和泛化能力。

Comments Accepted for publication at the 24th IEEE International Conference on Machine Learning and Applications (ICMLA 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04338 2026-03-05 cs.CV 57%

ArtHOI: Articulated Human-Object Interaction Synthesis by 4D Reconstruction from Video Priors

ArtHOI: 通过视频先验进行4D重建的可变形人-物交互合成

Zihao Huang, Tianqi Liu, Zhaoxi Chen, Shaocong Xu, Saining Zhang, Lixing Xiao, Zhiguo Cao, Wei Li, Hao Zhao, Ziwei Liu

机构 * School of AIA, Huazhong University of Science and Technology(华中科技大学人工智能学院) the S-Lab, Nanyang Technological University (NTU)(南洋理工大学S实验室) the Beijing Academy of Artificial Intelligence (BAAI)(北京人工智能研究院) Zhejiang University (ZJU)(浙江大学) the Institute for AI Industry Research (AIR), Tsinghua University (THU)(清华大学人工智能产业研究院)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 ArtHOI通过4D重建从视频先验生成可变形人-物交互,提升接触精度和物理合理性。

Comments Project Page: https://arthoi.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04291 2026-03-05 cs.CV cs.AI 57%

CubeComposer: Spatio-Temporal Autoregressive 4K 360° Video Generation from Perspective Video

CubeComposer: 从视角视频生成空间-时间自回归4K 360°视频

Lingen Li, Guangzhi Wang, Xiaoyu Li, Zhaoyang Zhang, Qi Dou, Jinwei Gu, Tianfan Xue, Ying Shan

机构 * The Chinese University of Hong Kong(香港中文大学) ARC Lab, Tencent PCG Project lead(腾讯PCG项目负责人)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 CubeComposer通过空间-时间自回归扩散模型实现4K分辨率360°视频生成,提升VR沉浸体验

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04265 2026-03-05 cs.CV 57%

ViterbiPlanNet: Injecting Procedural Knowledge via Differentiable Viterbi for Planning in Instructional Videos

ViterbiPlanNet: 通过可微Viterbi注入过程性知识以在教学视频中进行规划

Luigi Seminara, Davide Moltisanti, Antonino Furnari

机构 * University of Catania(卡塔尼亚大学) University of Bath(巴斯大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 ViterbiPlanNet通过可微Viterbi层整合过程性知识,实现高效的教学视频规划,提升样本效率和鲁棒性。

Comments Accepted at CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04130 2026-03-05 cs.CV 57%

Mask-Guided Attention Regulation for Anatomically Consistent Counterfactual CXR Synthesis

基于解剖一致性的反事实胸部X光合成中的掩码引导注意力调节

Zichun Zhang, Weizhi Nie, Honglin Guo, Yuting Su

机构 * Tianjin University(天津大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本文提出一种基于掩码引导的注意力调节框架,用于实现解剖一致的反事实CXR合成,通过解剖感知正则化和病理引导模块提升生成质量与可控性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03941 2026-03-05 cs.CV 57%

Slice-wise quality assessment of high b-value breast DWI via deep learning-based artifact detection

基于深度学习的高b值乳腺扩散加权成像切片质量评估

Ameya Markale, Luise Brock, Ihor Horishnyi, Dominika Skwierawska, Tri-Thien Nguyen, Hannes Schreiter, Shirin Heidarikahkesh, Lorenz A. Kapsner, Michael Uder, Sabine Ohlmeyer, Frederik B Laun, Andrzej Liebert, Sebastian Bickelhaupt

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本研究利用深度学习,特别是DenseNet121,对高b值乳腺扩散加权成像中的高信号和低信号伪影进行检测,以提高诊断准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16957 2026-03-05 cs.CV 57%

MatPedia: A Universal Generative Foundation for High-Fidelity Material Synthesis

MatPedia: 一种通用生成基础,用于高保真材料合成

Di Luo, Shuhui Yang, Mingxin Yang, Jiawei Lu, Yixuan Tang, Xintong Han, Zhuo Chen, Beibei Wang, Chunchao Guo

机构 * Nankai University(南开大学) Tencent Hunyuan(腾讯文言) Xi’an Jiaotong University(西安交通大学) Nanjing University(南京大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 MatPedia是一种基于联合RGB-PBR表示的生成模型,能够统一处理多种材料生成任务,实现高质量的高保真材料合成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17896 2026-03-05 cs.CV cs.AI 57%

EgoWorld: Translating Exocentric View to Egocentric View using Rich Exocentric Observations

EgoWorld:利用丰富的外参照观测将外参照视角转换为自身参照视角

Junho Park, Andrew Sangwoo Ye, Taein Kwon

机构 * AI Lab, LG Electronics(LG电子人工智能实验室) KAIST(韩国科学技术院) Visual Geometry Group, University of Oxford(牛津大学视觉几何组)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 EgoWorld通过重建丰富的外参照观测来实现外参照到自身参照视角的转换,展示了在增强现实、虚拟现实和机器人应用中的先进性能和鲁棒性。

Comments Accepted by ICLR 2026. Project Page: https://redorangeyellowy.github.io/EgoWorld/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13231 2026-03-05 cs.CV cs.AI cs.RO 57%

VITA: Vision-to-Action Flow Matching Policy

VITA:视觉到动作流匹配策略

Dechen Gao, Boqi Zhao, Andrew Lee, Ian Chuang, Hanchu Zhou, Hang Wang, Zhe Zhao, Junshan Zhang, Iman Soltani

机构 * University of California, Davis(加州大学戴维斯分校) University of California, Berkeley(加州大学伯克利分校)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 VITA是一种无噪声、无条件的视觉到动作流匹配策略,通过动作自动编码器和流潜在解码技术,在9个模拟和5个现实任务中实现更快的推理速度和更优的性能。

Comments Project page: https://ucd-dare.github.io/VITA/ Code: https://github.com/ucd-dare/VITA

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04297 2026-03-05 cond-mat.mes-hall 50%

Hanle lineshapes and spin-rotation signatures from in-plane anisotropic spin relaxation in heterogeneous spin devices

Hanle线形和自旋-旋转特征来自平面各向异性自旋弛豫在异质自旋器件中的表现

Josef Světlík, Juan F. Sierra, Lorenzo Camosi, Williams Savero Torres, Franz Herling, Vera Marinova, Dimitre Dimitrov, Sergio O. Valenzuela

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文通过研究异质自旋器件中平面各向异性自旋弛豫,提出理论框架解释横向石墨烯自旋器件的自旋输运测量。

Journal ref Phys. Rev. B 113, 094404 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏