arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-08-11 至 2026-08-11 共收录 166 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 122 篇

2601.19040 2026-08-11 cs.LG 版本更新 50%

OATS: Online Data Augmentation for Time Series Foundation Models

OATS: 用于时间序列基础模型的在线数据增强

Junwei Deng, Chang Xu, Jiaqi W. Ma, Ming Jin, Chenghao Liu, Xu Zhang, Li Zhao, Jiang Bian

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Microsoft Research(微软研究院) Griffith University(格里菲斯大学) Datadog AI Research(Datadog AI研究院)

专题命中 扩散模型 :diffusion(abstract)

AI总结 OATS通过动态生成合成数据提升时间序列基础模型的性能,采用探索-利用机制和扩散框架,在多个数据集上优于传统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10134 2026-08-11 physics.comp-ph cs.NA math.NA 50%

A volume penalization method for solving conjugate scalar transport with interfacial jump conditions

一种用于求解具有界面跃变条件的共轭标量传输的体积惩罚方法

Ming Liu, Yosuke Hasegawa

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种新的体积惩罚方法,用于求解具有界面跃变条件的共轭标量传输问题,通过提高精度和统一控制方程来改进模拟结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07195 2026-08-11 cs.CL cs.AI cs.CY cs.MA cs.SI 版本更新 50%

Multilingual Agent-Based World Modeling for Social Science

MASim:面向社会科学的多语言代理模拟

Xuan Zhang, Wenxuan Zhang, Anxu Wang, See-Kiong Ng, Yang Deng

专题命中 扩散模型 :diffusion(abstract)

AI总结 MASim是一种多语言代理模拟框架,用于研究社会行为,通过多语言代理模拟公众意见和媒体影响,展现多语言模拟在社会科学中的重要性。

Comments Accepted at COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03031 2026-08-11 math.OC q-fin.RM 50%

Robust optimal consumption, investment and reinsurance for recursive preferences

Elizabeth Dadzie, Wilfried Kuissi-Kamdem, Marcel Ndengo

专题命中 扩散模型 :diffusion(abstract)

Comments 18 pages, 10 figures

Journal ref Journal of Stochastic Analysis, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21915 2026-08-11 hep-ph astro-ph.CO hep-th 版本更新 50%

Electroweak Baryogenesis with BARYONET: a self-contained review of the WKB approach

利用BARYONET实现电弱重子产生:WKB方法的自包含综述

Giulio Barni

专题命中 扩散模型 :diffusion(abstract)

AI总结 该研究通过开源代码BARYONET,基于WKB方法完成电弱重子产生的自包含教学计算,验证框架并提供基准,明确EWBG要素以确保可复现性,为重子不对称性研究提供自动化流程。

Comments v3: 52 pages + appendices; match published version; new material added

Journal ref SciPost Phys. 21, 032 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19990 2026-08-11 cs.LG 版本更新 50%

Rethinking Reasoning with MDLMs: Early Exits, Post-hoc Reasoning, and Beyond

重新思考MDLM的推理:早期退出、事后推理及其他

Zachary Horvitz, Raghav Singhal, Hao Zou, Carles Domingo-Enrich, Zhou Yu, Rajesh Ranganath, Kathleen McKeown

机构 * Columbia University(哥伦比亚大学) Department of Computer Science, New York University(纽约大学计算机科学系) Microsoft Research(微软研究院) Center for Data Science, New York University(纽约大学数据科学中心)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出“推理即填充”技术,基于掩码扩散语言模型(MDLMs)实现早期退出、事后推理等能力,在GSM8k数据集上微调LLaDA-8B-Base提升准确率14.9%,证明MDLM训练目标对推理有显著优势。

Comments COLM 2026 Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.10723 2026-08-11 physics.bio-ph nlin.AO q-bio.NC 版本更新 50%

Stochastic Models of Neuronal Growth

神经元生长的随机模型

Cristian Staii

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文综述轴突生长的随机模型,结合朗之万动力学与福克-普朗克方程,耦合肌动蛋白-肌球蛋白-离合器模型,分析轴突动态的稳定性,为神经修复相关工程设计提供依据。

Comments 13 pages, 4 figures

Journal ref Staii C. Stochastic Models of Neuronal Growth. AppliedMath. 2025;5:170

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24289 2026-08-11 physics.chem-ph 版本更新 50%

Observation of Iron Oxide to Nitride Conversion via Liquid Liquid Phase Separation in High pressure Borate Melt

高压硼酸盐熔体中液-液相分离实现氧化铁向氮化物转化的观测

Yu Tao, Depu Liu, Chunyin Zhou, Xu Jia, Jingyi Liu, Xue Chang, Yangbin Wang, Yipeng Wang, Duanwei He, Li Lei

专题命中 扩散模型 :diffusion(abstract)

AI总结 本研究利用同步辐射X射线成像,在5.4 GPa、1700 K下观测到Fe₂O₃与BN经液-液相分离转化为Fe-N合金的过程,揭示了高压下金属氧化物转氮化物的新机制。

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01640 2026-08-11 quant-ph physics.comp-ph 50%

Hamiltonian simulation for nonlinear partial differential equation by Schrödingerization

Shoya Sasaki, Katsuhiro Endo, Mayu Muramatsu

专题命中 扩散模型 :diffusion(abstract)

Comments 12 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06727 2026-08-11 physics.app-ph cs.SY eess.SY 交叉投稿 50%

Fast Forward and Inverse Thermal Modeling for Parameter Estimation of Multi-Layer composites -- Part I: Forward Modeling

多层复合材料参数估计的正向与反向热建模——第一部分:正向建模

Gan Fu, Calina Ciuhu, Mitrofan Curti, Elena A. Lomonova

专题命中 扩散模型 :diffusion(abstract)

AI总结 本研究提出多层复合材料瞬态热建模的快速解析方法,结合分离变量法、正交展开技术及格林函数法,计算速度快于有限元法,为后续反向建模估计材料属性与几何变形奠定基础。

Comments 17 pages, 12 figures, the first part of a two-part study

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22456 2026-08-11 econ.GN q-fin.EC 版本更新 50%

Beyond Leaders and Laggards: A Typology of Renewable Energy Adoption Trajectories with Evidence from Off-Grid Communities

超越领先者与落后者:可再生能源采用轨迹的类型学——来自离网社区的证据

Roni Blushtein-Livnon, Tal Svoray, Itay Ficshhendler, Havatzelet Yahel, Emir Galilee, Michael Dorman

专题命中 扩散模型 :diffusion(abstract)

AI总结 本研究提出基于时间序列的分析框架及Adoption over Time Index,定义可再生能源采用轨迹的八类类型学,应用于以色列南部离网贝都因人案例,揭示衰退路径占比高、跳跃路径稀缺等特征,为制定针对性加速策略提供依据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.01302 2026-08-11 cs.LG math.OC math.PR 版本更新 50%

Regret of exploratory policy improvement and $q$-learning

探索策略改进与q学习的遗憾

Wenpin Tang, Xun Yu Zhou

专题命中 扩散模型 :diffusion(abstract)

AI总结 该研究针对受控扩散过程的q学习及相关算法,在特定假设下建立探索策略改进的指数收敛性,并推导q学习的定量误差与遗憾界。

Comments 28 pages, 1 figure. Several examples and remarks are added

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 可控生成 12 篇

2608.09357 2026-08-11 cs.CV 新提交 74%

ControlRadio: Prompt-Driven Controllable Diffusion for Cross-Modal Radio Map Generation

ControlRadio:用于跨模态无线电地图生成的提示驱动可控扩散模型

Kangjun Liu, Xiying Pan, Shuhang Zhang, Xiang Xiang, Ke Chen, Yaowei Wang

机构 * Pengcheng Laboratory(鹏城实验室) South China University of Technology(华南理工大学) Peking University(北京大学) Huazhong University of Science and Technology(华中科技大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))

专题命中 可控生成 :diffusion(title);分类 cs.CV

AI总结 ControlRadio是一种可控生成框架,可根据自然语言描述和环境布局生成无线电地图,在不同城市场景中精度和泛化能力领先,计算时间较传统方法减少四个数量级以上,为无线环境建模提供新范式。

Comments 17 pages, 9 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08553 2026-08-11 cs.CV cs.LG cs.MM 新提交 62%

MotionCraft: Latent World Modeling with Sparse Attention for Visual Upscaling

MotionCraft:用于视频超分辨率的基于稀疏注意力的潜在世界建模

Rong Fu, Chunlei Meng, Yangchen Zeng, Xiaowen Ma, Yongtai Liu, Wangyu Wu, Shuo Yin, Zijian Zhang, Sicheng Li, Yingrui Ji, Chenhao Wang, Simon Fong

专题命中 可控生成 :diffusion(abstract);分类 cs.CV、cs.MM

AI总结 MotionCraft是一种可控视频超分辨率框架,通过结合鲁棒运动融合、潜在世界Transformer与自适应稀疏注意力,实现了时间一致的高质量视频重建,且能灵活权衡时间平滑性与重建保真度。

Comments 14 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07948 2026-08-11 cs.CV 新提交 57%

SynVAR: Synergizing Spatial and Semantic Alignment in Visual Autoregressive Model

SynVAR:在视觉自回归模型中协同空间与语义对齐

Zhennan Chen, Tianxing Shi, Pengcheng Xu, Kepan Nan, Qian Wang, Zili Yi, Jian Yang, Ying Tai

机构 * State Key Laboratory for Novel Software Technology, Nanjing University(南京大学计算机软件新技术国家重点实验室) Western University(西安大略大学) JIUTIAN Research, CMCC, China(中国移动通信集团九天研究)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 本文提出首个专为视觉自回归模型(VAR)定制的无训练增强框架SynVAR,通过空间-语义协同控制策略及三个关键组件抑制误差,显著提升了VAR的复杂场景建模能力。

Comments Accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07541 2026-08-11 cs.CV cs.AI cs.MA 新提交 57%

NeuroPilot: An Agent-Driven Smart Pipeline for Processing, Quality Control, and Managing Neuroimages

NeuroPilot:一种用于神经影像处理、质量控制与管理的智能体驱动智能流程

Yiyao Chen, Yucheng Li, Jungong Tong, Shaoqi Wang, Kunhao Zhou, Ziquan Wei, Monica Murea, Marissa DiPiero, Tingting Dan, Guorong Wu

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 该研究提出NeuroPilot多智能体系统,整合神经影像处理、质控与管理流程,在17个超12.3万受试者的队列中验证,将传统2-3个月的工作压缩至一周,提升了可扩展性与效率。

Comments 21 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.04635 2026-08-11 cs.CV 版本更新 57%

UniPCB: A Generation-Assisted Vision-Based Measurement Framework for PCB Defect Inspection

UniPCB: 一种用于PCB缺陷检测的生成辅助检测框架

Huan Zhang, Lianghong Tan, Yichu Xu, Zishan Su, Jiangzhong Cao, Huanqi Wu, Linwei Zhu, Xu Zhang

机构 * School of Information Engineering, Guangdong University of Technology(广东工业大学信息工程学院) School of Computer Science, Wuhan University(武汉大学计算机学院) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 提出UniPCB框架,通过多模态条件生成器合成缺陷样本以增强数据,并设计倒残差移位注意力与跨级互补融合模块提升检测性能,在DsPCBSD+上实现98.0% mAP@0.5。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09571 2026-08-11 cs.SD 新提交 50%

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation

SonicWeave:用于统一音频场景生成的分块路由混合专家模型

Yunrui Cai, Xu Li, Yucheng Zhou, Jinchao Li, Dingdong Wang, Dongchao Yang, Xixin Wu, Chen Zhang, Zhiyong Wu, Pengfei Wan, Helen Meng

机构 * Kuaishou Technology(快手科技) The Chinese University of Hong Kong(香港中文大学) Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出SonicWeave,一种带CPE-MoE的流匹配模型,可通过单一权重集生成含语音、音乐等的统一音频场景,在多项基准及复杂场景评估中表现优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07840 2026-08-11 cond-mat.quant-gas physics.atom-ph 新提交 50%

Coherent Control of Domain-Wall Transport in an Ultracold Bose Gas

超冷玻色气体中畴壁输运的相干控制

O. Farion, M. Pourzand, J. M. McGuirk

专题命中 可控生成 :diffusion(abstract)

AI总结 本研究在超冷玻色气体中实现了畴壁输运的相干控制,通过调控自旋畴取向改变畴壁轨迹,揭示了两种输运 regime 的交叉,为原子电子学系统的可控畴壁动力学提供了新途径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01836 2026-08-11 math.OC 版本更新 50%

A noncommunicative Kalman condition for null controllability of backward stochastic parabolic systems

后向随机抛物系统零能控性的非交换卡尔曼条件

Mohamed Fadili

专题命中 可控生成 :diffusion(abstract)

AI总结 该研究针对一类带耦合的后向随机热方程系统,建立了其零能控性的充要非交换卡尔曼条件,通过分离随机动力学与热半群等方法完成证明并验证条件的必要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11665 2026-08-11 cs.NE cs.AI 50%

Beyond LLMs, Sparse Distributed Memory, and Neuromorphics <A Hyper-Dimensional SRAM-CAM "VaCoAl" for Ultra-High Speed, Ultra-Low Power, and Low Cost>

超越LLM、稀疏分布式记忆和神经形态计算:一种用于超高速、超低功耗和低成本的超维SRAM-CAM“VaCoAl”

Hiroyuki Chuma, Kanji Otsuka, Yoichi Sato

机构 * Hitotsubashi University(立命馆大学) Meisei University(立命馆大学) Shuhari System(Shuhari系统)

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出VaCoAl算法,通过超维计算和伽罗瓦域扩散,在SRAM/DRAM-CAM上实现可逆、可审计的多跳推理,解决灾难性遗忘和绑定问题,并在维基数据上验证了其路径依赖的STDP式选择机制。

Comments 58 pages, 4 figure, 19 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15521 2026-08-11 cond-mat.mes-hall quant-ph 版本更新 50%

Entropy Production from Spin--Vibrational Coupling in Endohedral-Fullerene Qubits Encapsulated in Suspended Carbon Nanotubes

端帽 fullerene 量子比特封装在悬空碳纳米管中的自旋-振动耦合熵产

Cristian Staii

专题命中 可控生成 :diffusion(abstract)

AI总结 研究端帽 fullerene 量子比特与悬空碳纳米管振动模式的耦合,分析熵生成机制及非平衡量子热力学中的不可逆性分布。

Comments 21 pages, 7 figures

Journal ref Entropy (Basel). 2026 Jun 8;28(6):646

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15150 2026-08-11 cs.DL 版本更新 50%

A Semantic Geometry for Uncovering Paradigm Dynamics via Scientific Publications

一种通过科学出版物揭示范式动态的语义几何

Jinchang Liu, Qingshan Zhou, Hongkan Chen, Yi Bu

专题命中 可控生成 :diffusion(abstract)

AI总结 提出基于R-P-C(参考文献、焦点出版物、引文)框架的语义几何,通过量化出版物的知识基础与扩散的语义相似性和距离,识别巩固型、探索型和平衡型三类出版物,揭示范式动态。

Comments 40 pages, 17 figures. Published in the Journal of the Association for Information Science and Technology

Journal ref Liu, J., Zhou, Q., Chen, H., & Bu, Y. (2026). A Semantic Geometry for Uncovering Paradigm Dynamics via Scientific Publications. Journal of the Association for Information Science and Technology

详情

展开后加载摘要…

URL PDF HTML 收藏
1902.01907 2026-08-11 math.OC 版本更新 50%

Null controllability of degenerate parabolic equations with a time-varying delay

带时变延迟的退化抛物型方程的零能控性

E. L. Mustapha Ait Benhassi, Mohamed Fadili, Lahcen Maniar

专题命中 可控生成 :diffusion(abstract)

AI总结 本文研究带时变状态延迟且在单端点退化的一维线性抛物型方程的零能控性,结合退化Carleman估计与单调性泛函得到可观性不等式,还通过空间延拓获得非退化端点的Dirichlet边界能控性,常延迟方程为特例。

Comments Substantially revised and extended version. The constant-delay framework has been generalized to a time-varying delay. The adjoint formulation, observability argument, and boundary controllability result have been revised accordingly. Title changed to reflect the broader scope. 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 图像修复 3 篇

2608.08819 2026-08-11 cs.CV physics.med-ph 新提交 79%

MRI super-resolution in ten sampling steps using a diffusion bridge model

基于扩散桥模型的十步采样MRI超分辨率

Mojtaba Safari, Hang Yu, Zach Eidex, Mingzhe Hu, Ryan J. Sanford, Alexandru Florea, Shansong Wang, Chih-Wei Chang, Erik H Middlebrooks, Aditya Juloori, Stanley L. Liauw, Ralph Weichselbaum, Xiaofeng Yang

机构 * The University of Chicago(芝加哥大学) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) Emory University(埃默里大学) Georgia Institute of Technology(佐治亚理工学院) Mayo Clinic(梅奥诊所)

专题命中 图像修复 :diffusion(title,abstract);分类 cs.CV

AI总结 该研究针对MRI扫描时间与分辨率的权衡问题,提出仅需十步采样的超分辨率扩散桥模型SR-DBM,在7T脑和前列腺MRI数据集上的量化指标与视觉效果均优于九种对比方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09405 2026-08-11 cs.CV 新提交 57%

MeanSR: Restoration Trajectory Learning for One-Step Perceptual Super-Resolution

MeanSR:用于单步感知超分辨率的恢复轨迹学习

Axi Niu, Jiawei Kou, Kang Zhang, Qingsen Yan, Jinqiu Sun, Yanning Zhang

专题命中 图像修复 :diffusion(abstract);分类 cs.CV

AI总结 MeanSR是一种单步感知超分辨率方法,通过学习LR条件平均速度场并引入阶段感知时间采样策略,在CLIPIQA等指标上优于CTMSR,同时降低计算成本与延迟,提升了重建质量。

Comments 7 pages, 8 figures. Submitted to AAAI 2027

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04568 2026-08-11 cs.CV 版本更新 57%

Mask-aware inference with State-Space Models

具有掩码意识的State-Space模型推理

Ignasi Mas, Ramon Morros, Javier-Ruiz Hidalgo, Ivan Huerta

专题命中 图像修复 :inpainting(abstract);分类 cs.CV

AI总结 本文提出Partial Vision Mamba(PVM)架构,用于处理具有任意形状无效数据的State-Space模型推理任务,展示了其在深度补全、图像修复和分类中的有效性。

Comments Some results contain significant errors and we are working in a rework on this paper, which is now outdated

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 个性化与一致性 6 篇

2608.09244 2026-08-11 cs.CV 新提交 89%

In-Loop Model Adaptation with Coupled Latent-Noise Guidance for High-Fidelity Subject-Driven Text-to-Image Generation

用于高保真主体驱动文本到图像生成的耦合潜在噪声引导的循环内模型适配

Yushun Tang, Weiming Chen, Siyi Liu, Yi Zhang, Feng Wu, Zhihai He

机构 * Southern University of Science and Technology(南方科技大学) University of Science and Technology of China(中国科学技术大学) Pengcheng Lab(鹏城实验室)

专题命中 个性化与一致性 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 本研究针对主体驱动文本到图像生成中参考图像变化时模型难适配且难保持主体身份的问题,提出IMA方法,通过耦合潜在噪声损失引导循环内模型适配,提升了生成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08446 2026-08-11 cs.AI 新提交 78%

TRACE-Memory: Public-Conditioned Retrieval and Utility-Aware Evidence Admission for Personalized Generation

TRACE-Memory:用于个性化生成的公共条件检索与效用感知证据接纳

Jing Wang, Zhu Wang, Yifan Guo, Yulong Yang, Yunji Liang

专题命中 个性化与一致性 :personalized generation(title,abstract)

AI总结 该研究针对个性化生成系统中记忆使用的效用问题,提出TRACE-Memory两阶段框架,经多阶段训练后在三类数据集的4500个任务上表现优于多种记忆使用方法,支持选择性个性化。

Comments 9 pages, 4 figures, and 6 tables. Submitted to the 41st AAAI Conference on Artificial Intelligence (AAAI 2027)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08460 2026-08-11 cs.CV 新提交 77%

InstructionCrafter: Generating Consistent and High-Fidelity Visual Instructions

InstructionCrafter:生成一致且高保真的视觉指令

Shun Okamoto, Satoshi Iizuka, Kazuhiro Fukui

机构 * University of Tsukuba(筑波大学)

专题命中 个性化与一致性 :image generation(abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 本研究提出基于扩散的InstructionCrafter框架,通过空间冻结训练和两种适配器优化,实现了文本到分步视觉指令的生成,在多基准数据集上达成了最优性能且减少了噪声等问题,代码和模型将公开。

详情

展开后加载摘要…

URL PDF HTML 收藏