arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-04-01 至 2026-04-01 共收录 85 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 57 篇

2603.29036 2026-04-01 cs.CV 70%

Generating Humanless Environment Walkthroughs from Egocentric Walking Tour Videos

从第一人称行走游览视频生成无人类环境 walkthroughs

Yujin Ham, Junho Kim, Vivek Boominathan, Guha Balakrishnan

机构 * Rice University(莱斯大学)

专题命中 扩散模型 :diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 本文提出一种生成算法,通过去除行走视频中的人和阴影效果,提升环境建模应用,使用半合成数据集训练Casper模型,实现高质量的无人类视频生成,进而构建三维/四维城市模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18782 2026-04-01 cs.CV cs.AI 70%

Points-to-3D: Structure-Aware 3D Generation with Point Cloud Priors

Points-to-3D: 基于点云先验的结构感知3D生成

Jiatong Xia, Zicheng Duan, Anton van den Hengel, Lingqiao Liu

机构 * Australian Institute for Machine Learning, University of Adelaide, Australia(澳大利亚阿德莱德大学澳大利亚机器学习研究所)

专题命中 扩散模型 :diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 本文提出Points-to-3D框架,利用点云先验生成可控的3D资产和场景,通过结构修复网络和分阶段采样策略提升几何精度和渲染质量。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12052 2026-04-01 cs.CV cs.GR 62%

A Text-to-3D Framework for Joint Generation of CG-Ready Humans and Compatible Garments

为生成兼容服装的CG-ready人类和服装联合生成的文本到3D框架

Zhiyao Sun, Yu-Hui Wen, Ho-Jui Fang, Sheng Ye, Matthieu Lin, Tian Lv, Yong-Jin Liu

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV、cs.GR

AI总结 本文提出Tailor框架,通过语义解析、几何感知服装生成和一致纹理合成,实现高保真定制3D人像和物理兼容服装,优于现有方法。

Comments Project page: https://human-tailor.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.30043 2026-04-01 cs.CV 57%

Video Models Reason Early: Exploiting Plan Commitment for Maze Solving

视频模型早起推理:利用计划承诺解决迷宫

Kaleb Newman, Tyler Zhu, Olga Russakovsky

机构 * Princeton University(普林斯顿大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 研究通过2D迷宫解决探讨视频模型生成过程中的规划动态,发现模型在早期步骤中承诺高层运动计划,并揭示路径长度而非障碍密度是迷宫难度的主要预测因素,提出ChEaP方法提升复杂迷宫解决性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29734 2026-04-01 cs.CV 57%

GRVS: a Generalizable and Recurrent Approach to Monocular Dynamic View Synthesis

GRVS:一种通用且递归的方法用于单目动态视图合成

Thomas Tanay, Mohammed Brahimi, Michal Nazarczuk, Qingwen Zhang, Sibi Catley-Chandar, Arthur Moreau, Zhensong Zhang, Eduardo Pérez-Pellitero

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本文提出GRVS方法,通过递归循环和动态输入平面扫描,实现高精度的单目动态视图合成,优于现有多种基于高斯点划和扩散的方法。

Comments CVPR Findings 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29449 2026-04-01 cs.CV cs.AI 57%

NeoNet: An End-to-End 3D MRI-Based Deep Learning Framework for Non-Invasive Prediction of Perineural Invasion via Generation-Driven Classification

NeoNet:一种端到端的3D MRI基于深度学习框架,用于通过生成驱动分类非侵袭性预测神经浸润

Youngung Han, Minkyung Cha, Kyeonghun Kim, Induk Um, Myeongbin Sho, Joo Young Bae, Jaewon Jung, Jung Hyeok Park, Seojun Lee, Nam-Joon Kim, Woo Kyoung Jeong, Won Jae Lee, Pa Hong, Ken Ying-Kai Liao, Hyuk-Jae Lee

机构 * Seoul National University(首尔大学) OUTTA Chung-Ang University(中央大学) Sookmyung Women's University(淑明女子大学) Samsung Medical Center, Sungkyunkwan University School of Medicine(三星医疗中心,成均馆大学医学院) Samsung Changwon Hospital, Sungkyunkwan University School of Medicine(三星昌原医院,成均馆大学医学院) NVIDIA AI Technology Center(英伟达人工智能技术中心)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本文提出NeoNet框架,通过生成驱动分类方法预测胆管癌神经浸润,解决缺乏明确影像学标准的问题,实现最高AUC 0.7903的性能。

Comments 15 pages, 5 figures. Accepted for oral presentation at W3PHIAI Workshop, AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29295 2026-04-01 cs.CV 57%

GazeCLIP: Gaze-Guided CLIP with Adaptive-Enhanced Fine-Grained Language Prompt for Deepfake Attribution and Detection

GazeCLIP:基于自适应增强细粒度语言提示的 gaze 引导 CLIP 用于深度伪造属性和检测

Yaning Zhang, Linlin Shen, Zitong Yu, Chunjie Ma, Zan Gao

机构 * Qilu University of Technology (Shandong Academy of Sciences)(齐鲁工业大学(山东省科学院)) Shenzhen University(深圳大学) National Engineering Laboratory for Big Data System Computing Technology, Shenzhen University(深圳大学大数据系统计算技术国家工程实验室) Shenzhen Institute of Artificial Intelligence and Robotics for Society(深圳市人工智能与机器人研究院) Guangdong Key Laboratory of Intelligent Information Processing, Shenzhen University(深圳大学广东省智能信息处理重点实验室) Great Bay University(大湾区大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本文提出 GazeCLIP,通过自适应增强细粒度语言提示提升深度伪造属性和检测性能,通过设计 gaze-aware 模型和语言精炼编码器,在细粒度基准测试中实现了 6.56% ACC 和 5.32% AUC 的提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29291 2026-04-01 cs.CV cs.AI 57%

MELT: Improve Composed Image Retrieval via the Modification Frequentation-Rarity Balance Network

MELT:通过修改频繁性-稀有性平衡网络改进组合图像检索

Guozhi Qiu, Zhiwei Chen, Zixu Li, Qinlei Huang, Zhiheng Fu, Xuemeng Song, Yupeng Hu

机构 * School of Software, Shandong University(山东大学软件学院) Southern University of Science and Technology(南方科技大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 MELT通过解决罕见语义定位不对称和硬负样本下的鲁棒相似性估计问题,改进组合图像检索的性能。

Comments Accepted by ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14794 2026-04-01 cs.CV cs.LG 57%

Face-to-Face: A Video Dataset for Multi-Person Interaction Modeling

面对面:一个多人物交互建模的视频数据集

Ernie Chu, Vishal M. Patel

机构 * Johns Hopkins University(约翰霍普金斯大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本文提出F2F-JF数据集,用于研究多人物交互建模,通过半自动流程提取对齐的主持人和嘉宾轨迹,并展示基于该数据集的反应式数字虚拟形象任务,验证了扩散模型在跨人物视觉上下文中的表现。

Comments Project Page: https://face2face2026.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06753 2026-04-01 cs.CV 57%

EarthBridge: A Solution for 4th Multi-modal Aerial View Image Challenge Translation Track

EarthBridge: 4th 多模态航空视图图像挑战翻译赛道的解决方案

Zhenyuan Chen, Guanyuan Shen, Feng Zhang

机构 * Zhejiang University(浙江大学) University of Science and Technology of China(中国科学技术大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本文提出EarthBridge框架,通过Diffusion Bridge Implicit Models和Contrastive Unpaired Translation方法,实现EO、IR和SAR传感器间的高质量图像到图像翻译,解决了跨模态转换中的挑战,取得第二名成绩。

Comments accepted by CVPRW 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.06537 2026-04-01 cs.CV cs.AI 57%

ProFashion: Prototype-guided Fashion Video Generation with Multiple Reference Images

ProFashion: 基于多参考图像的原型引导时尚视频生成

Xianghao Kong, Qiaosong Qi, Yuanbin Wang, Biaolong Chen, Aixi Zhang, Anyi Rao

机构 * The Hong Kong University of Science and Technology(香港科技大学) Taobao & Tmall Group(淘宝天猫集团)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本文提出ProFashion框架,利用多参考图像提升视图一致性和时间一致性,通过姿态感知原型聚合器和流增强原型生成器改进时尚视频生成。

Comments CVPRW 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29903 2026-04-01 q-bio.NC eess.SP 50%

Multimodal Higher-Order Brain Networks: A Topological Signal Processing Perspective

多模态高阶脑网络:拓扑信号处理视角

Breno C. Bispo, Stefania Sardellitti, Juliano B. Lima, Fernando A. N. Santos

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出基于拓扑信号处理的多模态框架,通过高阶拓扑域建模脑部,利用扩散MRI和静息态fMRI学习个体化脑细胞复合体,揭示高阶相互作用的拓扑特征及其与行为的关联。

Comments This paper has been sumbmitted to IEEE Transactions on Medical Imaging (TMI), March 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29763 2026-04-01 q-fin.PR q-fin.ST q-fin.TR 50%

Option Pricing on Automated Market Maker Tokens

自动化市场 maker 代币的期权定价

Philip Z. Maymin

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究了基于常产品自动市场 maker 的代币价格过程,推导出常弹性方差过程,提出流动性调整的希腊字母,并通过实证检验支持该模型的预测。

Comments 33 pages, 9 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29658 2026-04-01 eess.SY cs.SY 50%

SCORE: Statistical Certification of Regions of Attraction via Extreme Value Theory

SCORE:通过极值理论进行统计区域吸引域认证

Pietro Zanotta, Panos Stinis, Ján Drgoňa

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出SCORE框架,通过极值理论和随机梯度动力学方法,解决高维非线性系统区域吸引域认证问题,实现高效且可靠的统计认证。

Comments Submitted to IEEE Control Systems Letters (L-CSS). 6 pages, 2 figures, 1 table. Code available at: https://github.com/SOLARIS-JHU/SCORE-Statistical-Certification-of-ROA-via-EVT

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29638 2026-04-01 astro-ph.SR physics.plasm-ph physics.space-ph 50%

Multi-hierarchy simulation of Riemann problem for reconnection exhausts

多层级模拟瑞利问题中的再连接排气

Keita Akutagawa, Shinsuke Imada, Munehito Shoda

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文通过多层级框架结合MHD与PIC模拟,研究再连接排气中的慢速激波形成与性质,发现即使在PIC域中抑制慢速激波形成,MHD域仍能形成接近开关极限的慢速激波,且该行为不受PIC域大小影响,进一步促进PIC域内等离子体各向同性。

Comments Accepted for publication in the Astrophysical Journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08411 2026-04-01 stat.CO 50%

Particle Filtering for a Class of State-Space Models with Low and Degenerate Observational Noise

用于具有低或退化观测噪声的状态空间模型的粒子滤波器

Abylay Zhumekenov, Alexandros Beskos, Dan Crisan, Ajay Jasra, Nikolas Kantas

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种新的粒子滤波器,适用于观测噪声低或退化的情况,具有对观测噪声大小鲁棒的特性,并扩展到扩散过程的隐藏状态。

Comments 27 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04941 2026-04-01 cond-mat.stat-mech math.PR 50%

Supersymmetric properties of one-dimensional Markov generators with the links to Markov-dualities and to shape-invariance-exact-solvability

一维马尔可夫生成元的超对称性质及其与马尔可夫-对偶性和形状不变-精确可解性的联系

Cecile Monthus

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究一维马尔可夫生成元的超对称性质,通过超对称伙伴和形状不变性精确可解性,揭示马尔可夫对偶性与生成元的关联。

Comments v2=final version (30 pages)

Journal ref J. Phys. A: Math. Theor. 59 (2026) 105001

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.07645 2026-04-01 q-bio.PE math.PR 50%

Two-type branching processes with immigration, and the structured coalescents

两种类型分支过程与结构化凝聚过程

María Emilia Caballero, Adrián González Casanova, José Luis Pérez

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究了两种类型个体在两个岛屿上的分支过程,通过两型Feller扩散模型探讨了频率变化,并推导了不对称两岛频率过程的性质及大种群极限,揭示了平衡选择的新机制。

Journal ref J. Appl. Probab. 63 (2026) 32-60

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29430 2026-04-01 q-fin.MF q-fin.CP 50%

Ultra-short-term volatility surfaces

超短期波动率曲面

Federico M. Bandi, Nicola Fusari, Guido Gazzani, Roberto Renò

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出Edgeworth++模型,通过非参数随机波动性组件和确定性位移扩展,有效捕捉超短期期权的隐含波动率微笑,并通过局部展开实现快速准确的期权定价。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29398 2026-04-01 q-bio.PE 50%

Pathogen diversity emerging from coevolutionary dynamics in interconnected systems

共进化动态中互联系统中病原体多样性

Davide Zanchetta, Vittoria Bettio, Sandro Azaele, Manlio De Domenico

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究了病原体在共进化动态中的多样性,通过构建多尺度模型,分析宿主免疫记忆和异质接触对传染病传播和抗原性差异的影响,揭示了宿主异质性对病原体多样性及流行病持续性的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29388 2026-04-01 physics.space-ph cs.NA math.NA 50%

Closed-Form Solutions to the Fokker-Planck Equation for Orbital Uncertainty Propagation

Fokker-Planck方程轨道不确定性传播的闭式解

Jose Antonio Rebollo, Rafael Vazquez, Claudio Bombardelli

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出一种无需网格的闭式解法,用于Fokker-Planck方程的轨道不确定性传播,通过证明指数二次型假设在对流和扩散下保持结构,从而以紧凑的ODE系统传播概率密度函数,比蒙特卡洛方法更高效。

Comments Extended abstract submitted to 2026 AAS/AIAA Astrodynamics Specialist Conference, Whistler, British Columbia, July 26-30 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29312 2026-04-01 physics.soc-ph 50%

A Preliminary Theory of Infantile Dynamics

婴儿动力学的初步理论

Lei Ma

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出婴儿驱动家庭混沌的动力学模型,通过三个假设探讨家庭组织熵增与局部有序现象,利用玩具模型展示熵增过程及好奇心驱动行为。

Comments April Fools' paper on the laws of baby activity

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29310 2026-04-01 physics.app-ph 50%

Light-Sculpted Azopolymer Colloids: From Patchy Spheres to Porcupine and Pineapple Morphologies

光雕刻的Azopolymer胶体:从斑点球到海胆和菠萝形态

Sh. Golghasemi Sorkhabi, R. Barille, M. Loumaigne, A. Korbut, S. Zielinska, E. Ortyl

专题命中 扩散模型 :diffusion(abstract)

AI总结 通过控制激光偏振将PMMA Azopolymer复合纳米颗粒转化为复杂三维形态,展示了一种简单的光学策略,同时揭示了几何形状对微尺度传输和软物质物理的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29249 2026-04-01 math.NA cs.NA 50%

A Unified Weighted-Loss Physics-Informed Neural Network for Boundary Layer Problems in Singularly Perturbed PDEs

一种统一的加权损失物理信息神经网络用于奇异摄动PDEs中的边界层问题

Wei-Fan Hu, Shi-Xiang Zhong, Po-Wen Hsieh, Chung-Kai Chen, Te-Sheng Lin

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出一种基于加权损失的统一学习框架,用于解决奇异摄动PDEs中的边界层问题,通过自动识别边界层位置,简化了实现复杂度并提高了计算精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29048 2026-04-01 math.AP 50%

Asymptotic stabilization of weak solutions to phase-field equations with non-degenerate mobility and singular potential

弱解渐近稳定性的相场方程与非退化迁移率和奇异势的研究

Maurizio Grasselli, Andrea Poiatti

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种新方法,通过Lojasiewicz-Simon不等式证明了非退化迁移率和奇异势下的相场方程弱解渐近稳定到单一平衡态,扩展了相场模型的渐近行为研究。

Comments arXiv admin note: text overlap with arXiv:2510.17296

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28983 2026-04-01 quant-ph physics.hist-ph 50%

Can Quantum Field Theory be Recovered from Time-Symmetric Stochastic Mechanics? Part II: Prospects for a Trajectory Interpretation

能否从时间对称的随机力学中恢复量子场论?第二部分:轨迹解释的前景

Simon Friederich, Mritunjay Tyagi

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文探讨了时间对称随机力学中轨迹解释的可行性,指出轨迹动态本质上是非马尔可夫的,这解释了为何隐变量理论的否定定理不排斥该方法。

Comments 13 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28955 2026-04-01 cs.AI 50%

Enhancing Policy Learning with World-Action Model

通过世界-动作模型增强策略学习

Yuci Han, Alper Yilmaz

机构 * Photogrammetry and Computer Vision Lab, The Ohio State University(俄亥俄州立大学摄影测量与计算机视觉实验室)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出World-Action Model,通过联合推理未来视觉观测和驱动状态转移的动作,提升策略学习效果。在CALVIN基准的八项任务中,WAM通过行为克隆和基于模型的PPO优化,显著提高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28947 2026-04-01 math.NA cs.NA 50%

Toward generalized solutions of the Keller--Segel equations with singular sensitivity and signal absorption via an algebraic manipulation finite element algorithm

迈向具有奇异敏感性和信号吸收的Keller-Segel方程广义解的算法

Juan Vicente Gutiérrez-Santacreu

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出一种代数操作有限元算法,用于求解具有奇异敏感性和信号吸收的Keller-Segel方程,通过稳定项和极值检测器保证数值解的收敛性,同时保持物理约束和质量守恒。

Comments 53 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02700 2026-04-01 math.NA cs.NA q-fin.CP 50%

Numerical valuation of European options under two-asset infinite-activity exponential Lévy models

欧式期权在双资产无限活动指数莱维模型下的数值估值

Massimiliano Moda, Karel J. in 't Hout, Michèle Vanmaele, Fred Espen Benth

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种数值方法,用于在双资产无限活动指数莱维模型下估值欧式期权,扩展了Wang等人(2007)的方法,适用于一般莱维测度,通过快速傅里叶变换高效计算非局部积分项,采用半拉格朗日θ方法进行时间离散化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.04929 2026-04-01 physics.flu-dyn 50%

Flamelet Connection to Turbulence Kinetic Energy Dissipation Rate

湍流动能耗散率与火焰let的联系

William A. Sirignano, Wes Hellwig, Sylvain L. Walsh

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出将湍流动能耗散率ε用于闭合子网格非预混火焰let模型,通过关联湍流非预混燃烧的物理过程,提升燃烧计算的准确性。

Comments 29 pages, 11 figures

Journal ref Combustion Theory and Modelling, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏