arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-03-25 至 2026-03-25 共收录 6 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 6 篇

2603.23381 2026-03-25 cs.CV 57%

FG-Portrait: 3D Flow Guided Editable Portrait Animation

FG-Portrait: 基于3D流的可编辑肖像动画

Yating Xu, Yunqi Miao, Evangelos Ververas, Jiankang Deng, Jifei Song

机构 * National University of Singapore(新加坡国立大学) University of Warwick(沃里克大学) Imperial College London(伦敦帝国理工学院) University of Surrey(萨里大学)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 本文提出FG-Portrait,通过3D流引导的方法实现高质量的肖像动画生成,结合3D几何信息和扩散模型,提升驱动运动与源肖像的对应精度,并支持用户对表情和头部姿态的编辑。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16740 2026-03-25 cs.CV 57%

Task-Oriented Data Synthesis and Control-Rectify Sampling for Remote Sensing Semantic Segmentation

面向任务的数据合成与控制-校正采样用于遥感语义分割

Yunkai Yang, Yudong Zhang, Kunquan Zhang, Jinxiao Zhang, Xinying Chen, Haohuan Fu, Runmin Dong

机构 * Sun Yat-Sen University(中山大学) Tsinghua University(清华大学) Beijing Institute of Technology(北京理工大学)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 本文提出TODSynth框架,结合多模态扩散变换器和任务反馈驱动的采样策略,提升遥感语义分割数据合成效果,尤其在少样本和复杂场景中表现优异。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20095 2026-03-25 math.AP 50%

An eigenvalue problem for a nonlocal quasilinear anisotropic equation in fractional Orlicz Sobolev spaces without the $Δ_2$--condition

一个非局部准线性各向异性方程在无Δ₂-条件的分数Orlicz Sobolev空间中的特征值问题

Julian Fernandez Bonder, Martin Guzman, Juan F. Spedaletti

专题命中 可控生成 :diffusion(abstract)

AI总结 本文研究了一类非局部非标准生长扩散问题的特征值问题,不假设Young函数的Δ₂条件,证明了特征对序列(uk,λk)趋向于(0,+∞)的存在性。

Comments 18 pages, submitted

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17658 2026-03-25 cond-mat.mtrl-sci 50%

Thermal Control of Size Distribution and Optical Properties in Gallium Nanoparticles

镓纳米颗粒尺寸分布与光学性质的热控制

S. Catalan-Gomez, M. Ibanez, J. Rico, V. Braza, D. F. Reyes, M. Villanueva-Blanco, E. Squiccimarro, J. M. Ulloa

专题命中 可控生成 :diffusion(abstract)

AI总结 研究通过调节基底温度控制镓纳米颗粒的成核、生长及均质化过程,发现300-350℃范围内可获得均匀分布的纳米颗粒,优化了等离子体质量因子,证实了氧化层形成对稳定均匀数组的重要性。

Comments Supporting Information is included within the document

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19668 2026-03-25 eess.AS cs.AI cs.SD 50%

Selective Classifier-free Guidance for Zero-shot Text-to-speech

选择性分类器无关引导用于零样本文本到语音

John Zheng, Farhad Maleki

机构 * University of Calgary, Department of Computer Science, Canada(卡尔加里大学计算机科学系)

专题命中 可控生成 :image generation(abstract)

AI总结 本文研究了分类器无关引导在零样本文本到语音中的应用,发现传统方法在语音合成中效果不佳,通过分步应用选择性引导策略可提升说话人相似性并保持文本一致性。

Comments 5 pages, 7 figures, 1 table. Revision 1: removed ICASSP copyright notice

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09424 2026-03-25 cs.RO 50%

Exploring Pose-Guided Imitation Learning for Robotic Precise Insertion

探索基于姿态引导的模仿学习用于机器人精确插入

Han Sun, Sheng Liu, Yizhao Wang, Zhenning Zhou, Shuai Wang, Haibo Yang, Jingyuan Sun, Qixin Cao

机构 * School of Mechanical Engineering, Shanghai Jiao Tong University(上海交通大学机械工程学院) Karlsruhe Institute of Technology(卡尔斯鲁厄大学) Shanghai Huawei Technologies Co., Ltd.(上海华为技术有限公司)

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出基于姿态引导的模仿学习方法,通过紧凑的对象中心观测实现精确插入任务,提升数据效率和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏