arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-03-04 至 2026-03-04 共收录 3 信号源:cs.CV, cs.GR, cs.MM

1. 图像生成评测 3 篇

2603.02712 2026-03-04 cs.CV cs.MM eess.IV 81%

From "What" to "How": Constrained Reasoning for Autoregressive Image Generation

从‘是什么’到‘如何做’:用于自回归图像生成的约束推理

Ruxue Yan, Xubo Liu, Wenya Guo, Zhengkun Zhang, Ying Zhang, Xiaojie Yuan

机构 * College of Computer Science, Nankai University(南开大学计算机科学学院) Baidu Inc.(百度公司)

专题命中 图像生成评测 :image generation(title,abstract);分类 cs.CV、cs.MM

AI总结 本文提出CoR-Painter框架,通过约束推理引导自回归图像生成,解决空间结构模糊问题,提升生成图像的准确性和质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23348 2026-03-04 cs.LG 78%

Entering the Era of Discrete Diffusion Models: A Benchmark for Schrödinger Bridges and Entropic Optimal Transport

进入离散扩散模型的时代:Schrödinger桥和熵最优传输的基准

Xavier Aramayo Carrasco, Grigoriy Ksenofontov, Aleksei Leonov, Iaroslav Sergeevich Koshelev, Alexander Korotin

机构 * Applied AI Institute(应用人工智能研究所) AI Foundation and Algorithm Lab(人工智能基金会与算法实验室)

专题命中 图像生成评测 :diffusion(title,abstract)

AI总结 本文提出了一种针对离散空间的Schrödinger桥基准,通过构造具有已知解的概率分布对,实现了对SB方法在高维离散设置中性能的严格评估,并引入了新的SB算法DLightSB和DLightSB-M以及α-CSBM算法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02619 2026-03-04 cs.CV 57%

Direct Reward Fine-Tuning on Poses for Single Image to 3D Human in the Wild

基于姿态的直接奖励微调用于单图像到野外3D人体

Seunguk Do, Minwoo Huh, Joonghyuk Shin, Jaesik Park

机构 * Seoul National University(首尔国立大学)

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV

AI总结 DrPose通过直接奖励微调提升单图像到3D人体重建的姿态一致性,利用姿态与图像配对数据训练,改进多视图扩散模型,提升动态和复杂姿态的重建质量。

Comments ICLR 2026, Project webpage: https://seunguk-do.github.io/drpose

详情

展开后加载摘要…

URL PDF HTML 收藏