arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-03-11 至 2026-03-11 共收录 3 信号源:cs.CV, cs.GR, cs.MM

1. 图像生成评测 3 篇

2603.09832 2026-03-11 cs.GR cs.HC 89%

Prompt-Driven Color Accessibility Evaluation in Diffusion-based Image Generation Models

基于提示的扩散图像生成模型颜色可访问性评估

Xinyao Zhuang, Jose Echevarria, Kaan Akşit

专题命中 图像生成评测 :image generation(title,abstract);diffusion(title,abstract);text-to-image(abstract);分类 cs.GR

AI总结 本文提出CVDLoss指标,评估扩散模型在不同类别中对颜色可访问性提示的响应能力,揭示现有模型在可访问性方面的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24146 2026-03-11 cs.CV 83%

Taming Preference Mode Collapse via Directional Decoupling Alignment in Diffusion Reinforcement Learning

通过方向解耦对齐缓解偏好模式崩溃在扩散强化学习中

Chubin Chen, Sujie Hu, Jiashu Zhu, Meiqi Wu, Jintao Chen, Yanxun Li, Nisha Huang, Chengyu Fang, Jiahong Wu, Xiangxiang Chu, Xiu Li

机构 * Tsinghua University(清华大学) AMAP, Alibaba Group(阿里云实验室,阿里巴巴集团)

专题命中 图像生成评测 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

AI总结 本文提出D²-Align框架,通过方向解耦对齐缓解扩散强化学习中的偏好模式崩溃,提升生成多样性。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01433 2026-03-11 cs.CV 57%

DOCFORGE-BENCH: A Comprehensive 0-shot Benchmark for Document Forgery Detection and Analysis

DOCFORGE-BENCH:一个全面的零样本文档伪造检测与分析基准

Zengqi Zhao, Weidi Xia, En Wei, Yan Zhang, Jane Mo, Tiannan Zhang, Yuanqin Dai, Zexi Chen, Yiran Tao, Simiao Ren

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) University of California, Irvine(加州大学尔湾分校) Washington University in St. Louis(圣路易斯华盛顿大学) Duke University(杜克大学) University of California, Davis(加州大学戴维斯分校) New York University(纽约大学) Georgetown University(乔治城大学)

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV

AI总结 DOCFORGE-BENCH提出首个零样本文档伪造检测基准,揭示校准失败问题,强调阈值适应对实际部署的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏