arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-08-06 至 2026-08-06 共收录 4 信号源:cs.CV, cs.GR, cs.MM

1. 图像生成评测 4 篇

2608.05049 2026-08-06 cs.CV 新提交 57%

OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing

OmniEdit-Bench:基于指令的视频编辑综合基准

Chenxuan Miao, Yutong Feng, Yi Lu, Yunfeng Yan, Donglian Qi, Shiwei Zhang, Yu Liu, Xi Chen, Hengshuang Zhao

机构 * The University of Hong Kong(香港大学) Alibaba Group(阿里巴巴集团) Zhejiang University(浙江大学) Peking University(北京大学)

专题命中 图像生成评测 :image editing(abstract);分类 cs.CV

AI总结 针对现有基于指令的视频编辑基准的任务覆盖有限、指标不足的问题,OmniEdit-Bench将编辑任务分解为多维度并提出含惩罚机制的评估框架,实验显示当前IVE模型仍待提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04504 2026-08-06 cs.CV cs.AI 新提交 57%

GeoReward: Mitigating Contextual Variable Overestimation in Vision-Language Models for Cross-Market Preference Prediction

GeoReward:缓解跨市场偏好预测的视觉语言模型中的上下文变量高估问题

Shuo Liu, Huixiang Cai, Weiru Zhang, Xiaoyi Zeng

机构 * Alibaba International Digital Commerce Group(阿里巴巴国际数字商业集团)

专题命中 图像生成评测 :text-to-image(abstract);分类 cs.CV

AI总结 本研究针对视觉语言模型的上下文变量高估问题,提出GeoReward奖励模型,通过三种机制缓解该偏差,在跨市场广告偏好预测任务中性能优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04349 2026-08-06 cs.CV 新提交 57%

Poly-OPD: Heterogeneous Multi-Teacher On-Policy Distillation for Capability-Selectable Flow Models

Poly-OPD:用于能力可选流模型的异构多教师在线策略蒸馏

Siming Fu, Haojun Xu, Ruizhe He, Zheming Fu, Hualiang Wang, Jie Huang, Xiaoxiao Ma, Mingchen Zhong, Weihu Huang, Xiaoxuan He, Linjiang Huang, Si Liu

专题命中 图像生成评测 :text-to-image(abstract);分类 cs.CV

AI总结 Poly-OPD框架通过异构多教师在线策略蒸馏,将FLUX.1-dev和Z-Image的互补优势整合到25亿参数的SD3.5-Medium模型,提升了文本到图像生成的GenEval与DrawBench指标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04838 2026-08-06 math.ST math.PR stat.TH 新提交 50%

Exchangeable Testing Against an Unknown Benchmark

针对未知基准的可交换检验

Alexander Gnedin

专题命中 图像生成评测 :diffusion(abstract)

AI总结 本研究针对未知基准的序贯检验,提出基于组合秩的更新机制,建立贝叶斯框架下可显式计算的预测概率,分析了相关马尔可夫链的渐近行为。

Comments 17 pages

详情

展开后加载摘要…

URL PDF HTML 收藏