arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-05-04 至 2026-05-04 共收录 4 信号源:cs.CV, cs.GR, cs.MM

1. 图像生成评测 4 篇

2601.09896 2026-05-04 cs.HC cs.AI cs.CV 57%

The Algorithmic Gaze of Image Quality Assessment: An Audit and Trace Ethnography of the LAION-Aesthetics Predictor

图像质量评估的算法凝视:LAION-Aesthetics预测器的审计与踪迹民族志

Jordan Taylor, William Agnew, Maarten Sap, Sarah E. Fox, Haiyi Zhu

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV

AI总结 本文研究了广泛用于训练视觉生成图像模型的LAION-Aesthetics预测器,揭示其在筛选图像数据时对女性描述的偏向性,以及其对西方艺术史中帝国和男性凝视的强化,呼吁转向更多元的审美评估。

Comments To Appear at FAccT 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21864 2026-05-04 cs.CV 57%

Deepfakes: we need to re-think the concept of "real" images

深度伪造:我们需要重新思考“真实”图像的概念

Janis Keuper, Margret Keuper

机构 * Institute for Machine Learning and Analytics, Offenburg University(机器学习与分析研究所,奥芬堡大学) University of Mannheim(曼海姆大学) Max Planck Institute for Informatics, Saarland Informatics Campus(马克斯·普朗克信息研究所,萨尔兰州信息校区)

专题命中 图像生成评测 :image generation(abstract);分类 cs.CV

AI总结 本文指出当前“伪造”检测方法依赖过时的低分辨率“真实”图像数据集,呼吁重新定义“真实”图像并建立新基准数据集。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00689 2026-05-04 cs.CL cs.CR 50%

ML-Bench&Guard: Policy-Grounded Multilingual Safety Benchmark and Guardrail for Large Language Models

ML-Bench&Guard: 政策导向的多语言安全基准与大型语言模型的防护机制

Yunhan Zhao, Zhaorun Chen, Xingjun Ma, Yu-Gang Jiang, Bo Li

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Fudan University(复旦大学) University of Chicago(芝加哥大学)

专题命中 图像生成评测 :diffusion(abstract)

AI总结 本文提出ML-Bench和ML-Guard,通过区域法规构建多语言安全基准,并开发基于扩散模型的防护系统,实现文化与法律一致的多语言安全评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04465 2026-05-04 cs.AI 50%

The Topology of Multimodal Fusion: Why Current Architectures Fail at Creative Cognition

多模态融合的拓扑学:为何当前架构在创造性认知上失败

Xiujiang Tan

机构 * Guangzhou Academy of Fine Arts(广州美术学院)

专题命中 图像生成评测 :diffusion(abstract)

AI总结 本文指出当前多模态AI架构存在拓扑限制而非参数限制,通过哲学、认知科学和数学三个支柱提出多模态融合的拓扑学框架,提出UOO实现、ANALOGY-MM基准和META-TOP三阶基准,通过实验路线验证拓扑同构性。

Comments Expanded 11 technical improvements; 5 reference corrections; Appendix B pseudocode added. ~43 pages, 5 figures. Chinese philosophical terms romanized. Companion monograph available separately

详情

展开后加载摘要…

URL PDF HTML 收藏