Breaking Barriers to Creative Expression: Co-Designing and Implementing an Accessible Text-to-Image Interface
专题命中 文生图 :text-to-image(title,abstract);image generation(abstract)
Comments 12 pages, 2 figures
视觉与机器人
图像生成、文生图、图像编辑、扩散模型和可控生成。
专题命中 文生图 :text-to-image(title,abstract);image generation(abstract)
Comments 12 pages, 2 figures
专题命中 文生图 :text-to-image(title,abstract);image generation(abstract)
Comments 34 pages (incl. appendix), 3 figures, 4 tables. Coding template (31 pages, 10 tables), study invitations (email, social media) and pre-study survey provided as supplementary (ancillary) material. Accepted at ACM CHI Play 2023
Journal ref Proc. ACM Hum.-Comput. Interact., Vol. 7, No. CHI PLAY, 2023, Article 379
专题命中 文生图 :image generation(title,abstract);text-to-image(abstract)
Comments For accessibility tagged pdf, please refer to the ancillary file
专题命中 文生图 :text-to-image(title,abstract);image generation(abstract)
Comments 5 pages, AI & HCI Workshop at the 40 International Conference on Machine Learning (ICML) 2023
专题命中 文生图 :text-to-image(title,abstract);image editing(abstract)
专题命中 文生图 :text-to-image(title,abstract);image generation(abstract)
Comments 6 pages, 7 figures. arXiv admin note: text overlap with arXiv:2302.02498
专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract)
Comments 6 pages, 7 figures, In proceedings of the 37th AAAI Conference on Artificial Intelligence
专题命中 文生图 :text-to-image(title,abstract);diffusion(abstract)
Comments NeurIPS 2022 Machine Learning for Creativity and Design Workshop
专题命中 文生图 :image generation(title,abstract);text-to-image(abstract)
TextSculptor: 训练和评估场景文本编辑
机构 * Beijing Jiaotong University(北京交通大学) ; Bytedance(字节跳动)
专题命中 文生图 :text-to-image(abstract);diffusion(abstract);image editing(abstract);image synthesis(abstract)
AI总结 本文提出TextSculptor框架,通过构建大规模数据集和基准测试,解决场景文本编辑中高质量训练数据稀缺和缺乏标准化评估的问题,提升开源模型性能。
空间链式思考:连接理解与生成模型以实现空间推理生成
机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) ; Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) ; Tsinghua University(清华大学) ; Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
专题命中 文生图 :image generation(abstract);diffusion(abstract);image editing(abstract);image synthesis(abstract)
AI总结 本文提出SCoT框架,通过结合MLLMs的推理能力与扩散模型的生成能力,提升空间推理生成任务的性能。
Comments 19 pages, 4 figures
引导不应生成的内容:用于文本-图像对齐的自动化负提示
机构 * Department of Electrical and Computer Engineering, Seoul National University(电子与计算机工程系,首尔国立大学) ; Amazon(亚马逊) ; IPAI, AIIS, ASRI, INMC, and ISRC, Seoul National University(IPAI、AIIS、ASRI、INMC 和 ISRC,首尔国立大学)
专题命中 文生图 :image generation(abstract);text-to-image(abstract);diffusion(abstract);image synthesis(abstract)
AI总结 本文提出NPC方法,通过自动化负提示生成提升文本-图像对齐效果,在GenEval++和Imagine-Bench上取得优异成绩。
Comments WACV 2026
UniModel: 一种仅依赖视觉的统一多模态理解和生成框架
机构 * Institute of Artificial Intelligence (TeleAI)(人工智能研究所)
专题命中 文生图 :image generation(abstract);text-to-image(abstract);diffusion(abstract);image synthesis(abstract)
AI总结 UniModel通过统一模型、任务和表示,在单一视觉空间中实现多模态理解和生成的统一框架。
机构 * Institute of Information Science, Beijing Jiaotong University(信息科学学院,北京交通大学) ; Faculty of Data Science, City University of Macau(数据科学学院,澳门城市大学) ; Nuctech Company Limited(NuTech公司)
专题命中 文生图 :image generation(abstract);text-to-image(abstract);diffusion(abstract);image synthesis(abstract)
机构 * Show Lab, National University of Singapore(新加坡国立大学Show实验室) ; ByteDance(字节跳动)
专题命中 文生图 :image generation(abstract);text-to-image(abstract);diffusion(abstract);inpainting(abstract)
Comments ICLR 2025
专题命中 文生图 :image generation(abstract);text-to-image(abstract);diffusion(abstract);image synthesis(abstract)
机构 * Inclusion AI Ant Group(Inclusion AI蚂蚁集团)
专题命中 文生图 :image generation(abstract);text-to-image(abstract);diffusion(abstract);image editing(abstract)
Comments https://github.com/inclusionAI/Ming/tree/Ming-Lite-Omni-Preview/Ming-unify
机构 * Jilin University(吉林大学) ; National Taiwan University(国立台湾大学)
专题命中 文生图 :image generation(abstract);text-to-image(abstract);diffusion(abstract);image synthesis(abstract)
专题命中 文生图 :image generation(abstract);text-to-image(abstract);image editing(abstract);image synthesis(abstract)
Comments Code is available at: https://github.com/VARGPT-family/VARGPT-v1.1. arXiv admin note: text overlap with arXiv:2501.12327
专题命中 文生图 :image generation(abstract);text-to-image(abstract);diffusion(abstract);image synthesis(abstract)
Comments CVPR2025
专题命中 文生图 :image generation(abstract);text-to-image(abstract);diffusion(abstract);image editing(abstract)
专题命中 文生图 :image generation(abstract);text-to-image(abstract);diffusion(abstract);image synthesis(abstract)
Comments 53 pages, 18 figures
专题命中 文生图 :image generation(abstract);text-to-image(abstract);diffusion(abstract);image editing(abstract)
专题命中 文生图 :image generation(abstract);text-to-image(abstract);diffusion(abstract);inpainting(abstract)
专题命中 文生图 :image generation(abstract);text-to-image(abstract);diffusion(abstract);image synthesis(abstract)
Comments Project page: https://xiefan-guo.github.io/i4vgen
专题命中 文生图 :image generation(abstract);text-to-image(abstract);diffusion(abstract);image synthesis(abstract)
Comments Accepted to ECCV 2024
专题命中 文生图 :image generation(abstract);text-to-image(abstract);diffusion(abstract);image synthesis(abstract)
Comments https://instruct-vis-zero.github.io/
专题命中 文生图 :image generation(abstract);text-to-image(abstract);diffusion(abstract);image editing(abstract)
Comments Project Page: https://unifyediting.github.io/
专题命中 文生图 :image generation(abstract);text-to-image(abstract);diffusion(abstract);image synthesis(abstract)
Comments Accepted by CVPR 2024. Project page: https://caphuman.github.io/
专题命中 文生图 :image generation(abstract);text-to-image(abstract);diffusion(abstract);image editing(abstract)