arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 762 信号源:cs.CV, cs.GR, cs.MM

1. 其他图像生成 762 篇

1710.10304 2018-03-01 cs.NE cs.CV 57%

Few-shot Autoregressive Density Estimation: Towards Learning to Learn Distributions

Scott Reed, Yutian Chen, Thomas Paine, Aäron van den Oord, S. M. Ali Eslami, Danilo Rezende, Oriol Vinyals, Nando de Freitas

专题命中 其他图像生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
1801.02684 2018-01-10 cs.CV eess.IV 57%

Generative Sensing: Transforming Unreliable Sensor Data for Reliable Recognition

Lina Karam, Tejas Borkar, Yu Cao, Junseok Chae

专题命中 其他图像生成 :image generation(abstract);分类 cs.CV

Comments 5 pages, Submitted to IEEE MIPR 2018

详情

展开后加载摘要…

URL PDF HTML 收藏
1709.01872 2018-01-10 cs.CV 57%

Synthetic Medical Images from Dual Generative Adversarial Networks

John T. Guibas, Tejpal S. Virdi, Peter S. Li

专题命中 其他图像生成 :image generation(abstract);分类 cs.CV

Comments First two authors contributed equally. Accepted to NIPS 2017 Workshops on Medical Imaging and Machine Learning for Health

详情

展开后加载摘要…

URL PDF HTML 收藏
1711.09151 2017-11-28 cs.CV 57%

Convolutional Image Captioning

Jyoti Aneja, Aditya Deshpande, Alexander Schwing

专题命中 其他图像生成 :image generation(abstract);分类 cs.CV

Comments 11 pages, 9 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1707.03124 2017-11-15 cs.CV 57%

Adversarial Generation of Training Examples: Applications to Moving Vehicle License Plate Recognition

Xinlong Wang, Zhipeng Man, Mingyu You, Chunhua Shen

专题命中 其他图像生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
1607.08022 2017-11-07 cs.CV 57%

Instance Normalization: The Missing Ingredient for Fast Stylization

Dmitry Ulyanov, Andrea Vedaldi, Victor Lempitsky

专题命中 其他图像生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
1705.06566 2017-09-12 cs.CV stat.ML 57%

Learning Texture Manifolds with the Periodic Spatial GAN

Urs Bergmann, Nikolay Jetchev, Roland Vollgraf

专题命中 其他图像生成 :image generation(abstract);分类 cs.CV

Comments Proceedings of the 34th International Conference on Machine Learning, Sydney, Australia, 2017. JMLR: W&CP. Copyright 2017 by the author(s)

详情

展开后加载摘要…

URL PDF HTML 收藏
1704.07242 2017-04-27 cs.CV 57%

Supervised Adversarial Networks for Image Saliency Detection

Hengyue Pan, Hui Jiang

专题命中 其他图像生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
1703.04079 2017-03-14 cs.CV cs.CG 57%

SurfNet: Generating 3D shape surfaces using deep residual networks

Ayan Sinha, Asim Unmesh, Qixing Huang, Karthik Ramani

专题命中 其他图像生成 :image generation(abstract);分类 cs.CV

Comments CVPR 2017 paper

详情

展开后加载摘要…

URL PDF HTML 收藏
1609.07093 2017-02-07 cs.LG cs.CV cs.NE stat.ML 57%

Neural Photo Editing with Introspective Adversarial Networks

Andrew Brock, Theodore Lim, J. M. Ritchie, Nick Weston

专题命中 其他图像生成 :image generation(abstract);分类 cs.CV

Comments 10 pages, 7 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
1701.01876 2017-01-10 cs.CV 57%

DeepFace: Face Generation using Deep Learning

Hardie Cate, Fahim Dalvi, Zeshan Hussain

专题命中 其他图像生成 :image generation(abstract);分类 cs.CV

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
1612.01294 2016-12-06 cs.CV cs.AI cs.LG cs.NE 57%

Message Passing Multi-Agent GANs

Arnab Ghosh, Viveka Kulharia, Vinay Namboodiri

专题命中 其他图像生成 :image generation(abstract);分类 cs.CV

Comments The first 2 authors contributed equally for this work

详情

展开后加载摘要…

URL PDF HTML 收藏
1607.05387 2016-11-15 cs.AI cs.CV cs.LG 57%

Generating Images Part by Part with Composite Generative Adversarial Networks

Hanock Kwak, Byoung-Tak Zhang

专题命中 其他图像生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
1611.03079 2016-11-11 cs.GR 57%

Fractal Art Generation using GPUs

Will. D. Mayfield, Justin. C. Eiland, Taylor. J. Hutyra, Matt. C. Paulsen, Bryant. M. Wyatt

专题命中 其他图像生成 :image generation(abstract);分类 cs.GR

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1608.04224 2016-08-16 cs.CV 57%

Generating Synthetic Data for Text Recognition

Praveen Krishnan, C. V. Jawahar

专题命中 其他图像生成 :image generation(abstract);分类 cs.CV

Comments 5 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1607.07215 2016-07-27 cs.CV 57%

DeepWarp: Photorealistic Image Resynthesis for Gaze Manipulation

Yaroslav Ganin, Daniil Kononenko, Diana Sungatullina, Victor Lempitsky

专题命中 其他图像生成 :image generation(abstract);分类 cs.CV

Comments Fixed typos, 14 + 2 + 2 pages, ECCV 2016

详情

展开后加载摘要…

URL PDF HTML 收藏
1602.07416 2016-05-31 cs.LG cs.CV 57%

Learning to Generate with Memory

Chongxuan Li, Jun Zhu, Bo Zhang

专题命中 其他图像生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
1603.05522 2016-03-18 stat.AP cs.CV stat.CO 57%

Tracking multiple moving objects in images using Markov Chain Monte Carlo

Lan Jiang, Sumeetpal S. Singh

专题命中 其他图像生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
1511.02793 2016-03-01 cs.LG cs.CV 57%

Generating Images from Captions with Attention

Elman Mansimov, Emilio Parisotto, Jimmy Lei Ba, Ruslan Salakhutdinov

专题命中 其他图像生成 :image generation(abstract);分类 cs.CV

Comments Published as a conference paper at ICLR 2016

详情

展开后加载摘要…

URL PDF HTML 收藏
1508.01887 2015-08-12 cs.CV cs.LG cs.NE 57%

Deep Boosting: Joint Feature Selection and Analysis Dictionary Learning in Hierarchy

Zhanglin Peng, Ya Li, Zhaoquan Cai, Liang Lin

专题命中 其他图像生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09468 2026-08-11 cs.LG cs.AI 新提交 50%

MixFormer: Linear Transformer with Mixture of Memory Experts

MixFormer:带有记忆专家混合体的线性Transformer

Yu Guo, Lei Duan

机构 * School of Computer Science, Sichuan University(四川大学计算机学院) School of Artificial Intelligence, Sichuan University(四川大学人工智能学院)

专题命中 其他图像生成 :image generation(abstract)

AI总结 针对现有线性Transformer主流方向状态空间模型的输入适应性与内存容量局限,论文提出带记忆专家混合体和时间感知线性注意力的MixFormer,在长序列生成任务上实现性能提升,为下一代网络基础设施提供更可持续的计算主干。

Comments 17 pages, 9 figures, and 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03413 2026-08-05 cs.AI cs.ET 新提交 50%

Enactive Artificial Intelligence: A Decision-Centric Architecture for Complex Systems

能动人工智能:面向复杂系统的以决策为中心的架构

Zuojun Max Shen, Yuan Qu, Pujun Zhang, Anbang Liu, Yunhao Liang

专题命中 其他图像生成 :image generation(abstract)

AI总结 本研究提出能动人工智能框架,通过组织世界、站点世界等四个角色构建以决策为中心的架构,拓展AI前沿,为企业与工业复杂系统的可靠AI部署提供新方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02162 2026-08-04 cs.SE cs.AI cs.PL 新提交 50%

Lossless Tensor Compression as Program Synthesis

作为程序综合的无损张量压缩

Jieke Shi, Junda He, Wenjia Jiang, Weifeng Sun, Shidong Pan, Zhensu Sun, Chengran Yang, Peixin Zhang, Yifan Jia, Zhou Yang, Thong Hoang, Xiwei Xu, Zhenchang Xing, David Lo

专题命中 其他图像生成 :image generation(abstract)

AI总结 Brevis将无损张量压缩转化为程序综合,通过带类型的DSL与有界A*搜索优化压缩,在10类模型检查点上实现了超通用及专用压缩器的存储缩减,且压缩解压速度可观。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20432 2026-07-24 cs.CL cs.PL 新提交 50%

Position: Natural Language Should Not Fully Replace Formal Languages

立场:自然语言不应完全取代形式语言

Eitan Wagner, Elisha Rosensweig, Omri Abend

专题命中 其他图像生成 :image generation(abstract)

AI总结 针对自然语言能否完全取代形式语言的争议,引入基于“任务特异性”的形式框架并证明“特异性交叉定理”,通过跨模态案例分析表明二者各有优势,是互补工具,倡导开发混合系统。

Comments To be published in ICML 2026 (position track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15686 2026-07-20 cs.AI 新提交 50%

S1-Omni: A Unified Multimodal Reasoning Model for Scientific Understanding, Prediction, and Generation

S1-Omni:用于科学理解、预测和生成的统一多模态推理模型

Jiahao Zhao, Junyi Liu, Lifeng Xu, Nan Xu, Qingli Wang, Qingxiao Li, Tianle Chen, Xiaoyu Wu, Yawen Zheng, Zikai Wang, Guanming Liu, Hequn Zhou, Jingyi Wang, Jingyuan Shu, Keqi Wang, Li He, Songyang Diao, Wenhui Xu, Xinyu Ren, Yaqin Fan, Yujin Zhou, Zhanao Yao

机构 * ScienceOne AI(科学一号人工智能) Wenge AI(文阁人工智能)

专题命中 其他图像生成 :image generation(abstract)

AI总结 研究针对科学人工智能模型能力分散问题,提出S1-Omni统一多模态推理模型,基于科学数据统一表示、知识对齐和解码三个核心组件,经训练和评估,在多基准测试中表现出色优于同类模型,为统一科学建模提供实用路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14999 2026-07-16 cs.LG 版本更新 50%

Unlocking Latent Dimensions: Exploring Representations of Large-Scale X-ray Scattering Data using Variational Autoencoders

解锁潜在维度:使用变分自编码器探索大规模X射线散射数据的表示

Monika Choudhary, Xiaoya Chong, Runbo Jiang, Wiebke Koepp, Petrus H. Zwart, Damon English, Gregory M. Su, Eric Schaible, Chenhui Zhu, Mostafa Nassr, Noah P. Wamble, Kelvin Kam-Yun Li, Jonathan M. Chan, Jose Carlos Diaz, Cameron McKay, Lynn Katz, Benny Freeman, Guillaume Freychet, Yevgen Matviychuk, Eliot Gann, Daniel B. Allan, Benedikt Sochor, Frank Schluenzen, Stephan V. Roth, Ethan J. Crumlin, Dylan McReynolds, Tanny Chavez, Alexander Hexemer

机构 * Advanced Light Source, Lawrence Berkeley National Laboratory(劳伦斯伯克利国家实验室先进光源) Center for Advanced Mathematics for Energy Research Applications, Lawrence Berkeley National Laboratory(劳伦斯伯克利国家实验室能源研究应用高级数学中心) Molecular Biophysics & Integrated Bioimaging Division, Lawrence Berkeley National Laboratory(劳伦斯伯克利国家实验室分子生物物理学与综合生物成像部) Berkeley Synchrotron Infrared Structural Biology program, Lawrence Berkeley National Laboratory(劳伦斯伯克利国家实验室伯克利同步辐射红外结构生物学项目) Materials Sciences Division, Lawrence Berkeley National Laboratory(劳伦斯伯克利国家实验室材料科学部) McKetta Department of Chemical Engineering, University of Texas(德克萨斯大学麦凯塔化学工程系)

专题命中 其他图像生成 :image generation(abstract)

AI总结 针对X射线散射数据离线探索和实时分析两大挑战,训练领域特定注意力卷积变分自编码器(C-VAE),学习低维表示以捕捉结构变化,并集成到MLExchange平台的Latent Space Explorer中,支持交互式结构探索。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10751 2026-07-09 cs.LG 版本更新 50%

Predicting integers from continuous parameters

从连续参数预测整数

Bas Maat, Peter Bloem

机构 * Learning & Reasoning Group Vrije Universiteit Amsterdam(阿姆斯特丹自由大学学习与推理组)

专题命中 其他图像生成 :image generation(abstract)

AI总结 本文研究了从连续参数预测整数标签的问题,探讨了离散分布在整数预测中的应用,并测试了多种分布模型在不同任务中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13212 2026-07-08 cs.LG 版本更新 50%

MAME: Multidimensional Adaptive Metamer Exploration with Human Perceptual Feedback

MAME:基于人类感知反馈的多维自适应同态体探索

Mina Kamao, Hayato Ono, Ayumu Yamashita, Kaoru Amano, Masataka Sawayama

机构 * Graduate School of Information Science and Technology(信息科学与技术研究生学校) The University of Tokyo(东京大学) Graduate School of System Informatics(系统信息科学研究生学校) Kobe University(大阪大学) Hokkaido University(北海道大学) Prometech CG Research(Prometech CG研究所)

专题命中 其他图像生成 :image generation(abstract)

AI总结 该研究针对人脑网络与人工模型对齐问题,提出MAME框架,通过人类感知反馈引导在线图像生成,在单个心理物理实验中成功测量多维人类同态体空间,发现人类与CNN模型在低级处理同态体空间对齐较差,强调早期视觉计算重要性,为研究人类视觉功能提供工具。

Comments 26 pages, 12 figures. Accepted at Journal of Vision

Journal ref Journal of Vision, 26(8):1, 1-14, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00089 2026-07-02 cs.LG 新提交 50%

Representation as a Bottleneck for Mechanistic Interpretability: The Manifestation Unit Protocol

表征作为机械可解释性的瓶颈:Manifestation Unit 协议

Hussein Chouman, Wataru Sasaki, Tomokazu Matsui, Hirohiko Suwa, Keiichi Yasumoto

机构 * Ubiquitous Computing Systems Laboratory, Nara Institute of Science and Technology, Nara, Japan(奈良先端科学技术大学院大学普适计算系统实验室)

专题命中 其他图像生成 :generative vision(abstract)

AI总结 提出 Manifestation Unit 协议,将组件分析结果组织为结构化字段,通过混合检索实现可重用和可查询,在视觉和语言模型上验证了其优于非结构化基线,并揭示了核心字段。

Comments 65 pages. Interactive demos: https://manifestation-xai.github.io/manifestation-transformers/ , https://manifestation-xai.github.io/manifestation-cnn

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15338 2026-06-16 cs.RO 新提交 50%

SimWeaver: Zero-Shot RGB Sim-to-Real for Deformable Manipulation

SimWeaver:面向可变形操作的零样本RGB仿真到现实

Wenkang Hu, Haoran Wang, Yitong Li, Liu Liu, Mengao Zhao, Lai Jiang, Xincheng Tang, Junhang Wei, Zhengjie Shu, Zhendong Wang, Zhizhong Su, Huamin Wang, Ruigang Yang

机构 * Shanghai Jiao Tong University(上海交通大学) Horizon Robotics(地平线机器人) Style3D Research(Style3D研究院)

专题命中 其他图像生成 :image generation(abstract)

AI总结 提出SimWeaver框架,通过200条仿真演示训练零样本RGB VLA策略,在5种可变形任务中达到91%平均真实成功率,无需遥操作或任务校准。

详情

展开后加载摘要…

URL PDF HTML 收藏