arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-04-16 至 2026-04-16 共收录 8 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 8 篇

2604.13863 2026-04-16 cs.CV 85%

PostureObjectstitch: Anomaly Image Generation Considering Assembly Relationships in Industrial Scenarios

姿态物体拼接:考虑装配关系的异常图像生成

Zebei Tong, Hongchang Chen, Yujie Lei, Gang Chen, Yushi Liu, Zhi Zheng, Hao Chen, Jieming Zhang, Ying Li, Dongpu Cao

机构 * Beijing Institute of Technology(北京理工大学) The Hong Kong Polytechnic University(香港理工大学) Tsinghua University(清华大学)

专题命中 可控生成 :image generation(title,abstract);diffusion(abstract);image synthesis(abstract);分类 cs.CV

AI总结 本文提出PostureObjectStitch方法,通过解耦多视角图像特征和引入条件损失与几何先验,实现工业场景中考虑装配关系的准确异常图像生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13549 2026-04-16 cs.CV 81%

Reconstruction of a 3D wireframe from a single line drawing via generative depth estimation

通过生成深度估计从单张线稿中重建3D线框

Elton Cao, Hod Lipson

机构 * Creative Machines Lab, Columbia University(创意机器实验室,哥伦比亚大学)

专题命中 可控生成 :diffusion(summary_cn,abstract);分类 cs.CV

AI总结 本文提出一种生成方法,将线稿重建视为条件密集深度估计任务,利用Latent Diffusion Model和ControlNet风格的条件框架解决正投影的固有歧义,并通过图遍历的BFS掩码策略支持迭代的线稿-重建-线稿工作流,实现从稀疏2D线稿到密集3D表示的转换。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13938 2026-04-16 cs.CV 70%

ASTRA: Enhancing Multi-Subject Generation with Retrieval-Augmented Pose Guidance and Disentangled Position Embedding

ASTRA:通过检索增强的姿势引导和解纠缠位置嵌入增强多主体生成

Tianze Xia, Zijian Ning, Zonglin Zhao, Mingjia Wang

机构 * Huazhong University of Science and Technology(华中科技大学)

专题命中 可控生成 :image generation(abstract);diffusion(abstract);分类 cs.CV

AI总结 ASTRA通过检索增强的姿势引导和解纠缠位置嵌入,解决多主体生成中身份与姿势结构的分离问题,提升姿态一致性和身份保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13581 2026-04-16 cs.CV 57%

SocialMirror: Reconstructing 3D Human Interaction Behaviors from Monocular Videos with Semantic and Geometric Guidance

SocialMirror: 从单目视频中利用语义和几何引导重建3D人体交互行为

Qi Xia, Peishan Cong, Ziyi Wang, Yujing Sun, Qin Sun, Xinge Zhu, Mao Ye, Ruigang Yang, Yuexin Ma

机构 * ShanghaiTech University(上海科技大学) Nanyang Technological University(南洋理工大学) Guangzhou Institute of Energy Conversion, CAS(广州能源研究所,中国科学院) University of Science and Technology of China(中国科学技术大学) The Chinese University of Hong Kong(香港中文大学) Inceptio Technology(Inceptio科技) Shanghai Jiao Tong University(上海交通大学)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 本文提出SocialMirror框架,通过语义和几何引导解决单目视频中人体重建的挑战,实现高精度交互行为重建,展现强大的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16385 2026-04-16 cs.CV 57%

Adaptive Multi-Scale Channel-Spatial Attention Aggregation Framework for 3D Indoor Semantic Scene Completion Toward Assisting Visually Impaired

自适应多尺度通道-空间注意力聚合框架用于3D室内语义场景补全以协助视障人士

Qi He, XiangXiang Wang, Jingtao Zhang, Yongbin Yu, Hongxiang Chu, Manping Fan, JingYe Cai, Zhenglin Yang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 本文提出自适应多尺度注意力聚合框架,解决2D到3D特征提升中的噪声扩散和多尺度融合结构不稳定问题,通过通道-空间注意力机制和分层自适应门控策略提升小物体和桌子的识别精度,实验表明在NYUv2基准上mIoU达27.88%。

Comments We need to optimize the experiment, the changes are quite significant

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08992 2026-04-16 cs.CE 50%

Learning to Control PDEs with Differentiable Predictive Control and Time-Integrated Neural Operators

基于可微预测控制与时间积分神经算子的PDE控制学习

Dibakar Roy Sarkar, Ján Drgoňa, Somdatta Goswami

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出一种数据驱动的PDE控制框架,结合时间积分深度算子网络与可微预测控制,实现高效离线优化神经策略,展示在热方程、非线性Burgers方程和反应扩散方程中的应用效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13312 2026-04-16 eess.SY cs.SY 50%

Path Integral Control in Gaussian Belief Space for Partially Observed Systems

高斯信念空间中部分观测系统的路径积分控制

Goutam Das, Takashi Tanaka

专题命中 可控生成 :diffusion(abstract)

AI总结 本文将路径积分控制扩展到部分观测系统,通过高斯信念空间建模,推导了匹配条件在无限维信念空间中的失效情况,并提出MPPI-Belief算法以实现有效控制。

Comments 6 pages, Submitted to CDC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01858 2026-04-16 math.OC q-fin.PM 50%

Mean Field Game of Optimal Tracking Portfolio

均场博弈中的最优跟踪投资组合

Lijun Bo, Yijie Huang, Xiang Yu

专题命中 可控生成 :diffusion(abstract)

AI总结 本文研究了由大量基金管理人员竞争产生的均场博弈问题,引入了基于基准跟踪的相对绩效。通过连续代理模型,建立带有反射状态过程的均场博弈问题,并利用PDE方法证明了均场均衡的存在性。

详情

展开后加载摘要…

URL PDF HTML 收藏