arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-04-27 至 2026-04-27 共收录 44 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 36 篇

2604.22277 2026-04-27 cs.HC 50%

Multi-Agent Consensus as a Cognitive Bias Trigger in Human-AI Interaction

多智能体共识作为人类与人工智能交互中的认知偏差触发器

Soohwan Lee, Kyungho Lee

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究探讨多智能体系统中共识机制对人类判断的影响,发现多数共识加速意见变化并提升自信,而少数反对则促进更深入的思考,揭示了智能体共识结构在人类与AI交互中的偏差相关信号作用。

Comments ACM CHI 2026 Workshop on Understanding, Mitigating, and Leveraging Cognitive Biases to Calibrate Trust in Evolving AI Systems (CHI'26 Bias4Trust)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22224 2026-04-27 cs.CE cs.LG physics.comp-ph 50%

AI-Driven Performance-to-Design Generation and Optimization of Marine Propellers

基于人工智能的船舶螺旋桨性能到设计生成与优化

Leah Chen, Keni Chih-Hua Wu, Boon Tat Chia, Xiuqing Xing, Jian Cheng Wong

机构 * Mencast Marine, Singapore(1Mencast Marine,新加坡) Institute of High Performance Computing, Agency for Science, Technology and Research, Singapore(2高性能计算研究所,新加坡科技研究局)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出基于物理的数据生成管道和生成式AI框架,用于生成符合性能要求的螺旋桨设计,减少传统设计迭代时间,提升设计多样性。

Comments Accepted at OMAE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22209 2026-04-27 eess.AS cs.AI cs.CL cs.SD 50%

UniSonate: A Unified Model for Speech, Music, and Sound Effect Generation with Text Instructions

UniSonate:一种统一的语音、音乐和音效生成模型,通过文本指令控制

Chunyu Qiang, Xiaopeng Wang, Kang Yin, Yuzhe Liang, Yuxin Guo, Teng Ma, Ziyu Zhang, Tianrui Wang, Cheng Gong, Yushen Chen, Ruibo Fu, Chen Zhang, Longbiao Wang, Jianwu Dang

机构 * Tianjin University(天津大学) Kling Team, Kuaishou Technology(快手科技 Kling 团队) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 扩散模型 :diffusion(abstract)

AI总结 UniSonate通过统一的文本指令接口生成语音、音乐和音效,采用动态令牌注入机制和多阶段课程学习策略,提升跨模态生成性能,实现指令驱动的TTS和TTM的SOTA表现。

Comments Accepted to ACL 2026 main conference (oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22084 2026-04-27 cs.LG 50%

Generating Synthetic Malware Samples Using Generative AI

利用生成式人工智能生成合成恶意软件样本

Tiffany Bao, Kylie Trousil, Quang Duy Tran, Fabio Di Troia, Younghee Park

机构 * Department of Computer Science, Boston University(波士顿大学计算机科学系) Department of Computer Science, University of Wisconsin–La Crosse(威斯康星大学拉克罗斯分校计算机科学系) Department of Computer Science, San José State University(圣何塞州立大学计算机科学系) Silicon Valley Cybersecurity Institute(硅谷网络安全研究所) Department of Computer Engineering, San José State University(圣何塞州立大学计算机工程系)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出利用生成式人工智能生成合成恶意软件样本,以弥补不平衡数据集中的不足,通过分解恶意软件二进制样本为指令序列并利用自然语言处理提升生成对抗网络等模型的性能,实验结果显示分类性能提升显著。

Comments 12 pages, 8 figures. This paper has been published in IEEE Access, available at this URL: https://ieeexplore.ieee.org/document/10947040

Journal ref IEEE Access, vol. 13, pp. 59725-59736, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19112 2026-04-27 cs.CY 50%

Governed Auditable Decisioning Under Uncertainty: Synthesis and Agentic Extension

在不确定性下的治理可审计决策:综合与代理扩展

Oleg Solozobov

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文综合了治理证据框架,分析其在四种决策系统架构中的可迁移性,揭示了治理覆盖梯度及代理系统中的结构性断裂问题。

Comments 24 pages, 2 tables. Companion artifact: Governance Benchmark Dataset (https://doi.org/10.5281/zenodo.19248723)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08532 2026-04-27 physics.ins-det 50%

Enhanced Athermal Phonon Responsivity in a Kinetic Inductance Detector with Integrated Phonon Collectors

增强的非热声子响应率在集成声子收集器的动能电感探测器中

Leonardo Pesce, Alessio Ludovico De Santis, Martino Calvo, Matteo Cappelli, Usasi Chowdhury, Angelo Cruciani, Giorgio Del Castello, Daniele Delicato, Matteo Folcarelli, Matteo del Gallo Roccagiovine, Alessandro Monfardini, Davide Quaranta, Marco Vignati

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出改进的动能电感探测器设计,通过集成声子收集器提高非热声子响应率,实验显示声子收集效率提升了约7倍。

Comments Published version of the article

Journal ref Applied Physics Letters (Vol.128, Issue 16), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04909 2026-04-27 physics.geo-ph 50%

Fault volume digital twin to reproduce the full slip spectrum, scaling and statistical laws

断层体积数字孪生以重现完整的滑动谱、缩放和统计规律

M. Almakari, N. Kheirdast, C. Villafuerte, M. Y. Thomas, P. Dubernet, J. Cheng, A. Gupta, P. Romanet, S. Chaillat, H. S. Bhat

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文通过模拟断层带中的非断层损伤区,重现地震和地质数据中的滑动动态、缩放和统计规律,展示了统一摩擦模型在重现奥莫里定律、古特肯-里克特缩放等现象中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00965 2026-04-27 physics.ao-ph 50%

A Multi-Physics Eulerian Framework for Long-Term Contrail Evolution

一种多物理场欧拉框架用于长期云迹演化

Amin Jafarimoghaddam, Manuel Soler

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出一种多物理场欧拉框架,用于模拟云迹的长期演化,整合了时空风变、非线性扩散系数和冰晶沉降速度模型,以提高计算效率和准确性。

Comments Revised version of MultiCon: A New Large-Scale Contrail Modeling Framework

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07249 2026-04-27 quant-ph cond-mat.quant-gas cond-mat.stat-mech cond-mat.str-el 50%

Kubo-Martin-Schwinger relation for energy eigenstates of SU(2)-symmetric quantum many-body systems

SU(2)对称量子多体系统的能量本征态的Kubo-Martin-Schwinger关系

Jae Dong Noh, Aleksander Lasek, Jade LeSchack, Nicole Yunger Halpern

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文研究了SU(2)对称量子多体系统的能量本征态的KMS关系,探讨了非阿贝尔对称性对热力学的影响,并通过数值模拟验证了有限大小修正的尺度特性。

Comments 8 pages, 4 figures, 26 pages of appendices

Journal ref APL Quantum 3, 026103 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13255 2026-04-27 cs.RO 50%

Policy Contrastive Decoding for Robotic Foundation Models

基于机器人基础模型的策略对比解码

Shihan Wu, Xu Luo, Ji Zhang, Junlin Xie, Jingkuan Song, Heng Tao Shen, Lianli Gao

机构 * University of Electronic Science and Technology of China(电子科学与技术大学) Southwest Jiaotong University(西南交通大学) Tongji University(同济大学)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出Policy Contrastive Decoding方法,通过对比原始与物体遮挡的视觉输入,提升机器人策略的泛化能力,实验表明其在仿真和现实环境中均有效。

Comments ICLR 2026. Project website: https://koorye.github.io/PCD/

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 可控生成 1 篇

2602.21750 2026-04-27 cs.LG 50%

From Words to Amino Acids: Does the Curse of Depth Persist?

从词到氨基酸:深度诅咒是否依然存在?

Aleena Siji, Amir Mohammad Karimi Mamaghan, Ferdinand Kapl, Tobias Höppe, Emmanouil Angelis, Andrea Dittadi, Maurice Brenner, Michael Heinzinger, Karl Henrik Johansson, Kaitlin Maile, Johannes von Oswald, Stefan Bauer

机构 * Technical University of Munich(慕尼黑技术大学) Helmholtz AI, Munich(慕尼黑海德堡研究所人工智能部门) KTH Royal Institute of Technology(皇家理工学院) Institute of Computational Biology, Helmholtz Munich(海德堡慕尼黑计算生物学研究所) Google, Paradigms of Intelligence Team(谷歌,智能范式团队)

专题命中 可控生成 :diffusion(abstract)

AI总结 本文研究蛋白质语言模型中深度效率问题,通过分析七种主流PLM家族,发现任务相关计算集中在部分层,其余层主要提供预测细化,这一趋势在序列和多模态模型中均存在。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 个性化与一致性 1 篇

2602.21977 2026-04-27 cs.CV 83%

When LoRA Betrays: Backdooring Text-to-Image Models by Masquerading as Benign Adapters

当LoRA背叛时:通过伪装成无害适配器对文本到图像模型进行后门攻击

Liangwei Lyu, Jiaqi Xu, Jianwei Ding, Qiyao Deng

机构 * People’s Public Security University of China(中国人民公安大学)

专题命中 个性化与一致性 :text-to-image(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 研究提出MasqLoRA攻击框架,通过独立LoRA模块在文本到图像扩散模型中隐蔽注入恶意行为,实验显示其攻击成功率高达99.8%。

Comments Accepted to CVPR 2026 main track(poster)

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 图像生成评测 1 篇

2604.22296 2026-04-27 cs.CV 57%

Evaluation of image simulation open source solutions for simulation of synthetic images in lunar environment

月球环境下的图像模拟开源解决方案评估

Jai G Singla, Hinal B Patel, Nitant Dube

机构 * Space Applications centre(空间应用中心) Indian Space Research Organization(印度空间研究组织)

专题命中 图像生成评测 :image generation(abstract);分类 cs.CV

AI总结 本文评估了用于生成月球环境合成图像的开源解决方案,重点分析不同相机模型和光照条件对图像质量的影响,以提高自主导航和决策系统在月球探索中的可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 效率与蒸馏 1 篇

2604.22379 2026-04-27 cs.CV 79%

Efficient Diffusion Distillation via Embedding Loss

通过嵌入损失高效扩散蒸馏

Jincheng Ying, Yitao Chen, Li Wenlin, Minghui Xu, Yinhao Xiao

机构 * School of Big Data and Artificial Intelligence(大数据与人工智能学院) Guangdong University of Finance and Economics(广东金融学院) School of Computer Science(计算机科学学院) Shandong University(山东大学)

专题命中 效率与蒸馏 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出嵌入损失,通过特征嵌入对齐提升生成质量并加速训练,实验表明在CIFAR-10等数据集上取得SOTA结果,同时减少训练迭代次数。

详情

展开后加载摘要…

URL PDF HTML 收藏