arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 1207 信号源:cs.CV, cs.GR, cs.MM

1. 图像生成评测 1207 篇

2606.09705 2026-06-09 cs.LG cond-mat.stat-mech 新提交 50%

When Do Local Score Models Extrapolate Across Size? A Diagnostic Theory and Benchmark

局部评分模型何时能跨尺寸外推?诊断理论与基准

Wenjie Xi

机构 * The University of Hong Kong(香港大学) Department of Physics and HK Institute of Quantum Science & Technology(物理系与香港量子科学与技术研究所)

专题命中 图像生成评测 :diffusion(abstract)

AI总结 提出诊断理论,证明局部模型能否稳定外推取决于高斯平滑评分的准局部性,并引入有限深度局部流(FDLF)基准进行验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08903 2026-06-09 cs.LG 新提交 50%

Synthetic but Not Realistic: The Evaluation Challenge in Generative Modelling for Structured Electronic Medical Records

合成但不真实:结构化电子病历生成建模中的评估挑战

Nicholas I-Hsien Kuo, Blanca Gallego, Louisa Jorm

机构 * Centre for Big Data Research in Health, the University of New South Wales(新南威尔士大学健康大数据研究中心)

专题命中 图像生成评测 :diffusion(abstract)

AI总结 针对合成电子病历评估过度依赖统计相似性而忽视临床有效性的问题,提出基于流行病学的多维度评估框架,发现当前生成模型虽能复现边缘分布,但无法同时保持亚组结构、效应估计和依赖关系,导致评估高估数据质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08736 2026-06-09 cs.LG cs.DB 新提交 50%

Declarative Outcome-Conformant Synthesis: Exact, Closed-Form Specification Satisfaction and a Conformance Benchmark

声明性结果一致性合成:精确、闭式规范满足及一致性基准

Muhammed Rasin

机构 * Independent Researcher(独立研究员)

专题命中 图像生成评测 :diffusion(abstract)

AI总结 针对无源数据下精确满足声明性分析结果的需求,提出结果一致性合成任务,通过闭式条件伽马抽样实现精确聚合,并构建SpecBench基准,证明一致性保真度正交。

Comments 22 pages, 1 figure. Benchmark and reference implementation (MIT): https://github.com/rasinmuhammed/misata

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06412 2026-06-05 cond-mat.dis-nn quant-ph stat.ML 50%

Nonreversible Gauge Fields in Fokker--Planck Dynamics: Supersymmetric Hamiltonians and Learned Finite Forces

福克-普朗克动力学中的不可逆规范场:超对称哈密顿量与学习到的有限力

Masayuki Ohzeki

专题命中 图像生成评测 :diffusion(abstract)

AI总结 本文通过规范场形式化描述保持稳态密度的不可逆扰动,将福克-普朗克动力学与超对称哈密顿量联系起来,并引入有限时间正则化目标与演员-评论家程序学习最优规范场。

Comments 33 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08318 2026-06-05 cs.LG cs.AI cs.NA math.NA physics.comp-ph stat.ML 50%

When Attention Beats Fourier: Multi-Scale Transformers for PDE Solving on Irregular Domains

当注意力胜过傅里叶:用于不规则域上的PDE求解的多尺度变换器

Brandon Yee, Pairie Koh, Jack Rodriguez, Mihir Tekal

机构 * Physics Lab, Yee Collins Research Group(Yee Collins研究组物理实验室)

专题命中 图像生成评测 :diffusion(abstract)

AI总结 本文研究了深度学习模型在求解偏微分方程(PDE)时的架构选择问题,探讨了基于学习注意力的变换器架构在何时优于傅里叶域神经算子。引入了多尺度注意力变换器(MSAT),该架构将时空解的历史编码为令牌序列,并通过复合监督目标进行端到端训练。在五个基准问题上,与九种基线方法(包括物理信息神经网络、神经算子和状态空间模型)进行了全面的实证评估,展示了在复杂几何问题上的最佳泛化能力。

Comments Substantial Revision Required

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03555 2026-06-05 cs.MA cs.AI cs.SI 50%

Benchmarking Emergent Coordination in Large-Scale LLM Populations: An Evaluation Framework on the MoltBook Archive

在大规模大语言模型群体中评估涌现协调:对MoltBook档案库的评估框架

Brandon Yee, Pairie Koh

机构 * Management Lab, Yee Collins Research Group(Yee Collins研究组管理实验室)

专题命中 图像生成评测 :diffusion(abstract)

AI总结 本文提出了一种评估框架,用于在开放代理环境中评估角色专业化、信息扩散和协作任务解决的涌现协调,通过MoltBook档案库的数据集展示了该框架,并建立了量化基准,揭示了核心-外围结构、重尾级联分布和去中心化任务解决中的严重协调开销。

Comments Substantial Revision Required

详情

展开后加载摘要…

URL PDF HTML 收藏
1709.08597 2026-06-04 math.NA cs.NA 50%

An adaptive reduced basis collocation method based on PCM ANOVA decomposition for anisotropic stochastic PDEs

基于PCM ANOVA分解的自适应降阶校准方法用于各向异性随机PDEs

Heyrim Cho, Howard C. Elman

专题命中 图像生成评测 :diffusion(abstract)

AI总结 本文提出一种基于PCM ANOVA分解的自适应降阶校准方法,用于求解高维参数化随机PDEs,通过两阶段适应性策略有效识别有效维度并优化参数空间,验证了该方法在求解各向异性随机对流-扩散方程中的有效性。

详情
URL PDF HTML 收藏
1905.13012 2026-06-04 cs.CE cs.NA math.NA 50%

Evaluation of the reliability of building energy performance models for parameter estimation

建筑能耗性能模型可靠性评估:用于参数估计的可靠性评估

Julien Berger, Denys Dutykh

专题命中 图像生成评测 :diffusion(abstract)

AI总结 本文研究了两种数学模型在建筑墙体热损失模拟中用于参数估计的可靠性,发现DuFort-Frankel模型在估计未知参数时具有很高的可靠性,而RC模型则存在显著的不准确性。

Comments 29 pages, 20 figures, 4 tables, 1 appendix, 29 references. Other author's papers can be downloaded at http://www.denys-dutykh.com/

Journal ref Computational Technologies (2019), Vol. 24, Number 3, pp. 4-32

详情

展开后加载摘要…

URL PDF HTML 收藏
1808.10580 2026-06-04 math.NA cs.NA 50%

GPU-Accelerated Particle Methods for Evaluation of Sparse Observations for PDE-Constrained Inverse Problems

用于PDE约束反问题稀疏观测评估的GPU加速粒子方法

Jeff Borggaard, Nathan E. Glatt-Holtz, Justin A. Krometis

专题命中 图像生成评测 :diffusion(abstract)

AI总结 本文提出两种粒子方法,利用反问题的结构高效计算正向映射,适用于时间演化问题和狄利克雷边界值问题,并通过数值示例展示了其在贝叶斯推断和数值优化中的应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
1803.07668 2026-06-04 math.NA cs.NA 50%

Hybrid asymptotic/numerical methods for the evaluation of layer heat potentials in two dimensions

二维层热势评估的混合渐近/数值方法

Jun Wang, Leslie Greengard

专题命中 图像生成评测 :diffusion(abstract)

AI总结 本文提出一种混合渐近/数值方法,用于准确计算二维单层和双层热势,通过局部渐近近似与高斯核边界积分运算结合,克服几何诱导刚性,适用于移动几何体。

Comments 16 pages, 3 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1709.06466 2026-06-04 math.OC cs.NA math.NA 50%

Evaluation of the Rate of Convergence in the PIA

PIA收敛速率的评估

Jun Maeda, Saul D. Jacka

专题命中 图像生成评测 :diffusion(abstract)

AI总结 本文在更一般的设定下证明了PIA算法的收敛速率,解释了其快速收敛的原因,并通过数值例子验证了算法对解析解的逼近效果。

Comments 11 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1506.04255 2026-06-04 math.OC cs.SY eess.SY 50%

Entropic and displacement interpolation: a computational approach using the Hilbert metric

熵与位移插值:一种利用希尔伯特度量的计算方法

Yongxin Chen, Tryphon T. Georgiou, Michele Pavon

专题命中 图像生成评测 :diffusion(abstract)

AI总结 本文提出利用希尔伯特度量的计算方法,为熵插值和最优质运输提供新证明和高效计算方案,通过图像密度插值示例展示其有效性。

Comments 20 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03312 2026-06-03 cs.RO cs.AI 50%

RobotValues: Evaluating Household Robots When Human Values Conflict

RobotValues: 当人类价值观冲突时评估家用机器人

Jongwook Han, Hyeongjin Kim, Yohan Jo

机构 * Graduate School of Data Science, Seoul National University(首尔国立大学数据科学研究生院)

专题命中 图像生成评测 :image generation(abstract)

AI总结 提出RobotValues基准,通过10K个价值冲突场景评估家用机器人规划器,发现视觉语言模型存在默认价值偏好且难以覆盖,表明评估需考虑价值冲突下的行动选择。

详情

展开后加载摘要…

URL PDF HTML 收藏
1212.0970 2026-06-03 math.NA cs.NA 50%

Accurate and efficient evaluation of the a posteriori error estimator in the reduced basis method

降基方法中后验误差估计子的精确高效评估

Fabien Casenave, Alexandre Ern, Tony Lelièvre

专题命中 图像生成评测 :diffusion(abstract)

AI总结 针对降基方法中后验误差界对舍入误差敏感的问题,提出基于经验插值法(EIM)的新近似公式,提高了精度并减少了预计算量。

Comments 26 pages, 10 figures. ESAIM: Mathematical Modelling and Numerical Analysis, 2013

Journal ref M2AN Math. Model. Numer. Anal. 48 (2014), 207-229

详情

展开后加载摘要…

URL PDF HTML 收藏
1203.1715 2026-06-03 cs.DC cs.NA math.DS math.NA 50%

D-iteration: Evaluation of a Dynamic Partition Strategy

D-iteration: 动态分区策略的评估

Dohy Hong

专题命中 图像生成评测 :diffusion(abstract)

AI总结 本文评估了一种基于D-iteration方法的动态分区策略,该策略能在分布式计算中线性降低内存并接近线性加速,同时无需深入分析矩阵或图结构即可均衡计算负载。

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
1202.6168 2026-06-03 math.NA cs.DC cs.NA 50%

D-iteration: Evaluation of the Asynchronous Distributed Computation

D-迭代:异步分布式计算的评估

Dohy Hong

专题命中 图像生成评测 :diffusion(abstract)

AI总结 本文评估了基于流体扩散的D-迭代方法在异步分布式计算中的性能,实验表明该方法在K台虚拟机上可实现内存线性减少和计算速度几乎线性提升。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
1202.6136 2026-06-03 cs.DM cs.NA math.NA 50%

D-iteration: evaluation of the update algorithm

D-迭代:更新算法的评估

Dohy Hong

专题命中 图像生成评测 :diffusion(abstract)

AI总结 本文分析基于流体扩散的D-迭代方法中更新算法的增益,通过真实数据集实验展示其在图演化场景下提升计算效率。

Comments 5 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02287 2026-06-02 cs.LG cs.AI 50%

CityTrajBench: A Unified Benchmark for City-Scale Vehicle Trajectory Generation

CityTrajBench: 城市尺度车辆轨迹生成的统一基准

Shibo Zhu, Xiaodan Shi, Dayin Chen, Yuntian Chen, Haoran Zhang, Tianhao Wu, Jinyue Yan

机构 * Department of Building Environment and Energy Engineering, The Hong Kong Polytechnic University, Hong Kong SAR, China(香港理工大学建筑环境与能源工程系) Eastern Institute for Advanced Study, Eastern Institute of Technology, Ningbo, China(宁波东部先进研究所) International Centre of Urban Energy Nexus, The Hong Kong Polytechnic University, Hong Kong SAR, China(香港理工大学城市能源 nexus 中心) Department of Computer and Systems Sciences, Stockholm University, Sweden(斯德哥尔摩大学计算机与系统科学系) Zhejiang Key Laboratory of Industrial Intelligence and Digital Twin, Eastern Institute of Technology, Ningbo, China(浙江工业智能与数字孪生重点实验室) Ningbo Institute of Digital Twin, Eastern Institute of Technology, Ningbo, China(宁波数字孪生研究所) LocationMind Inc., Tokyo 101-0042, Japan(LocationMind公司)

专题命中 图像生成评测 :diffusion(abstract)

AI总结 为解决轨迹生成方法因数据集、预处理、表示和评估指标不一致导致的比较困难,提出CityTrajBench统一基准框架,标准化数据处理、模型适配与多级评估,并在三个真实数据集上对比统计、VAE、GAN、扩散和流匹配模型,揭示不同模型在全局真实性、轨迹几何保真度等指标上的权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10056 2026-06-02 cs.LG stat.ML 50%

WildCat: Near-Linear Attention in Theory and Practice

WildCat: 理论与实践中近乎线性的注意力机制

Tobias Schröder, Lester Mackey

机构 * University of Cambridge(剑桥大学)

专题命中 图像生成评测 :image generation(abstract)

AI总结 提出WildCat方法,通过随机枢轴Cholesky算法选择加权核心集,在近线性时间内以超多项式误差衰减近似精确注意力,并应用于图像生成、分类和语言模型KV缓存压缩。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17502 2026-06-02 cs.RO 50%

RynnVLA-002: A Unified Vision-Language-Action and World Model

RynnVLA-002: 统一的视觉-语言-动作与世界模型

Jun Cen, Siteng Huang, Yuqian Yuan, Kehan Li, Hangjie Yuan, Chaohui Yu, Bohan Hou, Yuming Jiang, Jiayan Guo, Xin Li, Hao Luo, Fan Wang, Deli Zhao, Hao Chen

机构 * DAMO Academy, Alibaba Group(达摩院,阿里巴巴集团) Hupan Lab(虎扑实验室) Zhejiang University(浙江大学)

专题命中 图像生成评测 :image generation(abstract)

AI总结 提出统一视觉-语言-动作(VLA)与世界模型的框架RynnVLA-002,通过联合学习环境动态和动作规划,在仿真和真实机器人任务中显著提升成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30807 2026-06-01 cs.LG 50%

Conformal Reliability: A New Evaluation Metric for Conditional Generation

共形可靠性:条件生成的新评估指标

Yachen Gao, Xinwei Sun, Yikai Wang, Ye Shi, Jingya Wang, Jianfeng Feng, Yanwei Fu

机构 * Institute of Science and Technology for Brain-Inspired Intelligence(脑启发式智能科学与技术研究院) Shanghai Innovation Institute(上海创新研究院) School of Data Science(数据科学学院) Nanyang Technological University(南洋理工大学) School of Information Science and Technology(信息科学与技术学院)

专题命中 图像生成评测 :text-to-image(abstract)

AI总结 提出基于共形预测的可靠性分数作为条件生成模型的新评估指标,并开发CReL框架高效计算该分数,实验证明其有效性和可解释性。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09936 2026-06-01 cs.LG 50%

Generative Drifting is Secretly Score Matching: a Spectral and Variational Perspective

生成性漂移实际上是分数匹配:一个谱与变分视角

Erkan Turan, Nicolas Dufour, Maks Ovsjanikov

机构 * LIX, Ecole Polytechnique, IP Paris(巴黎高等理工学院信息研究所)

专题命中 图像生成评测 :image generation(abstract)

AI总结 本文通过揭示高斯核下漂移算子等价于平滑分布上的分数差,将生成性漂移方法纳入分数匹配框架,并利用谱分析和变分方法解决了原始工作中的三个遗留问题,同时提出了指数带宽退火策略和基于JKO方案的停止梯度算子理论依据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29005 2026-05-29 cs.LG cs.AI 50%

LoRe: Adaptive Interaction-Evaluation Routing with Per-Step Interaction Budgets for Iterative Graph Solvers

LoRe: 基于每步交互预算的自适应交互评估路由用于迭代图求解器

Jintao Li, Yong-Yi Wang, Zheng-An Wang, Heng Fan

机构 * Beijing Key Laboratory of Fault-Tolerant Quantum Computing, Beijing Academy of Quantum Information Sciences, Beijing, China(北京容错量子计算重点实验室,量子信息科学北京市院,北京,中国) Beijing National Laboratory for Condensed Matter Physics, Institute of Physics, CAS, Beijing, China(北京凝聚态物理国家实验室,物理研究所,中国科学院,北京,中国) Beijing Key Laboratory of Advanced Quantum Technology, Beijing, China(北京先进量子技术重点实验室,北京,中国) Hefei National Laboratory, Hefei, China(合肥国家实验室,合肥,中国)

专题命中 图像生成评测 :diffusion(abstract)

AI总结 提出LoRe方法,通过动态路由计算到高冲突或高不确定性交互,实现每步固定比例交互评估,在不牺牲解质量的前提下显著提升迭代图求解器的可扩展性和速度。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04876 2026-05-28 cs.SD 50%

ChronosAudio: A Comprehensive Long-Audio Benchmark for Evaluating Audio-Large Language Models

ChronosAudio: 用于评估音频大语言模型的综合长音频基准

Kaiwen Luo, Liang Lin, Yibo Zhang, Moayad Aloqaily, Jialiang Tao, Dexian Wang, Zhenhong Zhou, Junwei Zhang, Kun Wang, Li Sun, Qingsong Wen

机构 * Nanyang Technological University(南洋理工大学) Independent Researcher(独立研究者) United Arab Emirates University(阿联酋大学) North China Electric Power University(华北电力大学) Southwest Jiaotong University(西南交通大学) Squirrel AI Learning(Squirrel AI学习)

专题命中 图像生成评测 :diffusion(abstract)

AI总结 提出首个针对音频大语言模型长音频理解的多任务基准ChronosAudio,包含6大任务类别和36000个测试实例,实验发现模型存在长上下文崩溃、注意力稀释等问题,现有缓解策略仅恢复50%性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26741 2026-05-27 cond-mat.mtrl-sci cs.AI 50%

MatFormBench: A Benchmarking Evaluation Framework for Target-Driven Materials Formulation

MatFormBench: 一个面向目标驱动材料配方的基准评估框架

Linhan Wu, Chenxi Wang, Chuhan Yang, Zhengwei Yang, Yuyang Liu

机构 * DeepVerse

专题命中 图像生成评测 :diffusion(abstract)

AI总结 针对现有材料机器学习基准仅关注正向属性预测而缺乏逆向优化评估的问题,提出MatFormBench基准框架,集成物理驱动配方生成方案与多维度评分指标,系统评估39种逆向设计算法。

Comments 26 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24658 2026-05-26 cs.LG 50%

WLNO: Wavelet-Laplace Neural Operator for Solving Partial Differential Equations

WLNO: 用于求解偏微分方程的小波-拉普拉斯神经算子

Muhammad Abid, Arth Sojitra, Omer San

机构 * Department of Mechanical and Aerospace Engineering, University of Tennessee, Knoxville(田纳西大学机械与航空航天工程系)

专题命中 图像生成评测 :diffusion(abstract)

AI总结 提出WLNO,通过融合Haar小波多尺度空间分解与拉普拉斯神经算子的极点-留数公式,在五个基准PDE问题上优于LNO,尤其擅长处理具有强空间多尺度结构的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21682 2026-05-22 astro-ph.SR astro-ph.GA 50%

The Absolute Age of the Open Cluster NGC 6791 and Its Implications for Galactic Archaeology and Asteroseismic Calibration

NGC 6791 开放星团的绝对年龄及其对银河考古和恒星震颤校准的启示

George Dufresne, Brian Chaboyer, Rayna Rampalli

专题命中 图像生成评测 :diffusion(abstract)

AI总结 本文通过结合Gaia DR3光度数据和NGC 6791中的分离食双星,利用10,000个蒙特卡洛等时线集确定了NGC 6791的绝对年龄,揭示了其年龄、金属丰度和距离模等参数,并探讨了其对银河考古和恒星震颤校准的影响。

Comments Accepted to ApJ

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19382 2026-05-20 cs.AI 50%

PRISM: A Benchmark for Programmatic Spatial-Temporal Reasoning

PRISM:一个程序化空间-时间推理的基准测试

Qiran Zhang, Yuheng Wang, Runde Yang, Lin Wu, Jingru Fan, Shu Yao, Jie Zhang, Tianle Zhou, Huatao Li, Ruijie Shi, Yihan Li, Chen Qian

机构 * School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院)

专题命中 图像生成评测 :diffusion(abstract)

AI总结 本文提出PRISM基准测试,通过大规模人类校准的指令-代码对(共10,372个,比之前基准大20倍),评估语言模型生成空间正确动画输出的能力,并揭示执行成功率与空间正确率之间的显著差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17804 2026-05-20 cs.LG eess.SP 50%

GenTS: A Comprehensive Benchmark Library for Generative Time Series Models

GenTS:生成时间序列模型的综合基准库

Chenxi Wang, Xiaorong Wang, Peiyang Li, Yi Wang

机构 * The University of Hong Kong(香港大学) Fudan University(复旦大学)

专题命中 图像生成评测 :diffusion(abstract)

AI总结 本文提出GenTS,一个用于系统评估生成时间序列模型的综合且可扩展的基准库,通过统一的数据预处理流程、多样化的模型集合和全景评估指标,为生成模型提供了更灵活的评估框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03280 2026-05-19 cs.LG cs.AI 50%

BlendedNet++: A dataset and benchmark for field-resolved aerodynamics and inverse design of blended wing body aircraft

BlendedNet++:一种用于混合翼身融合飞机场解气动学和逆设计的数据集和基准

Nicholas Sung, Steven Spreizer, Mohamed Elrefaie, Matthew C. Jones, Faez Ahmed

机构 * Massachusetts Institute of Technology(麻省理工学院) MIT Lincoln Laboratory(麻省理工学院林肯实验室)

专题命中 图像生成评测 :diffusion(abstract)

AI总结 本文提出BlendedNet++数据集,包含12492种独特的BWB几何体,通过RANS模拟提供集成力和密集表面场,利用几何深度学习模型实现实时气动预测和生成性逆设计,验证了Transolver在场预测中的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏