arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-06-25 至 2026-06-25 共收录 48 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 1 篇

2606.25297 2026-06-25 cs.CV 新提交 79%

Minimalist Preprocessing Approach for Image Synthesis Detection

图像合成检测的极简预处理方法

Hoai-Danh Vo, Trung-Nghia Le

机构 * University of Science, VNU-HCM(胡志明市国立大学理科大学) Vietnam National University, Ho Chi Minh City(胡志明市国立大学)

专题命中 文生图 :image synthesis(title);image generation(abstract);分类 cs.CV

AI总结 提出一种基于梯度计算相邻像素波动的轻量级预处理方法,作为高通滤波器突出关键特征,在低端设备上实现与先进技术相当的检测精度。

Comments SOICT 2024

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 扩散模型 41 篇

2606.25740 2026-06-25 cs.CV cs.AI 新提交 79%

Point Cloud Diffusion with Global and Local Reconstruction for Instance-Level 3D Anomaly Detection

基于全局与局部重建的点云扩散用于实例级3D异常检测

Linchun Wu, Qin Zou, Jiwen Lu, Qingquan Li

机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) Department of Automation, Tsinghua University(清华大学自动化系) Guangdong Artificial Intelligence and Digital Economy Laboratory (SZ)(广东人工智能与数字经济实验室(深圳))

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 提出PCDiff框架,通过实例级多模态条件生成弱缺陷异常,并采用联合局部-全局重建算法恢复前景缺陷同时保持背景正常结构,在3D异常检测中显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25736 2026-06-25 cs.CV 新提交 79%

UniTeD: Unified Temporal Diffusion for Joint Perception and Planning in Autonomous Driving

UniTeD: 面向自动驾驶联合感知与规划的时域统一扩散模型

Bo Zhao, Xinting Zhao, Naifan Li, Erkang Cheng, Haibin Ling

机构 * Nullmax Westlake University(西湖大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 提出UniTeD框架,通过共享生成空间的迭代去噪统一建模感知与规划,引入时域过渡模块和锚点刷新策略,在多个基准上达到最先进性能。

Comments Accept to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25545 2026-06-25 cs.CV 新提交 79%

TensorLDM: A Component-Wise Latent Diffusion Model for Volumetric DTI Reconstruction from Sparse DWIs

TensorLDM: 一种用于从稀疏DWI重建体积DTI的组件式潜在扩散模型

Junhyeok Lee, Kyu Sung Choi

机构 * Interdisciplinary Program in Cancer Biology, Seoul National University College of Medicine(首尔大学医学院癌症生物学跨学科项目) Department of Radiology, Seoul National University Hospital(首尔大学医院放射科) Department of Radiology, Seoul National University College of Medicine(首尔大学医学院放射科) Healthcare AI Research Institute, Seoul National University Hospital(首尔大学医院医疗AI研究所)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 提出TensorLDM,一种组件式潜在扩散模型,通过分组编码器、解剖条件自编码器、跨组件注意力和专家混合条件机制,从稀疏DWI中重建扩散张量,在HCP数据集上实现高精度和物理有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25535 2026-06-25 cs.CV 新提交 79%

Spatio-Temporal Mixture-of-Modality-Experts Diffusion for Quantitative DCE-MRI Synthesis from Incomplete MR Sequences

时空模态专家混合扩散:从不完整MR序列合成定量DCE-MRI

Junhyeok Lee, Kyu Sung Choi

机构 * Interdisciplinary Program in Cancer Biology, Seoul National University College of Medicine(首尔大学医学院癌症生物学跨学科项目) Department of Radiology, Seoul National University Hospital(首尔大学医院放射科) Department of Radiology, Seoul National University College of Medicine(首尔大学医学院放射科) Healthcare AI Research Institute, Seoul National University Hospital(首尔大学医院医疗人工智能研究所)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 提出时空模态专家混合(ST-MoME)条件扩散框架,通过时空门控网络融合多模态专家特征,从任意子集合成3D DCE参数图,在386例脑肿瘤数据上16种缺失场景下取得最优NMSE。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25390 2026-06-25 cs.CV cs.AI 新提交 79%

Anatomically-conditioned Latent Diffusion Model for Data-Efficient Few-Shot Cross-Domain 3D Glioma MRI Synthesis

解剖条件约束的潜在扩散模型用于数据高效的小样本跨域3D胶质瘤MRI合成

Salman Shaik, Truong Thanh Hung Nguyen, Hung Cao

机构 * Analytics Everywhere Lab, University of New Brunswick, Canada(新不伦瑞克大学分析无处不在实验室,加拿大)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 提出解剖条件约束的潜在扩散模型(ALDM),通过两阶段框架(3D变分自编码器学习解剖先验,ControlNet引导的潜在扩散生成结构一致体积)在仅16张目标图像的小样本设置下优于GAN基线,实现FID 85.40和分类AUC 0.987。

Comments Published in Canadian AI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25255 2026-06-25 cs.CV 新提交 79%

Cross-Modality Structural Guidance in 3D Latent Diffusion for Robust FLAIR Super-Resolution

跨模态结构引导的3D潜在扩散用于鲁棒FLAIR超分辨率

Haoyu Lan, Jiazhen Zhang, John Onofrey, Bino Varghese, Nasim Sheikh-Bahaei, Arthur W. Toga, Jeiran Choupan

机构 * University of Southern California(南加州大学) Yale University(耶鲁大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 提出MR-DiffuSR框架,利用HR T1w结构先验通过跨模态结构swin注意力引导厚层FLAIR超分辨率,采用混合尺度退化策略和DINOv3感知损失,在ADNI-4数据集上优于CNN和2D扩散方法,并在下游白质高信号分割中保持鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25754 2026-06-25 cs.RO 新提交 78%

Stage-Aware and Roughness-Constrained Diffusion Policy for Multi-Stage Robotic Polishing

阶段感知与粗糙度约束的扩散策略用于多阶段机器人抛光

Shuai Ke, Jiexin Zhang, Huan Zhao, Zhiao Wei, Yikun Guo, Tiange Wu, Guoqiang Guo, Haoyuan Zhou, Jie Pan, Han Ding

机构 * State Key Laboratory of Intelligent Manufacturing Equipment and Technology, Huazhong University of Science and Technology(华中科技大学智能制造装备与技术国家重点实验室) Shanghai Spaceflight Precision Machinery Institute(上海航天精密机械研究所)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 提出阶段感知与粗糙度约束扩散策略(SRDP),通过多模态观测推断阶段后验并约束去噪过程,实现无外部标签的阶段一致动作生成,提升多阶段抛光质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25331 2026-06-25 cs.CL cs.AI cs.LG 新提交 78%

Improved Large Language Diffusion Models

改进的大规模语言扩散模型

Shen Nie, Qiyang Min, Shaoxuan Xu, Zihao Huang, Yuxuan Song, Yong Shan, Yankai Lin, Wayne Xin Zhao, Chongxuan Li, Ji-Rong Wen

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学高瓴人工智能学院) Beijing Key Laboratory of Research on Large Models and Intelligent Governance(北京市大模型与智能治理重点实验室) Engineering Research Center of Next-Generation Intelligent Search and Recommendation, MOE(教育部新一代智能搜索与推荐工程研究中心) ByteDance Seed(字节跳动Seed)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 提出iLLaDA,一种8B参数的全双向注意力掩码扩散语言模型,从零训练至12T tokens,在通用、数学和代码基准上显著优于LLaDA,并可与Qwen2.5 7B竞争。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24982 2026-06-25 cs.LG stat.ML 新提交 78%

Latent Block-Diffusion Temporal Point Processes: A Semi-Autoregressive Framework for Asynchronous Event Sequence Generation

潜在块扩散时间点过程:一种用于异步事件序列生成的半自回归框架

Shuai Zhang, Yancheng Chen, Chuan Zhou, Yang Liu, Xixun Lin, Xiangyu Zhao, Jun Zhu, Zhi-Ming Ma

机构 * Academy of Mathematics and Systems Science, Chinese Academy of Sciences(中国科学院数学与系统科学研究院) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) Department of Data Science, City University of Hong Kong(香港城市大学数据科学系) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 提出潜在块扩散时间点过程(LBDTPP),通过潜在空间中的块级自回归和块内高斯扩散,实现可变长度、高质量的事件序列生成,理论证明可减少误差累积,实验优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25783 2026-06-25 math.AP 新提交 78%

Non-uniqueness of weak solutions to cross-diffusion systems with advection

具有平流的交叉扩散系统弱解的非唯一性

José A. Carrillo, Ansgar Jüngel, Jakub Skrzeczkowski, Yao Yao

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 研究一维全线上两个分离种群交叉扩散系统的弱解非唯一性,通过构造两种不同解(完全分离与有限时间后混合),首次给出该类方程非唯一性示例并展示混合现象。

Comments 29 pages + bibliography

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25520 2026-06-25 math.NA cs.NA 新提交 78%

Efficient Krylov solvers for inverse source problem in 2D space-time fractional diffusion equation

二维时空分数阶扩散方程逆源问题的高效Krylov求解器

Asim Ilyas, Stefano Serra-Capizzano

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 针对二维变系数时空分数阶扩散方程的逆源问题,采用拟边界正则化方法,通过GLT理论分析离散矩阵谱性质并构造多级Toeplitz-like预条件子,加速GMRES收敛。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25339 2026-06-25 math.AP 新提交 78%

Propagation phenomena of spatially periodic combustion reaction-diffusion equations around an obstacle

障碍物周围空间周期燃烧反应扩散方程的传播现象

Yang Long, Jia-Fang Zhang, Wei-Jie Sheng

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 研究外部域中空间周期燃烧反应扩散方程的传播现象,证明存在源于脉动前沿的整体解,并建立其作为过渡前沿的性质及渐近行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25991 2026-06-25 cond-mat.mtrl-sci 新提交 78%

Capturing Nuclear Quantum Effects in Hydrogen Diffusion through MoS2 via Machine-Learning-Enhanced Path-Integral Simulations

通过机器学习增强的路径积分模拟捕捉MoS2中氢扩散的核量子效应

Ismail Eren, Ege Yigit Erbil, Maria-Judith Caisachana-Lozada, Hossein Mirhosseini, Thomas D. Kühne, Agnieszka B. Kuc

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本研究利用机器学习增强的路径积分模拟,结合r2SCAN+rVV10密度泛函理论数据训练的原子间势,研究了MoS2中氢和氘的扩散,揭示了核量子效应显著降低自由能垒、增强扩散系数,并表现出明显的动力学同位素效应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25429 2026-06-25 cond-mat.soft 新提交 78%

Suppression of Active Super-Diffusion: Impact of String Defects and Canted Multi-Domains

活性超扩散的抑制:弦缺陷与倾斜多域的影响

Ritik Rajak, Manish Agarwal, Sanjay Puri, Varsha Banerjee

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 通过广义Lebwohl-Lasher模型和朗之万动力学模拟,研究活性布朗粒子在液晶中的输运,发现均匀向列相中的超扩散被拓扑缺陷抑制。

Comments 10 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24369 2026-06-25 cs.AI cs.DC cs.NI cs.PF 新提交 78%

Accelerating Disaggregated RL for Visual Generative LLMs with Diffusion-Based Parallelism and Trainer-Assisted Generation

加速面向视觉生成式大语言模型的解耦强化学习:基于扩散并行与训练器辅助生成

Sijie Wang, Zhengyu Qing, Zhiqiang Tan, Yiming Yin, Yeqing Zhang, Yaoyuan Wang, Qiang Wang, Xiaowen Chu, Shaohuai Shi

机构 * School of Computer Science and Technology, Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)计算机科学与技术学院) Data Science and Analytics Thrust, The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)数据科学与分析学域) Huawei Technologies Ltd.(华为技术有限公司)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 提出解耦强化学习框架DigenRL,通过生成轴流水线、时间步并行和弹性训练器辅助生成,解决扩散生成式大语言模型中执行气泡问题,实现1.56-2.10倍吞吐提升。

Comments Withdrawn by the authors pending resolution of intellectual property and institutional disclosure requirements

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16417 2026-06-25 cs.SD eess.AS 新提交 78%

Joycent: Diffusion-based Accent TTS without Accented Phone Prediction

Joycent: 基于扩散的口音语音合成,无需口音音素预测

Xintong Wang, Ye Wang

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 提出Joycent,一种基于扩散模型的口音TTS方法,直接从标准音素序列和语音参考合成口音语音,无需口音音素预测,通过条件层归一化集成口音和说话人表征,并引入WhisAID口音识别模型,在保持说话人身份的同时提升口音自然度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06739 2026-06-25 math.PR 新提交 78%

The relationship between the transition functions of the labeled and unlabeled versions of the infinitely-many-neutral-alleles diffusion model

标记与未标记的无穷多中性等位基因扩散模型的转移函数之间的关系

S. N. Ethier

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文从标记的无穷多中性等位基因扩散模型的转移函数出发,简化推导了未标记模型的转移函数。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25234 2026-06-25 cs.CV 新提交 70%

Structuring Sparsity: Block-Sparse Featurizers Capture Visual Concept Manifolds

结构化稀疏:块稀疏特征化器捕获视觉概念流形

Thomas Fel, Matthew Kowal, Mozes Jacobs, Dron Hazra, Usha Bhalla, Lee Sharkey, Lucius Bushnaq, Satchel Grant, Tal Haklay, Thomas Icard, Can Rager, Michael Pearce, Daniel Wurgaft, Aiden Swann, Fenil Doshi, Siddharth Boppana, Curt Tigges, Nick Cammarata, Thomas Serre, Vasudev Shyam, Owen Lewis, Thomas McGrath, Jack Merullo, Ekdeep Singh Lubana, Atticus Geiger

机构 * Goodfire Harvard University(哈佛大学) Stanford University(斯坦福大学) Brown University(布朗大学)

专题命中 扩散模型 :image generation(abstract);diffusion(abstract);分类 cs.CV

AI总结 提出块稀疏特征化器(BSF)来建模视觉概念流形,通过最小描述长度分析证明其比方向基特征化器更紧凑,并应用于解释曲线检测、发现新流形及控制图像生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26087 2026-06-25 cs.CV 新提交 57%

MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation

MVTrack4Gen: 多视角点跟踪作为4D视频生成的几何监督

JoungBin Lee, Jaewoo Jung, Jongmin Lee, Tongmin Kim, Hyunsung Kim, Takuya Narihira, Kazumi Fukuda, Jahyeok Koo, Jisang Han, Yuki Mitsufuji, Seungryong Kim

机构 * KAIST AI(韩国科学技术院人工智能学院) Sony AI(索尼人工智能) Sony Group Corporation(索尼集团公司)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 提出MVTrack4Gen框架,利用多视角点跟踪作为几何与运动监督信号,增强仅相机条件的新视角视频扩散模型的运动一致性和几何一致性。

Comments Project Page : https://cvlab-kaist.github.io/MVTrack4Gen/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25907 2026-06-25 cs.CV 新提交 57%

In-context Region-based Drag: Drag Any Region to Any Shape

基于上下文区域的拖拽:将任意区域拖拽至任意形状

Jiacheng Sui, Tianyu Hao, Bingjie Gao, Li Niu, Guangtao Zhai

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 提出ICRDrag方法,通过上下文学习框架和两种注意力正则化,实现区域级拖拽编辑,在精度和视觉保真度上显著优于现有方法。

Comments Accepted by ECCV 2026. Dataset, code, and model are available at https://github.com/bcmi/ICRDrag-Region-Drag-Editing

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25548 2026-06-25 cs.CV cs.LG 新提交 57%

Concept Removal for Frontier Image Generative Models

前沿图像生成模型的概念移除

Aditya Kumar, Pierre Joly, Adam Dziedzic, Franziska Boenisch

机构 * CISPA Helmholtz Center for Information Security(CISPA海德堡信息安全研究中心)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 提出一种针对前沿扩散和自回归模型(如SD3.5、Flux、Infinity)的概念移除方法,通过将内部瓶颈层替换为转码器来选择性禁用概念相关信号,实现高效概念移除并保持生成质量。

Comments Accepted at ICML2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25430 2026-06-25 cs.CV 新提交 57%

PRISM: Feed-Forward Single-Image 3D Reconstruction via Geometric Warp-Residual Modeling

PRISM: 基于几何扭曲残差建模的前馈式单图像三维重建

Zhijie Zheng, Xinhao Xiang, Jiawei Zhang

机构 * University of California, Davis(加州大学戴维斯分校)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 提出PRISM前馈框架,将多视角潜在预测分解为无参数几何先验和可学习残差校正,无需扩散采样,推理时间仅36秒/场景,重建质量与扩散方法相当。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25300 2026-06-25 cs.CV 新提交 57%

HiFiVe: High-Fidelity Vehicle Generation Leveraging Auto-Regressive 2D Generative Priors

HiFiVe: 利用自回归2D生成先验的高保真车辆生成

Hongli Xiao, Youjian Zhang, Qi Zheng, Zhaohui Hu, Yaohui Jin, Xiaoguang Ren, Wenjing Yang, Long Lan

机构 * Bosch(博世)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 提出HiFiVe,一种无需训练的框架,通过施加3D几何约束锚定2D生成先验,联合增强纹理与几何,实现高保真车辆建模。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20300 2026-06-25 cs.CV 新提交 57%

CMDS-AD: Cross-Modal Dual-Stream Decoupling for Few-Shot Anomaly Detection

CMDS-AD: 跨模态双流解耦用于少样本异常检测

Junhao Cai, Junyu Chen, Deyu Zeng, Junhao Pang, Qiwei Liang, Xiaopin Zhong, Zongze Wu

机构 * Shenzhen University(深圳大学) Guangzhou Maritime University(广州航海学院) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 提出跨模态双流异常检测框架CMDS-AD,通过扩散模型生成多样本并利用低频正常估计辅助解耦高频缺陷,在1-shot设置下MVTec 3D-AD上I-AUROC提升5.7%。

Comments Accepted to ECCV 2026! Project page: https://cmds-ad.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25762 2026-06-25 cs.LG cs.AI 新提交 50%

OncoSynth: Synthetic data generation for treatment effect estimation in oncology

OncoSynth: 用于肿瘤治疗效果估计的合成数据生成

Octavia-Andreea Ciora, Julian Welzel, Dennis Frauen, Maresa Schröder, Marie Brockschmidt, Harry Amad, Thomas Callender, Mihaela van der Schaar, Stefan Feuerriegel

机构 * LMU Munich(慕尼黑大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心) Department of Applied Mathematics and Theoretical Physics, University of Cambridge(剑桥大学应用数学与理论物理系) Department of Public Health and Primary Care, University of Cambridge(剑桥大学公共卫生与初级保健系) Cambridge Centre for AI in Medicine, University of Cambridge(剑桥大学剑桥医学人工智能中心) The Alan Turing Institute(艾伦·图灵研究所)

专题命中 扩散模型 :diffusion(abstract)

AI总结 提出因果感知的生成框架OncoSynth,通过扩散序列建模协变量对治疗分配及治疗对生存的影响,在肺癌和乳腺癌队列中实现高保真合成,将群体和个体治疗效果估计误差分别降低66%和58%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25575 2026-06-25 cs.RO 新提交 50%

One Body, Two Minds: Variable Autonomy Approach for a Co-embodied Robotic Hand

一个身体,两个心智:共体机械手的可变自主性方法

Piotr Koczy, Yuchong Zhang, Danica Kragic, Michael C. Welle

机构 * KTH Royal Institute of Technology(瑞典皇家理工学院) INCAR Robotics AB(INCAR Robotics AB公司)

专题命中 扩散模型 :diffusion(abstract)

AI总结 提出共体可变自主性方法,让人类与机器人共享同一身体并在任务阶段切换自主级别,通过用户研究验证了该方法在辅助机器人中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25295 2026-06-25 cs.RO 新提交 50%

DynaMOMA: Instantaneous Prediction of Grasp Poses for Mobile Manipulation of Dynamic Objects

DynaMOMA:动态物体移动操作的抓取姿态瞬时预测

Zhinan Yu, Junyan Xu, Jiazhao Zhang, Zheng Qin, Yijie Tang, Yuhang Huang, Yihan Cao, Zhiyuan Yu, Yongjun Wang, Renjiao Yi, Chenyang Zhu, Kai Xu

机构 * National University of Defense Technology(国防科技大学) CFCS, Peking University(北京大学前沿计算研究中心) Defense Innovation Institute, Academy of Military Sciences(军事科学院国防科技创新研究院) Wuhan University(武汉大学) Institute of AI for Industries, Chinese Academy of Sciences(中国科学院产业人工智能研究院)

专题命中 扩散模型 :diffusion(abstract)

AI总结 提出DynaMOMA框架,结合基于锚点的扩散模型预测瞬时抓取轨迹与全身控制策略,实现动态物体移动操作,在仿真和真实实验中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25151 2026-06-25 cs.LG cs.AI 新提交 50%

Silent Failures in Physics-Informed Neural Networks: Parameter Poisoning and the Limits of Loss-Based Validation

物理信息神经网络中的静默失败:参数投毒与基于损失的验证的局限性

David McShannon, Nicholas Dietrich

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文揭示物理信息神经网络(PINNs)在编码物理参数错误时,即使训练损失很低,解也可能严重偏离真实解,并提出一种无需重训的后验防御方法,通过扫描残差损失最小值恢复真实参数。

Comments 7 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24993 2026-06-25 cs.LG 新提交 50%

The Geometry of Sequential Learning: Lie-Bracket Prediction of Transfer Order

序列学习的几何:李括号预测迁移顺序

John Sweeney

机构 * Sideplane AI

专题命中 扩散模型 :diffusion(abstract)

AI总结 提出李括号对偶性分数预测序列学习中的源域顺序,通过李括号锦标赛实现O(N log N)排序,在指令微调和DPO中达到高准确率。

Comments Accepted to ICML 2026. 20 pages, including appendices

详情

展开后加载摘要…

URL PDF HTML 收藏