Adversarial Social Epistemology for Assemblies of Humans and Large Language Models
人类与大语言模型集合的对抗性社会认识论
专题命中 扩散模型 :diffusion(abstract)
AI总结 研究人类与大语言模型集合在密集互动交流场景中的信息问题,提出对抗性社会认识论,借助语言、机制及基于认知网络的 machinery 来分析、破坏信任并审计纠正信任违规。
Comments 50 pages
视觉与机器人
图像生成、文生图、图像编辑、扩散模型和可控生成。
人类与大语言模型集合的对抗性社会认识论
专题命中 扩散模型 :diffusion(abstract)
AI总结 研究人类与大语言模型集合在密集互动交流场景中的信息问题,提出对抗性社会认识论,借助语言、机制及基于认知网络的 machinery 来分析、破坏信任并审计纠正信任违规。
Comments 50 pages
RadioDiff-v2:用于多波束选择和定位的生成式角度无线电地图
机构 * State Key Laboratory of ISN and School of Telecommunications Engineering, Xidian University(信息与通信工程国家重点实验室和西安电子科技大学电信工程学院)
专题命中 扩散模型 :diffusion(abstract)
AI总结 研究6G网络中角度无线电地图相关问题,提出双分支一维扩散变压器RadioDiff-v2,经流匹配训练,结合多种技术,在零样本测试中各指标领先基线,实现多波束选择和接收器定位。
拟合直边三角形网格上有限元在光滑边界上自然条件的场外强制
专题命中 扩散模型 :diffusion(abstract)
AI总结 研究因拟合直边三角形网格近似光滑域导致边界条件执行不准的问题,采用在双线性形式中添加项的方法,应用于三角形拉格朗日有限元,经数值实验验证,有效恢复精度并进行可靠性研究。
经典力学基础中三个开放问题的复时(kime)表示公式:不确定性、不变熵和定向自由度
机构 * University of Michigan(密歇根大学)
专题命中 扩散模型 :diffusion(abstract)
AI总结 该研究在复时(kime)表示下探讨经典力学基础的三个问题,包括熵不确定性原理扩展、坐标不变测度与熵表征及构建经典相对论定向自由度,通过多种数学方法证明相关关系和结论,并提出精确开放问题。
夸克-胶子等离子体热化过程中的方位角动量各向同性化
专题命中 扩散模型 :diffusion(abstract)
AI总结 研究重离子碰撞中初始方位角各向异性在扩散近似玻尔兹曼方程下的弛豫,发现各向异性弛豫时间有层次,且与横向动量相关的谐波系数随时间演化,初始峰值向高动量移动,模拟结果与实验数据相符。
Comments 31 pages, 10 figures
退相干产生的拓扑结构
专题命中 扩散模型 :diffusion(abstract)
AI总结 研究表明退相干可诱导拓扑现象,在受环境诱导去相位的晶格系统中得以证明。由相互作用量子主方程支配的噪声平均动力学实现特定拓扑相,其随机噪声关联产生不对称扩散,此为开放多体系统中拓扑结构提供新途径,超越传统范式。
相关场中粒子的随机动力学
专题命中 扩散模型 :diffusion(abstract)
AI总结 研究处于平衡态复杂介质中胶体粒子有效动力学,针对介质由波动相关高斯场描述且与胶体线性耦合的情况,推导有效动力学,探讨其结果,还分析了粒子自身产生场时的自趋化动力学特性。
Comments Talk delivered at StatPhys29, Firenze, Italy, July 13-18, 2025 (19 pages, 6 figures)
Journal ref J. Stat. Mech. (2026) 084005
磁星引擎与星际介质相互作用:产生超亮超新星的协同效应
专题命中 扩散模型 :diffusion(abstract)
AI总结 研究磁星引擎与星际介质相互作用对超亮超新星的影响,开发半解析混合模型跟踪系统耦合动力学等,该模型能产生多样光变曲线形态,为降低相关解释中的能量要求提供合理方法。
Comments 18 pages, 9 figures, 2 tables, accepted for publication in ApJ
反应边界方差与伴随一致的局部波动率投影
专题命中 扩散模型 :diffusion(abstract)
AI总结 推导潜在订单簿反应边界的运行时间方差核,分离日历时间波动率模型中常合并的三个对象,给出确定性活动时钟的局部波动率投影,指出伴随一致性是对运行到日历时间投影的现实约束。
Comments Submitted to FMF; 13 pages, 6 Figures, 1 Table; Code reproducibility see: https://github.com/timgebbie/reaction-boundary-vol-surface-reproducibility
基于分块的机器人策略的动态执行视界预测
机构 * University of Toronto(多伦多大学) ; Vector Institute for Artificial Intelligence(向量人工智能研究所) ; Acceleration Consortium(加速联盟) ; Canadian Institute for Advanced Research (CIFAR)(加拿大高等研究院) ; Georgia Institute of Technology(佐治亚理工学院) ; NVIDIA(英伟达)
专题命中 扩散模型 :diffusion(abstract)
AI总结 提出DEHP方法,通过在线强化学习训练轻量级执行视界预测分支,在冻结预训练分块策略的情况下动态调整执行步数,显著提升高精度和长时域操作任务的成功率。
二氧化碳羽流扩展的多孔介质尺度
专题命中 扩散模型 :diffusion(abstract)
AI总结 通过比较分析解与数字图像分析结果,量化了多孔介质中二氧化碳羽流扩展的尺度特征,推导了羽流厚度、边缘和核心半径的闭合表达式。
在平稳随机动力学系统中因果效应的符号可识别性
机构 * Leiden University(莱顿大学)
专题命中 扩散模型 :diffusion(abstract)
AI总结 本文研究了平稳随机动力学系统中因果效应的符号可识别性,提出边符号可识别性概念,并通过具体因果结构分析确定了边符号的显式表达式。
无主变量的极点跳跃与全息超流体
专题命中 扩散模型 :diffusion(abstract)
AI总结 研究强耦合下格林函数极点跳跃性质,提出不依赖主变量的形式,以全息超流体为例指出流体动力学极点不全是极点跳跃点。
Comments 24 pages, v2: accepted version
NEP89:89种元素的无机和有机材料通用神经进化潜力
专题命中 扩散模型 :diffusion(abstract)
AI总结 研究针对机器学习原子间势的局限,提出神经进化势架构的NEP89模型,通过特定方法构建训练数据集。该模型精度高且计算高效,能实现大规模原子模拟,适用于多种场景并支持微调,为材料研究提供有力工具。
Comments 5 figures in the main text; Supplementary Information is available on the Nature Computational Science website
Journal ref Nature Computational Science (2026)
TORAX:JAX 中一个快速且可微的托卡马克输运模拟器
专题命中 扩散模型 :diffusion(abstract)
AI总结 介绍基于 JAX 框架的开源可微托卡马克输运模拟器 TORAX,它求解多种输运耦合方程,融合物理与机器学习模型,利用 JAX 特性实现快速运行及微分,经与 RAPTOR 代码验证,为托卡马克相关研究提供有力工具。
Comments 16 pages, 7 figures
ARDY:用于交互式人体运动生成的具有混合表示的自回归扩散
机构 * NVIDIA(英伟达) ; ETH Zürich(苏黎世联邦理工学院)
专题命中 可控生成 :diffusion(title);分类 cs.CV、cs.GR
AI总结 研究旨在解决交互式应用中人体运动生成问题,提出ARDY框架,采用混合表示和两阶段自回归变压器去噪器,能通过在线文本提示和运动学约束实现高保真运动生成,经评估验证了有效性和实用性。
Comments ACM Transactions on Graphics (SIGGRAPH 2026)
PanoImager:基于几何引导的稀疏全景视图新视角合成与重建
机构 * Institute of Industrial Science, The University of Tokyo(东京大学生产技术研究所)
专题命中 可控生成 :diffusion(abstract);分类 cs.CV
AI总结 提出PanoImager框架,无需SfM,结合前馈位姿/深度先验、几何条件扩散视图补全和深度引导3DGS优化,从稀疏全景图像实现稳定新视角合成与重建。
Comments IROS 2026
Elastic3D:基于引导潜解码的可控立体视频转换
专题命中 可控生成 :diffusion(abstract);分类 cs.CV
AI总结 针对沉浸式3D内容需求,提出Elastic3D方法,基于(条件)潜扩散,用引导VAE解码器确保高质量立体视频输出,能让用户在推理时控制立体效果强度,实验表明其优于传统及现有基线。
Comments Project page: elastic3d.github.io
关于状态切换扩散中最优控制的逼近
专题命中 可控生成 :diffusion(abstract)
AI总结 研究状态切换扩散中最优控制策略的逼近与简化问题,利用方程正则性、策略密度结果等,构建Euler - Maruyama逼近和有限状态逼近,证明相关收敛性,为该类控制问题提供系统逼近框架及数值实现依据。
以自我为中心的视频-语言模型是否捕捉了以手和物体为中心的线索?
机构 * The University of Tokyo(东京大学) ; University of Twente(特温特大学) ; University of Bristol(布里斯托大学)
专题命中 图像修复 :inpainting(abstract);分类 cs.CV
AI总结 研究手部-物体交互识别中现有视频-语言模型的局限,提出结合手部-物体掩码训练与HOI-动态感知解码器的新范式,构建DEHOI测试平台评估,证明该方法更有效利用相关信息,在多方面优于现有模型,提升HOI理解。
HairWeaver:基于仿真到现实引导视频扩散的少样本逼真头发运动合成
机构 * Meta University of Southern California(Meta 美国南加州大学)
专题命中 个性化与一致性 :diffusion(title,abstract);分类 cs.CV
AI总结 HairWeaver旨在解决现有方法在头发运动控制上的不足,通过运动上下文LoRA和风格对齐LoRA两个模块,结合CG模拟器生成的数据集训练视频扩散主干,实现对头发运动的精细控制,生成高度逼真且具动态细节的头发动画,达到新的技术水平。
Comments Accepted by ECCV 2026. Website: https://boese0601.github.io/hairweaver/
用于多模态理解、生成和编辑的认知结构多模态智能体
机构 * Peking University(北京大学) ; Tencent Inc(腾讯公司)
专题命中 图像生成评测 :image generation(abstract);分类 cs.CV
AI总结 研究针对统一多模态模型在长时多模态对话中的局限,提出认知结构多模态智能体,通过外化视觉信息等方式改进。开发统一场景引擎,构建评估基准。实验显示该智能体检索准确率高、推理时间减半,还介绍了工具包,为长时多模态智能体提供新范式。
Comments 16 pages, 7 figures, 8 tables. Project page: https://caseclose.github.io/cma-harness/ Code: https://github.com/caseclose/cma-harness
DexVerse:用于多任务、多实体灵巧操作的模块化基准测试
机构 * UNC-Chapel Hill(北卡罗来纳大学教堂山分校) ; The University of Hong Kong(香港大学) ; UC Berkeley(加州大学伯克利分校)
专题命中 图像生成评测 :diffusion(abstract)
AI总结 DexVerse是用于多任务、多实体灵巧操作的模块化基准测试,含100个任务,支持多种机器人手臂和手,可扩展且提供视觉变化等。通过对多种方法的基准测试,揭示任务泛化和视觉运动鲁棒性挑战,为通用灵巧操作提供测试平台。
FSampler: 通过epsilon外推实现无需训练的扩散采样加速
专题命中 效率与蒸馏 :diffusion(title,abstract);分类 cs.CV
AI总结 FSampler通过epsilon外推减少模型调用和采样时间,提升扩散采样效率。
Comments 10 pages; diffusion models; accelerated sampling; ODE solvers; epsilon extrapolation; training free inference
OPSD-V:用于训练后少步自回归视频生成器的策略内自蒸馏
机构 * Meituan(美团) ; HKUST(香港科技大学) ; City University of Hong Kong(香港城市大学)
专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV
AI总结 研究针对训练后少步自回归视频生成器存在的问题,提出OPSD-V策略内自蒸馏范式。通过引入真实长视频数据提供监督,学生和教师模型按特定方式运行,应用该范式于相关模型后,实验及用户研究表明其在多方面有改进且更受青睐。
Comments Project page: https://meigen-ai.github.io/OPSD-V ; Code: https://github.com/MeiGen-AI/OPSD-V
SAGA:自回归视频生成的稳定加速引导
机构 * University of Science, VNU-HCM(越南胡志明市国家大学) ; Vietnam National University(越南国家大学) ; University of Dayton(Dayton 大学)
专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV
AI总结 研究自回归视频生成中因重复使用潜在变量致时间误差问题,提出SAGA方法,它整合加速域频谱引导目标与初始化策略,无需训练可直接用于现有模型,能提升时间质量、减少时间不稳定性并保持视觉保真度。
蒙特卡罗莱曼阿尔法辐射传输中的力收敛
专题命中 效率与蒸馏 :diffusion(abstract)
AI总结 研究蒙特卡罗莱曼阿尔法辐射传输中力收敛问题,通过建立基准、开发基于矩的框架,应用于多种估计器,从不同阶次评估收敛性,为内部力计算提供实用框架,表明需分别评估统计精度、计算成本和物理准确性。
Comments 22 pages, 15 figures. Comments welcomed
安全流Q学习:基于可达性的安全离线强化学习流策略
专题命中 效率与蒸馏 :diffusion(abstract)
AI总结 本文提出Safe Flow Q-Learning,结合达性启发的安全价值函数和高效的一步流策略,通过自一致性Bellman递归学习安全价值,行为克隆训练流策略并转化为奖励最大化安全动作选择器,减少部署时的拒绝采样,提升实时安全应用性能。
Comments 21 pages, 6 figures, 3 tables; First 2 authors have contributed equally; Paper accepted at Reinforcement Learning Conference (RLC) 2026
SeFA策略:基于选择性流对齐的快速准确视觉运动策略学习
专题命中 效率与蒸馏 :diffusion(abstract)
AI总结 针对机器人模仿学习中视觉运动策略学习难题,提出SeFA框架,用选择性流对齐策略,借助专家示范纠正动作,统一整流流效率与观测一致动作生成,实验显示其超越现有策略,准确性、鲁棒性高且推理延迟大幅降低。
TOM:一种基于多教师知识蒸馏和任务特定数据增强的开源舌象分割方法
专题命中 效率与蒸馏 :diffusion(abstract)
AI总结 本文提出TOM模型,通过多教师知识蒸馏和任务特定数据增强实现高效舌象分割,并提供开源工具和案例研究,提升中医诊断性能。
Comments Tongue segmentation, data augmentation, synthetic data for AI training, prompt engineering, Segment Anything Model, knowledge distillation, tongue classification