Visualising Information Flow in Word Embeddings with Diffusion Tensor Imaging
用扩散张量成像可视化词嵌入中的信息流
机构 * Technical University Darmstadt(达姆斯塔特技术大学)
专题命中 扩散模型 :diffusion(title,abstract)
AI总结 本文提出利用扩散张量成像技术可视化词嵌入中的信息流,揭示LLM中自然语言表达的信息流动机制,提升NLP模型的可解释性。
视觉与机器人
图像生成、文生图、图像编辑、扩散模型和可控生成。
用扩散张量成像可视化词嵌入中的信息流
机构 * Technical University Darmstadt(达姆斯塔特技术大学)
专题命中 扩散模型 :diffusion(title,abstract)
AI总结 本文提出利用扩散张量成像技术可视化词嵌入中的信息流,揭示LLM中自然语言表达的信息流动机制,提升NLP模型的可解释性。
协调双边界:一种受算术强度启发的加速框架用于扩散语言模型
机构 * Peking University(北京大学)
专题命中 扩散模型 :diffusion(title,abstract)
AI总结 ODB-dLLM通过协调双边界,利用算术强度差异优化扩散语言模型的推理速度,显著提升效率并减少准确性损失。
Comments Accepted by DAC 2026
论LLM生成的单元测试中测试异味的扩散
专题命中 扩散模型 :diffusion(title,abstract)
AI总结 本研究通过多基准大规模分析,对比LLM生成、人类编写及EvoSuite生成的单元测试,发现LLM生成测试存在特定测试异味,受提示策略等影响,凸显基于LLM的测试生成的潜力与风险,呼吁开发相关优化方案。
Comments Accepted at Transactions on Software Engineering and Methodology (TOSEM) journal on 31 July 2026
3D-CovDiffusion:面向覆盖路径规划的三维感知扩散策略
机构 * IEEE
专题命中 扩散模型 :diffusion(title,abstract)
AI总结 本文提出 3D-CovDiffusion,将覆盖路径规划转化为条件序列生成问题,采用几何条件扩散框架从三维点云合成轨迹,相比基线方法在轨迹平滑度、覆盖率等指标上实现显著提升。
专题命中 扩散模型 :diffusion(title,abstract)
Comments This paper has been ACCEPTED as a FULL PAPER at DASFAA 2025
Journal ref Database Systems for Advanced Applications (DASFAA 2025), Lecture Notes in Computer Science, vol. 15987, pp. 571-586, 2026
专题命中 扩散模型 :diffusion(title,abstract)
专题命中 扩散模型 :diffusion(title,abstract)
NetDiff:具备增强全局能力的图扩散模型,用于生成和更新移动网络拓扑
专题命中 扩散模型 :diffusion(title,abstract)
AI总结 研究提出NetDiff模型,结合ACAM令牌与部分扩散方法,生成更新移动网络拓扑,性能超基线,实现高效全局链路决策与快速重配置。
专题命中 扩散模型 :diffusion(title,abstract)
Journal ref Appl. Math. Optim. 94 (2026) 40
专题命中 扩散模型 :diffusion(title,abstract)
Journal ref Phys. Rev. B 109, 224205 (2024)
专题命中 扩散模型 :diffusion(title,abstract)
Comments 33 pages
医学影像中的生成式AI与基础模型
机构 * Nagoya University(名古屋大学) ; Graduate School of Informatics, Nagoya University(名古屋大学信息学研究科)
专题命中 扩散模型 :diffusion(abstract,abstract_cn);image generation(abstract);分类 cs.CV
AI总结 本文概述生成式AI相关的扩散模型、LLMs及基础模型,介绍其在医疗辅助中的应用,探讨基础模型的构建方法与医疗应用,并研究利用国家资源开发医疗辅助AI的路径。
Comments Review Article
Journal ref Radiological Physics and Technology, vol.18, pp.937-948, 2025
c-整流流的计算与统计保证
专题命中 扩散模型 :diffusion(abstract,abstract_cn);image generation(abstract)
AI总结 该研究针对迭代整流流的计算与统计保证问题,提出c-整流流方法,证明其在合适假设下可收敛到最优传输耦合,并建立相关收敛保证与最优估计速率,为整流流提供理论支撑。
轻量强制:通过稀疏注意力加速自回归视频扩散
机构 * Nanjing University of Posts and Telecommunications(南京邮电大学)
专题命中 扩散模型 :diffusion(title);分类 cs.CV
AI总结 针对自回归视频生成模型中注意力二次复杂度问题,提出首个稀疏注意力方案Light Forcing,通过块感知增长机制和分层稀疏注意力实现质量和效率提升。
Comments ICML 2026
城市尺度平流扩散系统中考虑可识别性的源解析
专题命中 扩散模型 :diffusion(title)
AI总结 该研究针对城市空气质量源解析的逆问题,提出IASA框架,结合可识别性分析,实现源活动系数估计、轨迹重建与不确定性评估,在新德里PM2.5数据集上验证了方法的有效性。
基于概率扩散模型的动态无人机落水人员搜索作业
专题命中 扩散模型 :diffusion(title)
AI总结 该研究针对游轮落水人员搜救难题,提出结合扩展卡尔曼滤波与漂移模型的区域预测方法,评估五种无人机搜索策略,其中改进概率引导搜索法在延迟20分钟、检测成功率30%时平均搜救成功率超80%。
Zellige:用于混合图像-视频DiT训练的可塑序列放置
专题命中 扩散模型 :diffusion(abstract,abstract_cn)
AI总结 Zellige是一种可塑序列放置系统,通过硬件分析器、两阶段规划器和合并注意力引擎解决混合图像-视频DiT训练的GPU序列放置问题,在多GPU环境下性能优于KnapFormer。
PartMat:基于单个全局隐变量的材质感知三维部件分解
机构 * Alibaba Group(阿里巴巴集团)
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV、cs.GR
AI总结 该研究提出PartMat,一种用单个全局隐变量的材质感知三维部件分解流水线,可按材质边界分解物体,推理高效且分解准确率优于基线,几何质量相当。
基于超网络控制的几何深度学习的脑组织微结构估计的协议泛化
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV
AI总结 本文提出一种融入b-值依赖的超网络控制SCNN架构,实现b-值与b-向量泛化及旋转等变性,提升了脑组织微结构估计的鲁棒性与临床适用性。
RPL-UIE:面向水下图像增强的可靠先验学习
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV
AI总结 针对水下图像增强的语义漂移问题,提出RPL-UIE两阶段教师-学生框架,结合RPRD与FPRD缩小师生模型先验学习差异,在基准测试、下游视觉任务及真实ROV数据上表现良好。
Comments 14 pages, 10 figures, and 6 tables
GSRAIN:面向3D高斯溅射(3DGS)驾驶场景的物理校准高低频降雨合成方法
机构 * College of Automotive and Energy Engineering, Tongji University(同济大学汽车与能源工程学院)
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV
AI总结 GSRAIN针对自动驾驶降雨模拟的物理可控性与多视图一致性局限,结合实测数据与几何感知扩散模型生成可控降雨场景,在FID指标上优于现有方法,可用于自动驾驶算法的雨天测试。
SPARE:用于流匹配的无结构参数亲和力正则化
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV
AI总结 针对去噪扩散Transformer训练收敛慢的问题,提出无结构参数亲和力正则化SPARE,利用跨图像标记对的结构实现正则化,在ImageNet数据集上取得优异生成性能,内存开销极小。
Comments Preprint
GeoCore-9B:面向地球观测的地理感知生成基础模型
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV
AI总结 本文针对现有EO生成模型的地理空间约束冲突问题,推出90亿参数的GeoCore-9B,采用Flow Matching的DiT与地理空间元数据条件生成,结合地理空间语义对齐损失,在多项EO任务上实现最优性能。
Comments Please visit our project page at https://kaist-viclab.github.io/GeoCore-9B_site/
LiveLight:具备交互式控制的实时流视频重光照
机构 * HKUST(香港科技大学) ; University of Macau(澳门大学) ; THU(清华大学) ; UoT(多伦多大学) ; University of Tuebingen(蒂宾根大学)
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV
AI总结 本研究提出首个基于扩散模型的实时流视频重光照框架LiveLight,通过三项关键设计解决三大挑战,在实时速度下达到最优重光照质量,将公开发布相关资源以推动该领域研究。
Comments Accepted by TOG 2026. Project page: https://living-lighting.github.io
SPAE:用于预训练视觉隐层的频谱引导自编码器
机构 * Alibaba Group(阿里巴巴集团) ; Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学高瓴人工智能学院)
专题命中 扩散模型 :image generation(abstract);分类 cs.CV
AI总结 针对DiT生成隐层与编码器隐层的频谱不匹配问题,提出SPAE框架,通过紧凑瓶颈结构与通道级掩码策略实现隐层适配,在视觉理解、生成质量与重建保真度间取得良好平衡。
LeapTalk:打破说话头生成中的延迟-质量权衡
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV
AI总结 LeapTalk是一种新型说话头生成框架,通过单步前向传播结合数据到数据传输、异质蒸馏与音频驱动无分类器引导,实现了200 FPS的稳定实时生成,打破了延迟-质量权衡。
FreqForcing:基于频谱自锚定的自回归长视频生成方法
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV
AI总结 本文针对自回归长视频生成中的误差累积问题,提出无需训练的FreqForcing框架,通过频谱自锚定技术实现24倍外推,性能优于现有无训练方法且与有训练方法有竞争力。
Comments Code is available at: https://github.com/jiatongli2024/FreqForcing
从不确定性到确定性:无射线匹配的由粗到细视觉楼层平面图定位
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV
AI总结 该研究针对视觉楼层平面图定位的多模态姿态分布问题,提出无射线匹配的由粗到细框架,通过图像条件姿态扩散模型与局部细化器实现定位,在S3D和ZInD基准上达到最优精度与鲁棒性。
用于视差和表面法线的统一立体几何估计框架
机构 * Beijing Institute of Technology(北京理工大学) ; School of Computer Science, Wuhan University(武汉大学计算机科学学院) ; Beihang University(北京航空航天大学) ; INSAIT, Sofia University(索非亚大学INSAIT) ; BAAI AIR, Tsinghua University(清华大学BAAI AIR)
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV
AI总结 本文针对立体匹配和表面法线估计问题,提出统一框架GeoStereo,结合前馈立体匹配与基于扩散的法线估计分支,引入初始化策略与扭曲条件,实现有效交互,在多场景表现可靠,零样本设置下视差和法线估计精度高。
MoWorld:一种快速世界模型
机构 * Moxin Technology(魔心科技)
专题命中 扩散模型 :diffusion(abstract);分类 cs.CV
AI总结 研究旨在提升世界模型实用性与推理效率。提出MoWorld,基于3D原生数据引擎,有课程跨帧预训练等策略,能在NPU上达50 FPS实时交互,平均推理成本低,为世界模型大规模应用提供基础并展示多种应用。
Comments Project Page: https://moxin-tech.github.io/moworld/