Seeing the End at Step Zero: Accelerating Diffusion MLLMs via MLP Sparsity-Aware Truncation
从零步洞察终点:通过MLP稀疏感知截断加速扩散多模态大语言模型
机构 * Zhejiang University(浙江大学)
专题命中 文档图表理解 :multimodal large language model(abstract);分类 cs.AI
AI总结 研究针对扩散多模态大语言模型推理效率受固定长度生成约束影响的问题,提出Seer框架,利用MLP激活稀疏性变化检测有效语义边界,进行冗余截断及采用混合执行策略,实验表明其可加速吞吐量并维持性能甚至提升复杂视觉任务准确性。
Comments Accepted to ACM Multimedia (ACM MM) 2026