LFPO: Likelihood-Free Policy Optimization for Masked Diffusion Models
LFPO:基于掩码扩散模型的似然自由策略优化
机构 * Shenzhen University(深圳大学) ; Hong Kong University of Science(香港科学大学) ; Guangdong Laboratory of Artificial Intelligence(广东省人工智能与数字经济实验室) ; University of Science(科学技术大学) ; Shanghai Jiao Tong University(上海交通大学) ; Carleton University(卡尔顿大学) ; Southeast University(东南大学)
专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
AI总结 LFPO通过似然自由策略优化提升掩码扩散模型的生成质量与推理效率。