PQuantML: A Tool for End-to-End Hardware-aware Model Compression
PQuantML:用于端到端硬件感知模型压缩的工具
机构 * European Center for Nuclear Research (CERN)(欧洲核子研究中心) ; Purdue University(普渡大学) ; California Institute of Technology(加州理工学院) ; University of Padova(帕多瓦大学) ; Physikalisches Institut, Heidelberg University(海德堡大学物理研究所) ; SLAC National Accelerator Laboratory(SLAC国家加速器实验室) ; Institute of Physics Belgrade(贝尔格莱德物理研究所)
AI总结 PQuantML通过提供统一接口实现剪枝与量化,支持端到端工作流中的模型压缩,通过多种剪枝方法和固定点量化实现参数和位宽显著减少,同时保持精度。