arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

University of California, Los Angeles(加州大学洛杉矶分校)

2026-03-24 至 2026-03-24 共收录 1
2511.06174 2026-03-24 cs.AR cs.AI

LUT-LLM: Efficient Large Language Model Inference with Memory-based Computations on FPGAs

LUT-LLM: 通过FPGA上的基于内存的计算实现高效的大型语言模型推断

Zifan He, Shengyu Ye, Rui Ma, Yang Wang, Jason Cong

机构 * University of California, Los Angeles(加州大学洛杉矶分校)

AI总结 本文提出LUT-LLM,首个利用基于内存计算的FPGA加速器,通过向量量化部署10亿参数语言模型,提升FPGA效率以竞争GPU性能。

Comments Extended, 11 pages, FCCM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏