ABI: A tightly integrated, unified, sparsity-aware, reconfigurable, compute near-register file/cache GPU architecture with light-weight softmax for deep learning, linear algebra, and Ising compute
ABI: 一种紧密集成、统一、稀疏感知、可重构、近寄存器文件/缓存计算的GPU架构,配备轻量级softmax,用于深度学习、线性代数和伊辛计算
专题命中 长上下文与记忆 :large language model(abstract);language model(abstract)
AI总结 提出一种紧密集成的近内存GPU架构,通过自定义稀疏感知电路和轻量级softmax电路,在CNN、GCN、线性规划、大语言模型和伊辛工作负载上实现6-16倍加速和6-13倍能效提升。