Indexed by:
Abstract:
针对卷积神经网络(CNN)在通用CPU以及GPU平台上推断速度慢、功耗大的问题,采用FPGA平台设计了并行化的卷积神经网络推断系统.通过运算资源重用、并行处理数据和流水线设计,并利用全连接层的稀疏性设计稀疏矩阵乘法器,大大提高运算速度,减少资源的使用.系统测试使用ORL人脸数据库,实验结果表明,在100 MHz工作频率下,模型推断性能分别是CPU的10.24倍,是GPU的3.08倍,是基准版本的1.56倍,而功率还不到2W.最终在模型压缩了4倍的情况下,系统识别准确率为95%.
Keyword:
Reprint 's Address:
Email:
Version:
Source :
电子技术应用
ISSN: 0258-7998
CN: 11-2305/TN
Year: 2020
Issue: 2
Page: 24-27
Cited Count:
WoS CC Cited Count: 0
SCOPUS Cited Count:
ESI Highly Cited Papers on the List: 0 Unfold All
WanFang Cited Count: -1
Chinese Cited Count:
30 Days PV: 6
Affiliated Colleges: