基于FPGA的浮点可分离卷积神经网络加速方法

张志超; 王剑; 章隆兵; 肖俊华

首页> 中文期刊>高技术通讯 >基于FPGA的浮点可分离卷积神经网络加速方法

基于FPGA的浮点可分离卷积神经网络加速方法

开具论文收录证明 >>

期刊封面封底目录下载 >>

页面导航

摘要
著录项
相似文献
相关主题

摘要

针对可分离卷积神经网络在星载飞机目标型号分类应用中存在的速度瓶颈以及功耗限制等问题,提出了一种基于现场可编程门阵列(FPGA)数据流调度的浮点深度分离卷积神经网络加速方法,对通用MobileNet的图像分类模型进行加速。采用基于乘法矩阵与前向加法树的深度分离卷积计算阵列设计,解决了深度分离卷积浮点加速的线速吞吐瓶颈。实验结果表明,基于FPGA的目标分类速度为633 FPS,功耗为22.226 W,运算性能为236.04 GFLOPS,计算速度达到了Titan Xp GPU的1.10~2.61倍,计算效能是Titan Xp GPU的7.44~18.66倍。在同类基于FPGA的浮点卷积加速方案中,该方法在运算性能及能效比上达到了最优。同时,该方法提供了与原模型一致性的图像分类准确率,解耦合了软硬件协同开发流程,降低了应用开发人员使用FPGA加速计算的门槛。

著录项

来源
《高技术通讯》|2022年第5期|441-453|共13页
作者
张志超; 王剑; 章隆兵; 肖俊华;
展开▼
作者单位

计算机体系结构国家重点实验室(中国科学院计算技术研究所);

中国科学院计算技术研究所;

中国科学院大学;

中国电子科技集团公司第十五研究所;

展开▼
原文格式 PDF
正文语种 chi
中图分类计算技术、计算机技术;
关键词
深度可分离卷积; 现场可编程门阵列(FPGA); 数据流调度; 加速; 图像分类;

相似文献

中文文献
外文文献
专利

1. 基于FPGA的卷积神经网络浮点激励函数实现 [J] . 李施豪 ,应三丛 . 微电子学与计算机 . 2017,第10期
2. 基于改进动态配置的FPGA卷积神经网络加速器的优化方法 [J] . 陈朋 ,陈庆清 ,王海霞 . 高技术通讯 . 2020,第3期
3. 基于深度可分离卷积神经网络的农作物病害识别方法 [J] . 蔡汉明 ,随玉腾 ,张镇 . 安徽农业科学 . 2019,第011期
4. FPGA加速器深度卷积神经网络优化计算方法 [J] . 梁修壮 ,倪伟 . 计算机仿真 . 2022,第5期
5. 在FPGA上实现及优化加速卷积神经网络的方法 [J] . 郑文凯 ,杨济民 . 山东师范大学学报（自然科学版） . 2019,第002期
6. 基于Winograd算法的卷积神经网络FPGA加速器的设计方法 [C] . Wang Aobo ,王奥博 ,Liu Kai . 2018年全国高性能计算学术年会 . 2018
7. 基于FPGA的深度可分离卷积神经网络加速器设计研究 [A] . 詹宏毅 . 2021

基于FPGA的浮点可分离卷积神经网络加速方法

摘要

著录项

相似文献

相关主题

期刊订阅