用于实现稀疏卷积神经网络加速器的装置和方法与流程

文档序号:11216990阅读:来源:国知局

技术特征:

技术总结
提供一种用于实现稀疏卷积神经网络加速器的装置和方法。在本发明的装置中,包括卷积与池化单元、全连接单元和控制单元。通过依据控制信息而读取卷积参数信息与输入数据与中间计算数据,并且读取全连接层权值矩阵位置信息,根据卷积参数信息对输入数据进行第一迭代次数的卷积与池化操作,然后根据全连接层权值矩阵位置信息进行第二迭代次数的全连接计算。每个输入数据被分割为多个子块,由卷积与池化单元和全连接单元分别对多个子块并行进行操作。本发明采用专用电路,支持全连接层稀疏化卷积神经网络,采用ping‑pang缓存并行化设计与流水线设计,有效平衡I/O带宽和计算效率,并获得较好的性能功耗比。

技术研发人员:谢东亮;张玉;单羿
受保护的技术使用者:北京深鉴智能科技有限公司
技术研发日:2016.12.05
技术公布日:2017.10.10
当前第2页1 2 
网友询问留言 已有0条留言
  • 还没有人留言评论。精彩留言会获得点赞!
1