深度学习论文理解3：Flexible, high performance convolutional neural networks for image classification

最新推荐文章于 2021-12-03 21:59:20 发布

whiteinblue

最新推荐文章于 2021-12-03 21:59:20 发布

阅读量3.5k

点赞数 2

CC 4.0 BY-SA版权

文章标签：卷积网络 GPU计算CNN

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.youkuaiyun.com/whiteinblue/article/details/43149363

本文是11年Dan C.Ciresan的作品，主要贡献是提供了一种快速，全GPU部署的CNN计算框架，通过快速的GPU计算可以让作者尝试相对以前的神经网络更深的CNN，而且是仅仅使用监督学习的方式。

本来不想写本文的总结的，但是最近看了ImageNet上取得好成绩的网络，都是通过GPU（caffe，convnet）部署，仅仅通过监督学习的方式来训练更加深的CNN，所以打算总结一下本文，作为在GPU上通过监督学习来训练深度CNN的开篇（Dan不是第一个使用GPU计算CNN的，个人见解）。

一，介绍

……尽管在硬件上的进步，计算速度仍然是限制CNN发展的一个主要瓶颈。为了系统性地测试各种结构的影响，本文提供了一种快速GPU部署CNN框架。之前的GPU部署CNN都是为了满足GPU硬件的限制，或者使用一般的函数库，然而我们的GPU部署比较灵活而且是on-line的权值学习方式。我们的部署允许训练CNN时间是以天为单位，而不是月；这样我们可以探索更大的参数空间，研究各种结构的影响。

二.CNN

2.1卷积层

C层的参数=f(特征图大小，特征图个数，filter尺寸，跳跃间隔因子，连接表)

采用valid的卷积方式，卷积后特征图大小关系，如下式：

n代表层数，M代表每层特征个数，x，y分别代表特征图的长宽。K代表filter，S代表跳跃间隔数。（貌似上面公式并不具有普遍性，因为自己在后面的一些论文用此公式是map的尺寸和公式的结果不一样，估计可能是和Stride的定义有关，再有就是填充像素的原因）

2.2 max-Pooling层

相比mean-Pooling，max-Pooling能够较快的收敛，选择更加具有不变性的特征，而且还能够增加泛化能力。Max-Pooling能够在更大的局域上具有不变性，下采样（降维）特征图按照Kx和Ky倍数。

2.3 分类层

需要选择Filter尺寸&#

最低0.47元/天解锁文章

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。