首页 / 行业

谷歌发表论文EfficientNet 重新思考CNN模型缩放

2019-06-03 14:19:00

谷歌AI研究部门华人科学家再发论文《EfficientNet：重新思考CNN模型缩放》，模型缩放的传统做法是任意增加CNN的深度和宽度，或使用更大的输入图像分辨率进行训练，而使用EfficientNet使用一组固定额缩放系数统一缩放每个维度，超越了当先最先进图像识别网络的准确率，效率提高了10倍，而且更小。

目前提高CNN精度的方法，主要是通过任意增加CNN深度或宽度，或使用更大的输入图像分辨率进行训练和评估。

以固定的资源成本开发，然后按比例放大，以便在获得更多资源时实现更好的准确性。例如ResNet可以通过增加层数从ResNet-18扩展到ResNet-200。

再比如开源大规模神经网络模型高效训练库GPipe，通过将基线CNN扩展四倍来实现84.3％ ImageNet top-1精度。

这种方法的优势在于确实可以提高精度，但劣势也很明显。这个时候往往需要进行繁琐的微调。一点点的摸黑去试、还经常的徒劳无功。这绝对不是一件能够让人身心愉快的事情，对于谷歌科学家们也一样。

这就是为什么，谷歌人工智能研究部门的科学家们正在研究一种新的“更结构化”的方式，来“扩展”卷积神经网络。他们给这个新的网络命名为：EfficientNet（效率网络）。

代码已开源，论文刚刚上线arXiv，并将在6月11日，作为poster亮相ICML 2019。

比现有卷积网络小84倍，比GPipe快6.1倍

为了理解扩展网络的效果，谷歌的科学家系统地研究了缩放模型不同维度的影响。模型缩放并确定仔细平衡网络深度后，发现只要对网络的深度、宽度和分辨率进行合理地平衡，就能带来更好的性能。基于这一观察，科学家提出了一种新的缩放方法，使用简单但高效的复合系数均匀地缩放深度、宽度和分辨率的所有尺寸。

据悉，EfficientNet-B7在ImageNet上实现了最先进精度的84.4％ Top 1/97.1％ Top 5，同时比最好的现有ConvNet小84倍，推理速度快6.1倍；在CIFAR-100（91.7％），Flower（98.8％）和其他3个迁移学习数据集上，也能很好地传输和实现最先进的精度。参数减少一个数量级，效率却提高了10倍（更小，更快）。