EfficientNet模型的完整细节 - HelloWorld开发者社区

作者：Vardan Agarwal
编译：ronghuaiyang

导读

深入研究所有不同EfficientNet结构的细节。

我在一个Kaggle竞赛中翻阅notebooks，发现几乎每个人都在使用EfficientNet 作为他们的主干，而我之前从未听说过这个。谷歌AI在这篇文章中：https://arxiv.org/abs/1905.11946介绍了它，他们试图提出一种更高效的方法，就像它的名字所建议的那样，同时改善了最新的结果。一般来说，模型设计得太宽，太深，或者分辨率太高。刚开始的时候，增加这些特性是有用的，但很快就会饱和，然后模型的参数会很多，因而效率不高。在EfficientNet中，这些特性是按更有原则的方式扩展的，也就是说，一切都是逐渐增加的。

EfficientNet模型的完整细节

不明白发生了什么？不要担心，一旦看到了架构，你就会明白了。但首先，让我们看看他们得到了什么结果。

EfficientNet模型的完整细节

由于参数的数目相当少，这个模型族是非常高效的，也提供更好的结果。现在我们知道了为什么这些可能会成为标准的预训练模型，但是缺少了一些东西。

共同之处

首先，任何网络都以它为主干，在此之后，所有对架构的实验都以它为开始，这在所有8个模型和最后的层中都是一样的。

EfficientNet模型的完整细节

之后，每个主干包含7个block。这些block还有不同数量的子block，这些子block的数量随着EfficientNetB0到EfficientNetB7而增加。要可视化模型层，代码如下：

!pip install tf-nightly-gpu

import tensorflow as tf

IMG_SHAPE = (224, 224, 3)
model0 = tf.keras.applications.EfficientNetB0(input_shape=IMG_SHAPE, include_top=False, weights="imagenet")
tf.keras.utils.plot_model(model0) # to draw and visualize
model0.summary() # to see the list of layers and parameters

如果你计算EfficientNet-B0的总层数，总数是237层，而EfficientNet-B7的总数是813层！！但不用担心，所有这些层都可以由下面的5个模块和上面的主干组成。

EfficientNet模型的完整细节