一文读懂EfficientNet

news/2024/7/5 6:59:59

点击上方“小白学视觉”,选择加"星标"或“置顶

重磅干货,第一时间送达4ae8261dcc28c3a1df7243874c5e3d27.png

导读

 

本文介绍了一种高效的网络模型EfficientNet,并分析了 EfficientNet B0 至B7的网络结构之间的差异。

我在一个Kaggle竞赛中翻阅notebooks,发现几乎每个人都在使用EfficientNet 作为他们的主干,而我之前从未听说过这个。

谷歌AI在这篇文章中:https://arxiv.org/abs/1905.11946介绍了它,他们试图提出一种更高效的方法,就像它的名字所建议的那样,同时改善了最新的结果。一般来说,模型设计得太宽,太深,或者分辨率太高。刚开始的时候,增加这些特性是有用的,但很快就会饱和,然后模型的参数会很多,因而效率不高。在EfficientNet中,这些特性是按更有原则的方式扩展的,也就是说,一切都是逐渐增加的。

ab20bd25e25aa7274ab564e38c22421d.png

不明白发生了什么?不要担心,一旦看到了架构,你就会明白了。但首先,让我们看看他们得到了什么结果。

15a0097dba9d06f29ff197c74638c46c.png

由于参数的数目相当少,这个模型族是非常高效的,也提供更好的结果。现在我们知道了为什么这些可能会成为标准的预训练模型,但是缺少了一些东西。

共同之处

首先,任何网络都以它为主干,在此之后,所有对架构的实验都以它为开始,这在所有8个模型和最后的层中都是一样的。

4978a427f3b9fce6a0d04240e4f02672.png

之后,每个主干包含7个block。这些block还有不同数量的子block,这些子block的数量随着EfficientNetB0到EfficientNetB7而增加。要可视化模型层,代码如下:

!pip install tf-nightly-gpuimport tensorflow as tfIMG_SHAPE = (224, 224, 3)
model0 = tf.keras.applications.EfficientNetB0(input_shape=IMG_SHAPE, include_top=False, weights="imagenet")
tf.keras.utils.plot_model(model0) # to draw and visualize
model0.summary() # to see the list of layers and parameters

如果你计算EfficientNet-B0的总层数,总数是237层,而EfficientNet-B7的总数是813层!!但不用担心,所有这些层都可以由下面的5个模块和上面的主干组成。

a5424b6abbbc3e32cd0ff28add36eb89.png

我们使用这5个模块来构建整个结构。

  • 模块1 — 这是子block的起点。

  • 模块2 — 此模块用于除第一个模块外的所有7个主要模块的第一个子block的起点。

  • 模块3 — 它作为跳跃连接到所有的子block。

  • 模块4 — 用于将跳跃连接合并到第一个子block中。

  • 模块5 — 每个子block都以跳跃连接的方式连接到之前的子block,并使用此模块进行组合。

这些模块被进一步组合成子block,这些子block将在block中以某种方式使用。

839c0bbcae59ceae11158d24cf471335.png

  • 子block1 — 它仅用于第一个block中的第一个子block。

  • 子block2 — 它用作所有其他block中的第一个子block。

  • 子block3 — 用于所有block中除第一个外的任何子block。

到目前为止,我们已经指定了要组合起来创建EfficientNet模型的所有内容,所以让我们开始吧。

模型结构

EfficientNet-B0

9e95a433b4b0611465ea50103e83c2ef.png

EfficientNet-B0架构。(x2表示括号内的模块重复两次)

EfficientNet-B1

bb33617e10e00672671c7bac907195a6.png

EfficientNet-B1的结构

EfficientNet-B2

它的架构与上面的模型相同,唯一的区别是特征图(通道)的数量不同,增加了参数的数量。

EfficientNet-B3

a4a1591038f5956ca9f410b67d4344e3.png

EfficientNet-B3的结构

EfficientNet-B4

c946949c70b22fe294eef42997b47936.png

EfficientNet-B4的结构

EfficientNet-B5

1d11c146ac070b77d9efd82610fe93a5.png

EfficientNet-B5的结构

EfficientNet-B6

ee48afac1edffaf91cdba9194453de64.png

EfficientNet-B6的结构

EfficientNet-B7

c11e1e0b5bc2dc6668ca3b780b539038.png

EfficientNet-B7的结构

很容易看出各个模型之间的差异,他们逐渐增加了子block的数量。如果你理解了体系结构,我鼓励你将任意的模型打印出来,并仔细阅读它以更彻底地了解它。下面的表表示了EfficientNet-B0中卷积操作的内核大小以及分辨率、通道和层。

9f14e4def7fcbcb0bc5b4ca779987dd1.png

此表已包含在原始论文中。对于整个模型族来说,分辨率是一样的。我不确定卷积核的大小是否改变了。层的数量已经在上面的图中显示了。通道数量是不同的,它是根据从每个型号的摘要中看到的信息计算出来的,如下所示:

97d8c4c6e939ab4419238edcbec4d63e.png

在结束之前,我附上了另一个图像,来自它的研究论文,显示了它与其他的SOTA的performance的比较,还有减少的参数的数量和所需的FLOPS。

49abd3bb0aec6f3b9bf0070b9181f810.png

原文链接:

https://towardsdatascience.com/complete-architectural-details-of-all-efficientnet-models-5fd5b736142

小白团队出品:零基础精通语义分割↓

c64099d88e77a1874fde4c05c15fc4ff.png

下载1:OpenCV-Contrib扩展模块中文版教程

在「小白学视觉」公众号后台回复:扩展模块中文教程即可下载全网第一份OpenCV扩展模块教程中文版,涵盖扩展模块安装、SFM算法、立体视觉、目标跟踪、生物视觉、超分辨率处理等二十多章内容。

下载2:Python视觉实战项目52讲

在「小白学视觉」公众号后台回复:Python视觉实战项目即可下载包括图像分割、口罩检测、车道线检测、车辆计数、添加眼线、车牌识别、字符识别、情绪检测、文本内容提取、面部识别等31个视觉实战项目,助力快速学校计算机视觉。

下载3:OpenCV实战项目20讲

在「小白学视觉」公众号后台回复:OpenCV实战项目20讲即可下载含有20个基于OpenCV实现20个实战项目,实现OpenCV学习进阶。

交流群

欢迎加入公众号读者群一起和同行交流,目前有SLAM、三维视觉、传感器、自动驾驶、计算摄影、检测、分割、识别、医学影像、GAN、算法竞赛等微信群(以后会逐渐细分),请扫描下面微信号加群,备注:”昵称+学校/公司+研究方向“,例如:”张三 + 上海交大 + 视觉SLAM“。请按照格式备注,否则不予通过。添加成功后会根据研究方向邀请进入相关微信群。请勿在群内发送广告,否则会请出群,谢谢理解~

6433d0414abacda489f1f52eb978fd4b.png

13466d0c6f71c7e3875e9bf76fddeaf8.png


http://lihuaxi.xjx100.cn/news/267079.html

相关文章

利用python爬取IP地址归属地等信息!

被使用的例子: IP:202.204.80.112 更多关于IP138的信息:https://blog.csdn.net/weixin_42859280/article/details/83752510 源代码: import requests url "http://m.ip138.com/ip.asp?ip" try:r requests.get(url 202.204.80.112)r.raise…

在字节跳动工作是什么样的体验?

链接:https://www.zhihu.com/question/28881353/answer/1912209855编辑:深度学习与计算机视觉声明:仅做学术分享,侵删作者:爱喝可乐的喵https://www.zhihu.com/question/28881353/answer/128694674工作久了之后&#x…

Linux下通过txt文件导入数据到MySQL数据库

1、修改配置文件 在 /etc/my.conf 中添加 local_infile1 2、重启MySQL >service mysqld restart 3、登录数据库 登录时添加参数 --local-infile >mysql --local-infile -uroot -p 4、进入相应的数据库导入数据转载于:https://www.cnblogs.com/SiriYang/p/10641954.html

List集合的去除重复性练习

package com.java.b.listdmeo.www; import java.util.ArrayList;import java.util.Iterator; import com.java.Student.www.Student; public class listtest { public static void main(String[] args) { //创建一个集合,该集合为List 集合 ArrayList listnew Arr…

10个 Python 工程师,9个不合格!

毋庸置疑,Python越来越被认可为程序员新时代的风口语言。 无论是刚入门的程序员,还是年薪百万的 BATJ 的大牛都无可否认:Python的应用能力是成为一名码农大神的必要项。 所以,很多程序员把Python当做第一语言来学习。 但对于Pytho…

Feed流系统设计

点击上方蓝色“方志朋”,选择“设为星标”回复“666”获取独家整理的学习资料!来源:r6d.cn/E8pb差不多十年前,随着功能机的淘汰和智能机的普及,互联网开始进入移动互联网时代,最具代表性的产品就是微博、微…

LINUX新手入门-1.装系统

LINUX新手入门-1.装系统首先我们用虚拟机模拟 装linux系统,然后下一步下一步,然后完成后,编辑一些设置,把镜像放上面就可以了选第一项,安装系统,查看镜像是否能运行,直接跳过,选择语…

豪气!华为放话:3年培养100万AI人才!网友神回应了

大家经常把BAT挂在嘴边,但是可能有些人还不知道,华为的体量早已超越了这三巨头,只是迟迟不肯上市。华为的创始人任正非曾说表:上不上市不重要,最重要的是要让中国华为的技术能够称霸全球!华为对技术的重视&…