时间:2021-05-22
在解决一个任务时,我会选择加载预训练模型并逐步fine-tune。比如,分类任务中,优异的深度学习网络有很多。
ResNet, VGG, Xception等等... 并且这些模型参数已经在imagenet数据集中训练的很好了,可以直接拿过来用。
根据自己的任务,训练一下最后的分类层即可得到比较好的结果。此时,就需要“冻结”预训练模型的所有层,即这些层的权重永不会更新。
以Xception为例:
加载预训练模型:
from tensorflow.python.keras.applications import Xceptionmodel = Sequential()model.add(Xception(include_top=False, pooling='avg', weights='imagenet'))model.add(Dense(NUM_CLASS, activation='softmax'))include_top = False : 不包含顶层的3个全链接网络
weights : 加载预训练权重
随后,根据自己的分类任务加一层网络即可。
网络具体参数:
model.summary
得到两个网络层,第一层是xception层,第二层为分类层。
由于未冻结任何层,trainable params为:20, 811, 050
冻结网络层:
由于第一层为xception,不想更新xception层的参数,可以加以下代码:
model.layers[0].trainable = False
冻结预训练模型中的层
如果想冻结xception中的部分层,可以如下操作:
from tensorflow.python.keras.applications import Xceptionmodel = Sequential()model.add(Xception(include_top=False, pooling='avg', weights='imagenet'))model.add(Dense(NUM_CLASS, activation='softmax'))for i, layer in enumerate(model.layers[0].layers): if i > 115: layer.trainable = True else: layer.trainable = False print(i, layer.name, layer.trainable)加载所有预训练模型的层
若想把xeption的所有层应用在训练自己的数据,并改变分类数。可以如下操作:
model = Sequential()
model.add(Xception(include_top=True, weights=None, classes=NUM_CLASS))
* 如果想指定classes,有两个条件:include_top:True, weights:None。否则无法指定classes
补充知识:如何利用预训练模型进行模型微调(如冻结某些层,不同层设置不同学习率等)
由于预训练模型权重和我们要训练的数据集存在一定的差异,且需要训练的数据集有大有小,所以进行模型微调、设置不同学习率就变得比较重要,下面主要分四种情况进行讨论,错误之处或者不足之处还请大佬们指正。
(1)待训练数据集较小,与预训练模型数据集相似度较高时。例如待训练数据集中数据存在于预训练模型中时,不需要重新训练模型,只需要修改最后一层输出层即可。
(2)待训练数据集较小,与预训练模型数据集相似度较小时。可以冻结模型的前k层,重新模型的后n-k层。冻结模型的前k层,用于弥补数据集较小的问题。
(3)待训练数据集较大,与预训练模型数据集相似度较大时。采用预训练模型会非常有效,保持模型结构不变和初始权重不变,对模型重新训练
(4)待训练数据集较大,与预训练模型数据集相似度较小时。采用预训练模型不会有太大的效果,可以使用预训练模型或者不使用预训练模型,然后进行重新训练。
以上这篇Keras 实现加载预训练模型并冻结网络的层就是小编分享给大家的全部内容了,希望能给大家一个参考,也希望大家多多支持。
声明:本页内容来源网络,仅供用户参考;我单位不保证亦不表示资料全面及准确无误,也不保证亦不表示这些资料为最新信息,如因任何原因,本网内容或者用户因倚赖本网内容造成任何损失或损害,我单位将不会负任何法律责任。如涉及版权问题,请提交至online#300.cn邮箱联系删除。
pytorch预训练层的使用方法将其他地方训练好的网络,用到新的网络里面加载预训练网络1.原先已经训练好一个网络AutoEncoder_FC()2.首先加载该网
问题keras使用预训练模型vgg16分类,损失和准确度不变。细节:使用keras训练一个两类数据,正负比例1:3,在vgg16后添加了几个全链接并初始化了。并
使用预训练模型的代码如下:#加载预训练模型resNet50=models.resnet50(pretrained=True)ResNet50=ResNet(Bo
keras模块里面为我们提供了一个预训练好的模型,也就是开箱即可使用的图像识别模型趁着国庆假期有时间我们就来看看这个预训练模型如何使用吧可用的模型有哪些?根据官
在实践中经常会遇到这样的情况:1、用简单的模型预训练参数2、把预训练的参数导入复杂的模型后训练复杂的模型这时就产生一个问题:如何加载预训练的参数。下面就是我的总