pytorch 预训练模型读取修改相关参数的填坑问题

Tricia ·

更新时间:2024-11-13

· 1194 次阅读

pytorch 预训练模型读取修改相关参数的填坑

修改部分层，仍然调用之前的模型参数。


resnet = resnet50(pretrained=False)
resnet.load_state_dict(torch.load(args.predir))
res_conv31 = Bottleneck_dilated(1024, 256,dilated_rate = 2)
print("---------------------",res_conv31)
print("---------------------",resnet.layer3[1])
res_conv31.load_state_dict(resnet.layer3[1].state_dict())

网络预训练模型与之前的模型对应不上，名称差个前缀


model_dict = model.state_dict()
# print(model_dict)
pretrained_dict = torch.load("/yzc/reid_testpcb/se_resnet50-ce0d4300.pth")
keys = []
for k, v in pretrained_dict.items():
       keys.append(k)
i = 0
for k, v in model_dict.items():
    if v.size() == pretrained_dict[keys[i]].size():
         model_dict[k] = pretrained_dict[keys[i]]
         #print(model_dict[k])
         i = i + 1
model.load_state_dict(model_dict)

最后是修改参数名拿来用的，


from collections import OrderedDict
pretrained_dict = torch.load('premodel')
new_state_dict = OrderedDict()
# for k, v in mgn_state_dict.items():
#     name = k[7:]  # remove `module.`
#     new_state_dict[name] = v
# self.model = self.model.load_state_dict(new_state_dict)
for k, v in pretrained_dict.items():
    name = "model.module."+k   # remove `module.`
    # print(name)
    new_state_dict[name] = v
self.model.load_state_dict(new_state_dict)

pytorch：加载预训练模型中的部分参数，并固定该部分参数(真实有效)

大家在学习pytorch时，可能想利用pytorch进行fine-tune,但是又烦恼于参数的加载问题。下面我将讲诉我的使用心得。

Step1: 加载预训练模型,并去除需要再次训练的层


#注意：需要重新训练的层的名字要和之前的不同。
model=resnet()#自己构建的模型，以resnet为例
model_dict = model.state_dict()
pretrained_dict = torch.load('xxx.pkl')
pretrained_dict = {k: v for k, v in pretrained_dict.items() if k in model_dict}
model_dict.update(pretrained_dict)
model.load_state_dict(model_dict)

Step2：固定部分参数


#k是可训练参数的名字，v是包含可训练参数的一个实体
#可以先print（k）,找到自己想进行调整的层，并将该层的名字加入到if语句中：
for k,v in model.named_parameters():
    if k!='xxx.weight' and k!='xxx.bias' :
        v.requires_grad=False#固定参数

Step3：训练部分参数


#将要训练的参数放入优化器
optimizer2=torch.optim.Adam(params=[model.xxx.weight，model.xxx.bias],lr=learning_rate,betas=(0.9,0.999),weight_decay=1e-5)

Step4：检查部分参数是否固定

debug之后，程序正常运行，最好检查一下网络的参数是否真的被固定了，如何没固定，网络的状态接近于重新训练，可能会导致网络性能不稳定，也没办法得到想要得到的性能提升。


for k,v in model.named_parameters():
   if k!='xxx.weight' and k!='xxx.bias' :
   print(v.requires_grad)#理想状态下，所有值都是False

需要注意的是，操作失误最大的影响是，loss函数几乎不会发生变化，一直处于最开始的状态，这很可能是因为所有参数都被固定了。

以上为个人经验，希望能给大家一个参考，也希望大家多多支持软件开发网。

训练模型 pytorch 预训练模型训练参数模型

1024 个赞

需要登录后方可回复, 如果你还没有账号请注册新账号

Go语言中结构体方法副本传参与指针传参的区别介绍

Rebecca 2021-05-19

817

css选择器设置标签样式的实例代码

Hope 2021-03-01

515

laravel unique验证、确认密码confirmed验证以及密码修改验证的方法

Manda 2020-08-09

879

利用kernel提供的接口打印进程号(pid)

Cynthia 2020-09-01

568

ASP生成静态htm页面基本代码

Mathea 2020-10-15

981

asp下用ADODB.Stream代替FSO读取文本文件

Madeleine 2020-08-15

975

Pytorch实现ResNet网络之ResidualBlock残差块

Kande 2023-05-27

1208

PyTorch常用函数torch.cat()中dim参数使用说明

Tricia 2023-05-27

372

DenseNet121模型实现26个英文字母识别任务

Pandora 2023-07-01

1833

MYSQL数据库连接池及常见参数调优方式

Malina 2023-07-19

1117

Shell脚本传递参数的4种方式实例说明

Bunny 2023-07-20

1813

检查Bash中是否存在输入参数的问题

Willow 2023-07-20

380

Pytorch基础教程之torchserve模型部署解析

Xylona 2023-07-20

1007

PyTorch模型创建与nn.Module构建

Radinka 2023-07-20

293

PyTorch模型容器与AlexNet构建示例详解

Dorothy 2023-07-20

1029

linux环境部署清华大学大模型最新版chatglm2-6b图文教程

Carly 2023-07-20

547

大语言模型的开发利器langchainan安装使用快速入门学习

Irma 2023-07-20

829

langchainPrompt大语言模型使用技巧详解

Posy 2023-07-20

618

Python中pytest的参数化实例解析

Crystal 2023-07-20

1338

vue中watch监听路由传来的参数变化问题

Viridis 2023-07-20

822

我要提问

致谢

帮助他人，成就自己。

人生最大成功就是伸出热情而温暖的双手，尽自己所能去帮助身边的每一个人，只要无私的奉献，就会收获到美好的生活。

1024问感谢每一位朋友的帮助和支持。

软件开发网提供编程的基础软件技术培训教程,软件开发编程实例讲解Go,Node,HTML,CSS,Javascript,Python,Java,Ruby,C,PHP,MySQL等软件开发编程语言以及数据开发的基础知识，也提供大量的软件开发在线实例、从入门到精通就在1024问。

育儿网微养生全球行美食街育儿菜谱大全海南旅游女性养狗百科星座