paddle复现pytorch踩坑(一):Resnet复现

该博客介绍了如何在PaddlePaddle框架中复现ResNet模型的初始化过程,包括对卷积层和批量归一化层的初始化。在PyTorch和PaddlePaddle中,代码有所不同。对于卷积层,使用不同的方法进行权重初始化,而在批量归一化层,设置权重和偏置的初始值。同时,详细对比了PyTorch和PaddlePaddle中设置ResNet层4的子模块参数的差异。

paddlepaddle中关于Resnet复现的实际解决代码

1. 遍历模块初始化部分

pytorch代码:

for m in self.modules():
    if isinstance(m, nn.Conv2d):
        nn.init.kaiming_normal_(m.weight, mode='fan_out', nonlinearity='relu')
    elif isinstance(m, nn.BatchNorm2d):
        nn.init.constant_(m.weight, 1)
        nn.init.constant_(m.bias, 0)

paddle代码:

for m in self.modules():
    if isinstance(m, nn.Conv2d):
        n = m.kernel_size[0] * m.kernel_size[1] * m.out_channels
        m.weight.data.normal_(0, math.sqrt(2. / n))
    elif isinstance(m, BatchNorm):
        m.weight.data.fill_(1)
        m.bias.data.zero_()

或者:

for m in self.modules():
    if isinstance(m, nn.Conv2d):
        n = m.kernel_size[0] * m.kernel_size[1] * m.out_channels
        m.weight.data.normal_(0, math.sqrt(2. / n))
    elif isinstance(m, BatchNorm):
        m.weight.data.fill_(1)
        m.bias.data.zero_()

2. 模块初始化

pytorch版本:

for n, m in self.layer4.named_modules():
    if 'conv2' in n:  # conv1 for resnet34
        m.dilation, m.padding, m.stride = (2, 2), (2, 2), (1, 1)
    elif 'downsample.0' in n:
        m.stride = (1, 1)

paddlepaddle版本:

for n, m in self.layer4.named_sublayers():
    if 'conv2' in n:  # conv1 for resnet34
        m.dilation = fluid.initializer.ConstantInitializer(value=[2,2])
        m.padding = fluid.initializer.ConstantInitializer(value=[2,2])
        m.stride = fluid.initializer.ConstantInitializer(value=[1,1])
    elif 'downsample.0' in n:
        m.stride = fluid.initializer.ConstantInitializer(value=[1,1])
评论 5
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值