Pytorch中LSTM各参数解释

PyTorch LSTM模型详解

原创于 2020-02-24 11:51:38 发布 · 1.3k 阅读

4 ·

CC 4.0 BY-SA版权

深度学习专栏收录该内容

20 篇文章

订阅专栏

本文深入探讨了PyTorch中LSTM模型的构建与应用，详细解释了如何定义LSTM层，设置输入数据维度，初始化隐藏状态和记忆单元，以及如何通过实例演示LSTM模型的前向传播过程。

部署运行你感兴趣的模型镜像

import torch
import torch.nn as nn             # 神经网络模块

rnn = nn.LSTM(10, 20, 2) 
# 输入数据x的向量维数10, 设定lstm隐藏层的特征维度20, 此model用2个lstm层。如果是1，可以省略，默认为1)

input = torch.randn(5, 3, 10)
# 输入的input为，序列长度seq_len=5, 每次取的minibatch大小，batch_size=3, 数据向量维数=10（仍然为x的维度）。每次运行时取3个含有5个字的句子（且句子中每个字的维度为10进行运行）
# 初始化的隐藏元和记忆元,通常它们的维度是一样的
# 2个LSTM层，batch_size=3, 隐藏层的特征维度20

h0 = torch.randn(2, 3, 20)
c0 = torch.randn(2, 3, 20)
# 这里有2层lstm，output是最后一层lstm的每个词向量对应隐藏层的输出,其与层数无关，只与序列长度相关
# hn,cn是所有层最后一个隐藏元和记忆元的输出

output, (hn, cn) = rnn(input, (h0, c0))
##模型的三个输入与三个输出。三个输入与输出的理解见上三输入，三输出

print(output.size(),hn.size(),cn.size())
#输出：torch.Size([5, 3, 20]) torch.Size([2, 3, 20]) torch.Size([2, 3, 20])

您可能感兴趣的与本文相关的镜像