双向RNN：bidirectional_dynamic_rnn()函数

最新推荐文章于 2025-10-08 00:54:44 发布

原创

最新推荐文章于 2025-10-08 00:54:44 发布 · 1.6w 阅读

·

6

·

CC 4.0 BY-SA版权

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

文章标签：

#tensorflow #双向RNN

本文介绍了双向RNN的重要性，并通过一个例子说明其在处理序列信息时的优势。详细解析了TensorFlow中的`tf.nn.bidirectional_dynamic_rnn()`函数，包括前向传播、反向传播的过程，以及如何利用`reverse_sequence()`处理输入序列。最后讨论了输出状态的处理方式，为解码器提供初始状态。

双向RNN：bidirectional_dynamic_rnn()函数

先说下为什么要使用到双向RNN，在读一篇文章的时候，上文提到的信息十分的重要，但这些信息是不足以捕捉文章信息的，下文隐含的信息同样会对该时刻的语义产生影响。

举一个不太恰当的例子，某次工作会议上，领导进行“简洁地”总结，他会在第一句告诉你：“下面，为了节约时间，我简单地说两点…”，（…此处略去五百字…），“首先，….”，（…此处略去一万字…），“碍于时间的关系，我要加快速度了，下面我简要说下第二点…”（…此处再次略去五千字…）“好的，我想说的大概就是这些”（…此处又略去了二百字…），“谢谢大家！”如果将这篇发言交给一个单层的RNN网络去学习，因为“首先”和“第二点”中间隔得实在太久，等到开始学习“第二点”时，网络已经忘记了“简单地说两点”这个重要的信息，最终的结果就只剩下在风中凌乱了。。。于是我们决定加一个反向的网络，从后开始往前听，对于这层网络，他首先听到的就是“第二点”，然后是“首先”，最后，他对比了一下果然仅仅是“简要地两点”，在于前向的网络进行结合，就深入学习了领导的指导精神。

这里写图片描述

上图是一个双向LSTM的结构图，对于最后输出的每个隐藏状态 $h$ 都是前向网络和后向网络的元组，即 $h = (\overset{\leftarrow}{h}, \vec{h})$

最低0.47元/天解锁文章

评论 3

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。