GRU原理理解

最新推荐文章于 2026-06-03 09:00:00 发布

转载最新推荐文章于 2026-06-03 09:00:00 发布 · 2.6w 阅读

·

64

·

本内容遵循CC 4.0 BY-SA版权协议

原文链接：https://zhuanlan.zhihu.com/p/32481747

收录于

深度学习

本文深入探讨了GRU（门控循环单元）与LSTM（长短期记忆网络）之间的区别，强调GRU在保持与LSTM相似性能的同时，简化了内部结构，减少了参数数量，从而提高了计算效率和训练速度。GRU通过更新门和重置门控制信息流，实现了对长期依赖的有效捕捉。

1. 什么是GRU

GRU（Gate Recurrent Unit）是循环神经网络（Recurrent Neural Network, RNN）的一种。和LSTM（Long-Short Term Memory）一样，也是为了解决长期记忆和反向传播中的梯度等问题而提出来的。

GRU和LSTM在很多情况下实际表现上相差无几，那么为什么我们要使用新人GRU（2014年提出）而不是相对经受了更多考验的LSTM（1997提出）呢。

在我们的实验中选择GRU是因为它的实验效果与LSTM相似，但是更易于计算。

简单来说就是贫穷限制了我们的计算能力…

相比LSTM，使用GRU能够达到相当的效果，并且相比之下更容易进行训练，能够很大程度上提高训练效率，因此很多时候会更倾向于使用GRU。

OK，那么为什么说GRU更容易进行训练呢，下面开始介绍一下GRU的内部结构。

2. GRU浅析

2.1 GRU的输入输出结构

GRU的输入输出结构与普通的RNN是一样的。
在这里插入图片描述

2.2 GRU的内部结构

在这里插入图片描述

3. LSTM与GRU的关系

在这里插入图片描述

4. 总结

GRU输入输出的结构与普通的RNN相似，其中的内部思想与LSTM相似。

与LSTM相比，GRU内部少了一个”门控“，参数比LSTM少，但是却也能够达到与LSTM相当的功能。考虑到硬件的计算能力和时间成本，因而很多时候我们也就会选择更加”实用“的GRU啦。

在这里插入图片描述

面试补充：

1、画出GRU的结构：

GRU只有两个门。GRU将LSTM中的输入门和遗忘门合二为一，称为更新门（update gate），控制前边记忆信息能够继续保留到当前时刻的数据量；另一个门称为重置门（reset gate），控制要遗忘多少过去的信息。

标签

#机器学习 #深度学习

评论 5

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。