Type: entity
Confidence: 0.90
Created: 2026-04-26
Updated: 2026-04-26
Tags: 深度学习RNN序列建模机器学习

GRU

概述

GRU(Gated Recurrent Unit,门控循环单元)是一种改进的循环神经网络单元,由Cho等人于2014年提出,相比LSTM参数更少、训练更快,已成为序列建模任务中的重要组件。

关键内容

  1. 核心机制: GRU将LSTM的遗忘门输入门合并为一个更新门,同时引入重置门,参数量减少约25%,训练速度提升10-30%。更新门控制前一时刻隐藏状态的信息保留程度,重置门决定在计算候选隐藏状态时前一时刻状态的遗忘程度。

  2. 数学公式

  3. 更新门:z_t = σ(W_z * x_t + U_z * h_{t-1})
  4. 重置门:r_t = σ(W_r * x_t + U_r * h_{t-1})
  5. 候选隐藏状态:~h_t = tanh(W * x_t + U(r_t ⊙ h_{t-1}))
  6. 最终隐藏状态:h_t = (1 - z_t) ⊙ h_{t-1} + z_t ⊙ ~h_t

  7. GRU4Rec中的应用GRU4Rec论文比较了标准RNN、LSTM和GRU三种单元,发现GRU在推荐任务上表现最佳。GRU的参数效率和性能平衡使其成为序列推荐的理想选择,避免了标准RNN的梯度消失问题,同时在相对较短的会话序列上没有LSTM的过拟合倾向。

来源

相关