Type: entity
Confidence: 0.90
Created: 2026-04-16
Updated: 2026-04-16
Tags: 推荐系统序列推荐会话推荐RNNGRUICLR

GRU4Rec

概述

Balazs Hidasi 等人于 ICLR 2016 发表的开创性论文,首次将 GRU 引入会话推荐场景,通过 Session-Parallel Mini-Batch 训练策略和排序损失函数,开创了深度学习在序列推荐领域的先河。

关键内容

  1. 论文信息:标题 "Session-based Recommendations with Recurrent Neural Networks",作者 Balazs Hidasi, Alexandros Karatzoglou, Linas Baltrunas, Donat Tikk,机构 Gravity R&D(匈牙利)/ Telefonica Research(西班牙),发表于 ICLR 2016,首次公开 2015年11月(arXiv: 1511.06939),累计引用超过 4000 次(截至2025年)。

  2. 核心问题:给定匿名用户在当前会话中的点击序列 $[x_1, x_2, ..., x_t]$,预测下一次最可能点击的物品 $x_{t+1}$。不使用任何跨会话的用户信息,不依赖显式用户画像,本质上是一个序列到一的预测问题。

  3. 架构设计:输入层(1-of-N 编码)→ GRU 层(单层,100 隐藏单元)→ 输出层(全连接 + 排序损失)。实验发现 GRU > LSTM > 标准 RNN,单层即可取得最佳效果。

  4. Session-Parallel Mini-Batch 训练策略:将多个会话并排放置,每步取各会话的当前事件作为输入、下一事件作为目标;会话结束时替换为新会话并重置对应隐藏状态。充分利用 GPU 并行能力,mini-batch 内其他会话的目标物品天然作为负样本。

  5. 排序损失函数:提出 BPR LossTOP1 Loss 两种 pairwise 排序损失,显著优于交叉熵交叉熵在100次随机实验中仅10次收敛)。TOP1 内置正则化项使其在更大隐藏层尺寸下表现更稳定。

  6. 实验结果:在 RSC15(YOOCHOOSE)数据集上,Recall@20 达 0.5196,MRR@20 达 0.2164,相比 Item-KNN 提升约 20-30%。后续 GRU4Rec v2(CIKM 2018)提出 BPR-max 和 TOP1-max,性能再提升 35%。

  7. 历史地位:开创了基于深度学习的序列推荐研究方向,将 NLP 中的序列建模思想迁移到推荐系统。催生了 NARM(2017, 注意力机制)、HRNN(2017, 层次化 RNN)、STAMP(2018, 纯注意力)、SASRec(2018, 自注意力)、BERT4Rec(2019, 双向 Transformer)、SR-GNN(2019, 图神经网络)等一系列后续工作。

  8. 局限性:RNN 单向顺序处理无法并行化;完全丢失会话间信息;无法捕获全局物品关系;使用简单 one-hot 编码未利用物品侧信息;在某些场景下被精心设计的会话 KNN 方法超越。

  9. 工业界采纳Spotify 和 Pinterest 等公司的推荐系统借鉴了 GRU4Rec 的思想。在 NVIDIA Merlin / Transformers4Rec 等现代框架中仍保留为标准基线模型。

来源

相关