Type: concept
Confidence: 0.85
Created: 2026-04-16
Updated: 2026-04-16
Tags: 推荐系统因果推断去偏训练方法

MF-IPS

概述

基于 IPS 的矩阵分解(MF-IPS)将逆倾向加权嵌入经验风险最小化框架,在 MNAR 数据上实现近似无偏的矩阵分解训练。

关键内容

  1. 核心思想:传统矩阵分解在观测到的评分上最小化均方误差,等价于在 MCAR 假设下的经验风险最小化(ERM)。MF-IPS 用 IPS 估计器替代朴素的均方误差,从而在 MNAR 数据上实现近似无偏的 ERM。

  2. 优化目标:$\hat{Y}^* = \arg\min_{\hat{Y} \in \mathcal{H}} \hat{R}_{IPS}(\hat{Y}) + \lambda \cdot \text{reg}(\hat{Y})$,其中 $\mathcal{H}$ 是矩阵分解模型的假设空间,$\lambda \cdot \text{reg}(\hat{Y})$ 是正则化项。

  3. 理论保证Tobias Schnabel 等人推导了泛化误差界(generalization error bound),证明了 IPS-ERM 框架的统计学习理论保证。

  4. 与传统的关:当所有 倾向性评分 相等时(即 MCAR),MF-IPS 退化为传统的矩阵分解。这说明传统方法是 MF-IPS 在特殊假设下的特例。

  5. 实验结果:在 Yahoo! R3 和 Coat Shopping 数据集上,MF-IPS 显著优于所有基线方法(MF-Naive、HL-MAR、HL-MNAR),配对 t 检验 p < 0.001。MF-IPS 的性能甚至超过了计算复杂度远高于它的联合似然方法(HL-MNAR)。

  6. 关键启示:一个概念上简单、计算上高效的方法(IPS 加权的矩阵分解),通过正确地处理偏差,可以胜过复杂的联合概率模型。

  7. 局限性:MF-IPS 主要关注 显式反馈(评分)场景。现代推荐系统越来越多地依赖 隐式反馈(点击、浏览、购买),隐式反馈中的偏差模式更加复杂。

来源

相关