已在开头 下一篇 →

此文为关于因果推断的进一步补充内容。这个版本更简洁,适合速成。

1.因果推断目的

因果推断目的是估算两个效应,群体的ate,个体的ite。 由于在实际中个体ite无法直接观测,以前者为主。
在treatment分组很多时,无法通过简单加权得到ate,引入倾向性得分概念:$\pi{x} = P(T=1|X=x)$
倾向性得分可以用来做人群的分层,常见思路有PSM(倾向性匹配), DR, IPW(逆倾向性加权)等,

2.几种meta-learning快速一览

s-learner 单模型

最简答粗暴的方式,将X和T作为特征,直接训练一个模型,预测$Y_i = F(x_i)$。然后直接估算ite ate:
$ ITE = Y_i(1, x_i) - Y_i(0, x_i) $
$ ATE = \frac{1}{N}\sum_{i=1}^{N}ITE_i $
存在问题:1、如果特征X的维度远高于T,T会被淹没。 2、c-t组差异过大/有偏时,无法有效学习。

t-learner 双模型

思路是用两个模型分别处理treatment和control组,所有t=1的数据训练$ F_1(x)$,所有t=0的数据训练$F_0(x)$,然后预测$Y_i(1, x_i) = F_1(x_i)$,$Y_i(0, x_i) = F_0(x_i)$,然后计算ite ate。
存在问题:1、如果存在大量随机无偏数据,没问题 2、T-Learner无法解决 selection bias问题,导致预估的因果效应可能会存在很大的偏差 3、两个学习器导致可能方差大。

x-learner 交叉模型

此模型为许多深度因果模型的参考,原理图如下
x-learner

3.离线评估方法

模拟数据集有真实ground truth的ite和ate,可以直接计算误差mae_ate 和pehe,即ate集记的损失,比较直观。
在真实数据集上,无法直接计算误差. 在rct条件(treatment随机)下,评价指标如下:

mae—att

att(average treatment effect on the treated)是treatment组的平均干预效应,计算公式为: $ATT = \frac{1}{|T|}\sum_{i \in T}{Y(i)} - \frac{1}{|C|}\sum_{i \in C}{Y(i)}$
mae-att是预估的att和真实att的误差,计算公式为: $MAE_{ATT} = |\frac{1}{|T|}\sum_{i \in T}\tau_(i)- ATT|$
mae_att越小表明对treatment组的干预效应预估越准确。

qini系数和auuc 略,(可参考)[https://zhuanlan.zhihu.com/p/627342229]